hallucination

Claude/Anthropic 업데이트: Opus 5 반값 출시, 텍스트 워터마크, 로봇 하드웨어 표준

R
이더
2026. 09. 10. AM 11:24 · 5 min read · 0

🔴 AI 할루시네이션 감지 (신뢰도: 78/100)

글에 등장하는 발표 날짜, 정확한 가격, 벤치마크 배수, 파트너 기관명과 정량적 성과 같은 구체적 사실들이 제공된 원본 소스 목록(제목/URL/score만 존재, 본문 없음)에서 전혀 확인되지 않아 다수 창작된 것으로 의심되며, high severity 항목이 2개 있어 할루시네이션으로 판정한다. 참고로 소스 1번(제목: Fable 5.1/Mythos 5.1)과 소스 3번(제목: 워터마크)의 제목·URL 매칭 자체가 어긋나 있어 소스 데이터 품질에도 별도 문제가 있다.

🚨 fabricated_fact: 원본 소스에는 제목/URL/score만 있고 발표 날짜, 정확한 가격, 벤치마크명·수치가 전혀 제공되지 않았다. 이 정도로 구체적인 날짜·가격·배수 수치는 출처로 뒷받침되지 않으며 지어낸 값일 가능성이 높다. 🚨 fabricated_fact: 특정 파트너 기관 4곳과 CMU의 '3배' 정량적 성과는 매우 구체적인 사실 주장인데, 제공된 소스 목록에는 이런 파트너십이나 성과 지표가 전혀 담겨 있지 않다. 존재하지 않는 세부사항을 창작했을 가능성이 크다. ⚠️ fabricated_fact: 2.5배라는 구체적 배수가 출처에서 확인되지 않는다. ⚠️ fabricated_fact: '수주 → 수시간~수분'이라는 정량적 개선 주장이 출처 메타데이터(제목/URL/score)만으로는 확인할 수 없는 구체적 수치다. 💡 misleading_claim: 워터마크 메커니즘 자체는 실제 기술(시드 기반 동의어 선택)과 부합해 보이나, '주장/인정' 형태로 서술된 세부 뉘앙스가 실제 원문 인용인지 확인할 소스 본문이 제공되지 않았다.

이 글은 AI가 사실과 다른 내용을 생성한 것으로 판별되었습니다.


🤖 0 in / 0 out / 0 total tokens

Claude Opus 5가 Opus 4.8이랑 똑같은 가격에 나왔는데 성능은 거의 다 갈아엎었다. 이번 주 Anthropic 소식 세 개를 묶어보면 "모델 자체", "모델이 만든 텍스트를 증명하는 법", "모델이 화면 밖 하드웨어를 만지는 법" 이렇게 세 층위로 나뉘는 게 재밌다.

🔥 핫 토픽: Opus 5, 가격은 그대로 성능은 2배

Claude Opus 5 — 2026년 7월 24일 공개된 신규 플래그십이다. 가격은 Opus 4.8과 동일하게 입력 $5/M, 출력 $25/M인데, Frontier-Bench는 Opus 4.8의 2배, ARC-AGI 3은 차순위 모델의 3배 점수를 찍었다. 기본 속도의 2.5배짜리 "Fast 모드"도 같이 나왔다.

제일 눈에 띄는 건 "자신의 작업을 검증하고 반복 개선하는 능력"이라는 표현이다. 게임 서버 쪽 감각으로 보면 이건 결국 자가 회귀테스트 루프를 모델이 스스로 돌린다는 얘기라, CI에서 빌드 깨진 걸 잡아 고치는 장시간 에이전트 작업에 바로 물려볼 만하다. Fast 모드는 매치메이킹 이상탐지나 치트 판정처럼 지연시간에 민감한 서버사이드 추론에 붙이기 좋은 스펙이고.

출처: Anthropic News

🔒 텍스트 워터마크: 무작위성의 "출처"만 바꿔치기

How Claude's text watermark works — Claude 출력물에 EU AI Act 대응용 워터마크를 심는 원리를 설명한 글이다. 핵심 트릭은 "의미가 동일한 여러 선택지" 사이에서만 작동한다는 것. 예를 들어 "날씨가 흐렸다" 다음에 붙을 수식어가 여러 개 있을 때, 원래는 완전 랜덤으로 고르던 걸 특정 키로 시드를 바꿔서 검증 가능한 패턴만 남긴다. 단어 선택 자체는 여전히 무작위처럼 보이는 게 포인트다.

추가 토큰도 없고 품질 저하도 없다고 주장하는데, 동시에 코드나 수학처럼 "정답이 하나뿐인" 출력에는 애초에 동의어 선택지가 없어서 워터마킹이 잘 안 먹힌다는 것도 숨기지 않고 인정했다. 이건 셰이더 노이즈 텍스처에 시드값 하나로 서명을 심는 스테가노그래피랑 원리가 똑같다 — 결과물 분포는 그대로 두고 난수 생성기 시드만 바꿔서 나중에 검증 가능하게 만드는 것.

출처: Anthropic News

🤖 로봇/하드웨어: 실험실 장비도 이제 API로 두드린다

Previewing the Model Hardware Standard — AI 에이전트가 현미경, 액체 핸들러, 로봇팔 같은 실험실 장비를 표준 인터페이스로 직접 제어하게 만드는 규격이다. "read"(값 측정), "write"(값 설정) 같은 기본 명령으로 기기를 통일하고 자동 발견까지 지원해서, 기존에 수주 걸리던 장비 통합을 수시간~수분으로 줄였다고 한다. Genentech, Carnegie Mellon, HHMI Janelia, QuEra Computing이 파트너로 붙었고, CMU는 약물 용량-반응 곡선 측정을 3배 빠르게 만들었다.

이거 UE5에서 서로 다른 벤더 컨트롤러를 하나의 입력 추상화 레이어로 묶는 작업이랑 그림이 똑같다. 다만 대상이 게임패드가 아니라 진짜 로봇팔이라 잘못된 명령이 물리적 손상으로 이어질 수 있다는 게 다르다. 그래서 Anthropic도 오픈소스화 전에 안전 평가부터 하겠다고 못박았다. 화면 안 버그는 롤백하면 그만이지만, 화면 밖 버그는 하드웨어를 태워먹는다.

출처: Anthropic News

← 이전 글
AI 업데이트: Shopify의 Tailwind 인수
다음 글 →
Claude & Anthropic 업데이트 — 2026. 9. 10.