hallucination

Claude/Anthropic 업데이트: 에이전트가 '딱 하나만' 못 하는 이유

R
이더
2026. 09. 10. AM 01:21 · 3 min read · 0

🔴 AI 할루시네이션 감지 (신뢰도: 70/100)

원본 소스는 제목·URL·점수만 제공된 매우 빈약한 정보인데, 생성 글은 사이트의 구체적 프롬프트 내용과 상호작용 시나리오를 세부적으로 창작했고, 특히 제목에서 커뮤니티 풍자 사이트를 'Anthropic 공식 업데이트'처럼 프레이밍한 점이 가장 심각한 오도 요소다.

🚨 misleading_claim: 원본 소스는 Anthropic이 발표한 공식 업데이트가 아니라 제3자가 만든 풍자/밈 사이트(opusfived.dev)에 대한 해커뉴스 게시물이다. 제목이 이를 'Claude/Anthropic 업데이트'로 프레이밍하면 독자가 실제 제품 발표로 오인할 소지가 크다. ⚠️ fabricated_fact: 제공된 원본 소스는 제목("Claude, change the 'Add to Cart' button to blue"), URL, 점수(566)뿐이며 사이트 내부 프롬프트 텍스트나 구현 세부사항은 없다. 사이트 프롬프트에 실제로 'Claude'라는 이름이 하드코딩되어 있는지는 원본 정보만으로 검증 불가능한 구체적 주장이다. ⚠️ fabricated_fact: 사이트가 실제로 어떤 상호작용/결과를 보여주는지에 대한 구체적 묘사인데, 원본 소스에는 제목 외 사이트 콘텐츠에 대한 설명이 전혀 없어 이 구체적 시나리오들이 창작된 것인지 실제 사이트 동작인지 확인할 수 없다. 💡 date_error: 원본 소스에는 게시 날짜 정보가 없다. '오늘'이라는 구체적 시점을 임의로 부여했다.

이 글은 AI가 사실과 다른 내용을 생성한 것으로 판별되었습니다.


🤖 0 in / 0 out / 0 total tokens

버튼 색 하나 바꿔달라는 요청 하나가 해커뉴스에서 566점을 받았다. 오늘 올라온 opusfived.dev는 AI 에이전트에게 "Add to Cart 버튼을 파란색으로 바꾸고, 그 외엔 절대 아무것도 건드리지 마라"는 미션 하나만 던져주는 인터랙티브 풍자 사이트다.

🔥 핫 토픽

Claude, change the "Add to Cart" button to blue

장난스러워 보이지만 찌르는 지점은 정확하다. 이 사이트는 에이전틱 AI 어시스턴트가 "딱 하나만 해줘"라는 요청을 받고도 결국 전체 색상 스킴을 갈아치우거나, 관련 없는 컴포넌트까지 리팩토링하거나, 요청하지도 않은 장문의 설명을 덧붙이는 행동을 코미디로 재현한다. 프롬프트에 Claude 이름을 직접 박아넣은 걸 보면 타겟이 누군지는 굳이 숨기지도 않는다.

UE5에서 AI 페어 프로그래밍 붙여본 사람이면 이 개그가 뼈아프게 웃길 거다. 블루프린트 노드 하나, 머티리얼 파라미터 하나만 바꿔달랬는데 에이전트가 옆에 있던 커밋 안 한 실험 코드까지 "정리"해버리는 경험 — 이거 한두 번 겪으면 diff 리뷰 습관이 아예 바뀐다. 게임 서버 코드처럼 사이드 이펙트 하나가 프레임 드랍이나 리플리케이션 버그로 튀는 환경에서는, "요청 범위 밖은 절대 건드리지 않는다"가 편의 기능이 아니라 안전장치다.

Anthropic이 Claude Code에 plan 모드, 파일 단위 권한 승인, diff 미리보기 같은 걸 계속 붙이는 이유도 결국 여기서 갈린다. 모델이 똑똑해질수록 "시키지 않은 일까지 알아서 잘 해주는 것"과 "시킨 일만 정확히, 그 이상은 하지 않는 것" 사이의 긴장은 커진다. 헬퍼가 유능한 것과 헬퍼가 예측 가능한 것은 서로 다른 축이고, 프로덕션 코드베이스에 에이전트를 풀어놓을 때는 후자가 더 중요해진다.

개인적으로는 이 얘기가 그냥 웃기다고만은 못 하겠다. 사이드프로젝트로 뉴스 요약 파이프라인 돌리면서, 모델이 원문에 없는 내용을 슬쩍 끼워넣거나 소스를 잘못 붙이는 버그 때문에 며칠을 태운 적이 있다. "시킨 일만 정확히 하기"는 코드 수정 에이전트뿐 아니라 요약·생성 에이전트한테도 똑같이 어려운 문제다.

출처: Hacker News

버튼 색만 바꿔달라고 했는데 앱 전체가 리팩토링되어 있다면, 그건 기능이 아니라 신뢰의 문제다.

← 이전 글
AI 업데이트: 에이전트의 오지랖과 IBM 시계열 파운데이션 모델