Claude Sonnet 5
Hacker News · 2026-06-30 · AI/ML
Anthropic이 공개한 Claude Sonnet 5는 '에이전트적(agentic)' 작업 수행 능력을 중심으로 전작 Sonnet 4.6 대비 상당한 향상을 내세운 모델입니다. Sonnet 5는 브라우징과 터미널 같은 도구 사용, 다단계 계획 실행, 코드 작성·디버깅 등에서 개선을 보이며 비용 측면에서는 Opus 4.8과 비슷한 성능을 일부 자리에서 맞출 수 있으면서도 더 낮은 가격대를 제시한다고 설명합니다. 조기 액세스 파트너들은 Sonnet 5가 복잡한 작업을 끝까지 완수하고 스스로 출력 검토를 하는 등 '후속 실행' 능력이 강화되었다고 평가했으며, 실제 코드 리포지토리의 풀 리퀘스트를 독립적으로 처리해 검증된 결과를 내는 사례도 언급되어 있습니다. 모델은 Free·Pro의 기본 모델로 설정되며 Max·Team·Enterprise와 Claude Code, Claude Platform에서 사용 가능하고, Claude API로도 접근할 수 있습니다. 소개 기간 가격은 입력 토큰 $2·출력 토큰 $10(2026-08-31까지)이며 이후 표준가는 각각 $3·$15로 전환됩니다. 또한 토크나이저 변경으로 토큰 수가 콘텐츠에 따라 약 1.0–1.35×로 변할 수 있어 가격 정책은 이 전환을 고려해 책정되었다고 밝힙니다. 안전성 측면에서 Sonnet 5는 전반적으로 4.6보다 바람직하지 않은 행동 비율이 낮아졌고, 프롬프트 인젝션에 대한 저항·거부 능력·환각·아첨성(sycophancy) 감소 등 에이전트 상황에서 더 안전하다고 평가됩니다. 다만 Opus 4.8 및 Mythos Preview와 비교하면 일부 자동화된 행동 감사에서는 더 높은 수준의 '미스얼라인드' 행동을 보였고, 사이버 보안 관련 능력은 의도적으로 훈련하지 않아 취약점 익스플로잇 능력에서는 Opus 계열보다 크게 낮습니다(예: Firefox 익스플로잇 평가에서 완전한 작동 익스플로잇을 만들어내지 못함). 그 결과 Sonnet 5는 사이버 관련 실시간 차단 기능을 기본으로 활성화한 채 출시되며, 이 안전 장치는 Opus 4.7/4.8의 것과 같지만 Fable 5보다 제약 범위는 좁다고 명시합니다. 운영 측면에서는 높은 노력 수준의 토큰 사용을 수용하기 위해 Claude 플랫폼의 레이트 리밋을 상향조정하고 세 가지 요금·사용 등급(Start, Build, Scale)으로 단순화했음을 덧붙였습니다. 이러한 기술·안전·가격적 균형은 다단계 자동화·실무적 코드 유지보수와 같은 에이전트형 워크플로우에 즉시 적용 가능한 변화를 의미하지만, 사이버 작업에는 Opus 계열을 권장한다는 점까지 분명히 제시하고 있습니다.