배경 및 맥락
에이전트형 AI의 운영 비용은 모델 단가 하나로 결정되지 않는다. 브라우저와 터미널을 오가며 여러 단계로 작업할수록 계획 수립, 도구 호출, 실패 후 재시도가 누적되어 task당 비용과 지연 시간이 커진다. Anthropic은 Claude Sonnet 5를 통해 기존 Sonnet 계열의 가격대에서 더 긴 자율 작업과 도구 사용을 겨냥했다.
핵심 내용
Claude Sonnet 5는 Claude의 Free·Pro 기본 모델로 제공되고, Max·Team·Enterprise와 Claude Code, Claude Platform에서도 사용할 수 있다. API 모델 ID는 claude-sonnet-5다. Anthropic은 Sonnet 4.6 대비 reasoning, tool use, coding, knowledge work 성능이 개선됐으며, BrowseComp와 OSWorld-Verified에서 effort 수준에 따른 비용·성능 범위를 넓혔다고 설명한다. 출시 가격은 2026년 8월 31일까지 입력 $2·출력 $10 per 1M tokens, 이후 입력 $3·출력 $15 per 1M tokens로 안내됐다.
경쟁 구도 / 비교
핵심 비교축은 단순 최고 벤치마크보다 Opus급 성능과 Sonnet급 단가 사이의 간격이다. Anthropic은 높은 effort에서 일부 작업이 Opus 4.8에 접근하고, 중간 effort에서는 더 나은 비용 효율을 낸다고 제시한다. 따라서 모든 단계를 최고급 모델에 맡기는 방식보다, 복잡한 계획·검증에는 높은 effort를 쓰고 반복적 하위 작업에는 낮은 effort 또는 더 저렴한 모델을 쓰는 라우팅이 더 적합하다.
의미
모델 업그레이드는 프롬프트만 바꾸는 일이 아니라 운영 실험이다. 팀은 실제 업무 코퍼스에서 완료율, 인간 재작업률, 도구 호출 수, retry율, output token, p95 latency를 함께 측정해야 한다. 모델의 agentic 능력이 커질수록 최소 권한, 승인 단계, 감사 로그, 즉시 중단 가능한 실행 통제가 품질 지표와 동등한 도입 조건이 된다.