핵심 요약
Anthropic Claude Opus 5(claude-opus-5, 2026-07-24 출시)는 1M 토큰 컨텍스트(기본=최대, long-context surcharge 없음) 와 5단계 effort ladder(low·medium·high·xhigh·max)를 제공합니다(Amplifi Labs, 2026-07-24). API 가격은 Opus 4.8과 동일한 $5/$25 per MTok(input/output) 이며, effort는 output_config.effort로 설정합니다(Hashnode, 2026-07-24). agentic coding·장시간 작업에서 비용 예측 가능성이 핵심 차별점입니다.
무슨 일이 있었나
Opus 5 출시(2026-07-24)와 함께 벤치마크가 갱신됐습니다(Oflight, 2026-07):
- Frontier-Bench v0.1: high 18.7% → xhigh 44.4%
- OSWorld 2.0: 55.7% → 70.57%
- SWE-bench Verified: 96.0%
Effort 5단계(Hashnode, Amplifi Labs):
| Level | 용도 |
|-------|------|
| low | 서브에이전트·비용 민감 routing |
| medium | 균형 |
| high | API default (생략 시 동일) |
| xhigh | 30분+ 장기 agentic, million-token budget |
| max | 최대 reasoning depth |
Breaking changes: xhigh·max에서는 thinking disable 불가(400 error). Opus 4.8은 legacy, Opus 4.1은 2026-08-05 retire(Oflight, 2026-07).
컨텍스트·출력: 동기 Messages API max output 128K, Batches API+beta header 시 300K(eesel AI, 2026-07). 캐시 read $0.50/MTok, Batch API half rate.
Anthropic(2026-03-13)은 Opus/Sonnet 4.6부터 1M GA·long-context premium 폐지를 발표했고, Opus 5도 동일 정책입니다.
실무 트레이드오ff
1. Task routing: 단순 refactor·lint fix → low/medium on Sonnet/Haiku; multi-file migration·security review → Opus high~xhigh.
2. xhigh vs max: Frontier-Bench에서 xhigh(44.4%) > max(43.3%) — '무조건 max'가 비용·latency만 키울 수 있음(Oflight, 2026-07).
3. 1M context 함정: system prompt + tool defs + 이전 turn thinking blocks가 모두 input billing(Amplifi Labs). compaction·요약 전략 필수.
4. Rate limit: Opus 5는 별도 bucket — 4.x pool과 분리(eesel AI).
체크포인트
- 장기 agent loop에서 effort escalation rule (3 fail → xhigh 등) 문서화
- Batch API 300K output이 필요한 offline codegen인지 확인
- Claude Code Max/Pro 플랜별 Opus 5·1M context quota
마무리
Opus 5는 '더 똑똑한 모델'이면서 동시에 effort knob로 unit economics를 제어하는 제품입니다. 팀은 model card만 보지 말고 task tier × effort × cache hit rate 표를 만들어 agent pipeline 비용을 관리하는 것이 좋습니다.
고유 인사이트: xhigh가 max를 이기는 벤치 결과는 "effort=품질 단조증가" 가정을 깨는 사례입니다. 사내 eval에서도 low→high→xhigh curve를 그려 knee point(marginal gain < marginal cost)를 찾으면, Cursor router·custom orchestrator의 routing table을 data-driven으로 업데이트할 수 있습니다 — 벤치마크 숫자를 그대로 믿기보다 자체 repo set에서 knee point를 재측정하세요.
참고 자료
- Claude Opus 5: A Technical Guide for Production - Amplifi Labs (2026-07-24)
- Claude Opus 5 effort levels and real cost - Hashnode (2026-07-24)
- Claude Opus 5 pricing in 2026 - eesel AI (2026-07-24)
- 1M context GA for Opus 4.6 and Sonnet 4.6 - Anthropic (2026-03-13)
※ 본 글은 정보 제공을 목적으로 한 개인 의견이며, 특정 기술·서비스 사용을 권유하지 않습니다.
'개발이야기' 카테고리의 다른 글
| Sealos 2.0 공개… GitHub 레포에서 풀스택 배포까지 AI 에이전트 워크플로 (0) | 2026.07.28 |
|---|---|
| KAT-Coder-V2.5… 10만+ 검증 레포 환경으로 훈련한 에이전틱 코딩 모델 (0) | 2026.07.28 |
| Kimi K3 오픈웨이트 공개(7/27) — 2.8T·코딩 1위와 51% 환각률 트레이드오프 (0) | 2026.07.27 |
| Cursor Router GA — 요청마다 모델 자동 선택, 커밋당 $4.63 vs Fable $12.69 (0) | 2026.07.27 |
| Cursor 에이전트 스웜 — 플래너(Opus)·워커(Composer) 분업이 SQLite 리빌드 비용을 95% 깎다 (0) | 2026.07.27 |