2026-07-26 02:07
2026년 6월부터 앤트로픽은 두 달 새 Claude 5 패밀리 모델을 연달아 쏟아냈습니다. Mythos 5, Fable 5, Sonnet 5에 이어 2026년 7월 24일 출시된 Claude Opus 5가 그 마침표입니다. 가격은 프론티어 모델인 Fable 5의 절반, 성능은 대부분의 벤치마크에서 Fable 5와 동등하거나 앞서는 ‘실용적 최강’ 포지션으로 등장했습니다. 이 글에서는 오퍼스 5의 핵심 사양을 짚고, 소넷 5·GPT-5.6 Sol·제미나이 3.6 Flash와 개별 비교해 어떤 상황에서 어떤 모델을 택해야 하는지 가이드합니다.
Claude Opus 5는 앤트로픽이 정의한 ‘근(近)프론티어 일상용 플래그십’ 모델입니다. Fable 5가 며칠씩 자율 실행되는 최장기 에이전트용이라면, Opus 5는 코딩·에이전트·지식 작업 같은 현업 대부분에서 Fable 5 수준의 결과를 절반 비용으로 얻는 데 초점을 맞췄습니다.
claude-opus-5출시 시점 공개된 주요 수치입니다.
| 벤치마크 | Claude Opus 5 | 비고 |
|---|---|---|
| Frontier-Bench v0.1 (에이전트 코딩) | 43.3% | 전체 1위 |
| ARC-AGI-3 (새로운 문제 해결) | 30.2% | 2위 모델 대비 약 3.9배 |
| GDPval-AA v2 (지식 작업 Elo) | 1,861 | 전체 1위 |
| HLE — 도구 없음 | 56.3% | 전체 1위 |
| HLE — 도구 있음 | 64.7% | 전체 1위 |
| OSWorld 2.0 (컴퓨터 사용) | 70.6% | Fable 5 예산의 1/3로 능가 |
| BrowseComp (웹 탐색) | 90.8% | 전체 2위 |
| DeepSWE 1.1 (코딩 에이전트) | 68.8% | 전체 4위 |
| SWE-bench Pro | 79.2% | 전체 3위 (Fable 5 80.0%) |
두 모델은 경쟁자가 아닙니다. 소넷 5는 일상 코딩·연구·콘텐츠 작업을 낮은 비용으로 처리하는 워크호스, 오퍼스 5는 복잡한 추론과 에이전트 작업에서 Fable 5 수준을 절반 가격에 제공하는 프리미엄 티어입니다. 앤트로픽 스스로도 “소넷 5로 시작하고, 정확도가 필요한 복잡한 작업에서 오퍼스 5로 에스컬레이션하라”고 권장합니다.
| 항목 | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|
| 출시일 | 2026.07.24 | 2026.06.30 |
| 입력 가격 | $5 / 1M | 2) |
| 출력 가격 | $25 / 1M | 10) |
| 컨텍스트 윈도우 | 1M 토큰 | 1M 토큰 |
| 지식 컷오프 | 2026년 5월 | 2026년 1월 |
| 패스트 모드 | ✅ (50) | ❌ |
| Claude Free | ❌ | ✅ (기본) |
| Claude Pro | 최강 모델 | 기본 모델 |
| Claude Max | 기본 모델 | 사용 가능 |
| 벤치마크 | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|
| Frontier-Bench v0.1 | SOTA | 미보고 |
| ARC-AGI 3 | 차차순위 대비 3배 | 미보고 |
| GDPval-AA v2 (Elo) | 1,861 | 1,609 |
| HLE (도구 있음) | 64.7% | 57.4% |
| OSWorld 2.0 | 70.6% | 81.2% (OSWorld-Verified) |
| SWE-bench Verified | 미보고 | 85.2% |
| SWE-bench Pro | 미보고 (Opus 4.8 수준 이상) | 63.2% |
| Terminal-Bench 2.1 | 미보고 | 80.4% |
| BrowseComp | 미보고 | 84.7% |
| Zapier AutomationBench | ~1.5배 차이(100% 통과) | 13.5% |
실전 선택 가이드
OpenAI의 GPT-5.6 Sol과의 비교는 기업 도입 팀에서 가장 자주 등장하는 질문입니다. 공개된 벤치마크 수치로는 오퍼스 5가 전 항목에서 앞서지만, 스위칭 비용이라는 현실적 변수가 결정을 복잡하게 만듭니다.
| 벤치마크 | Claude Opus 5 | GPT-5.6 Sol | 격차 |
|---|---|---|---|
| Frontier-Bench v0.1 (에이전트 코딩) | 43.3% | 34.4% | +26% 상대적 우위 |
| ARC-AGI-3 (새로운 문제 해결) | 30.2% | 7.8% | 약 3.9배 |
| GDPval-AA v2 (지식 작업 Elo) | 1,861 | 1,736 | +125 Elo |
| SWE-bench Pro | 79.2% | 미보고 | — |
| DeepSWE 1.1 | 68.8% | 73% | GPT 우위 |
| 모델 | 입력 | 출력 | 비고 |
|---|---|---|---|
| Claude Opus 5 | $5 / 1M | $25 / 1M | 1M 토큰 컨텍스트 무료 |
| GPT-5.6 Sol | $5 / 1M | $30 / 1M | 272K 초과 시 입력 2배 과금 |
가격은 거의 같지만 중요한 차이가 있습니다. GPT-5.6 Sol은 272K 토큰 초과 입력부터 2배 요금이 부과되는 반면, 오퍼스 5는 1M 컨텍스트 전체를 기본 요금으로 사용할 수 있습니다. 긴 문서 분석이나 대형 코드베이스 작업이라면 실질 비용 격차가 상당히 커집니다.
스위칭 비용을 꼭 계산하세요. 프롬프트 라이브러리, 평가 하네스, 툴 스키마, 함수 호출 컨벤션은 공짜로 이식되지 않습니다. Frontier-Bench 9포인트 격차가 실질 ROI가 되려면 에이전트 스캐폴딩 재튜닝 비용을 넘어서야 합니다. 반드시 자체 작업 기준 실제 비교 테스트를 거친 후 결정하세요.
제미나이 3.6 Flash는 구글이 2026년 7월 21일 출시한 빠르고 저렴한 플래시 계열 모델입니다. 오퍼스 5와는 포지션 자체가 다릅니다 — 오퍼스 5가 ‘프리미엄 워크호스’라면 제미나이 3.6 Flash는 ‘고성능 저비용 러너’입니다.
| 벤치마크 | Claude Opus 5 | Gemini 3.6 Flash |
|---|---|---|
| DeepSWE 1.1 (딥 코딩 에이전트) | 68.8% | 49.0% |
| GDPval-AA v2 (지식 작업) | 62.0% | 47.4% |
| OSWorld 2.0 (컴퓨터 사용) | 70.6% | — |
| OSWorld-Verified | — | 83.0% |
| Terminal-Bench 2.1 | — | 78.0% |
| CharXiv-R (차트 이해) | — | 89.4% |
| MLE-Bench (ML 엔지니어링) | — | 63.9% |
| SWE-Bench Pro | 79.2% | 58.7% |
| BioMysteryBench | 90.1% | — |
| BrowseComp | 90.8% | — |
| 모델 | 입력 | 출력 | 가격 차이 |
|---|---|---|---|
| Claude Opus 5 | $5.00 / 1M | $25.00 / 1M | — |
| Gemini 3.6 Flash | $1.50 / 1M | $7.50 / 1M | 약 3.3배 저렴 |
| 항목 | Claude Opus 5 | Gemini 3.6 Flash |
|---|---|---|
| 입력 컨텍스트 | 1,000,000 토큰 | 1,048,576 토큰 |
| 최대 출력 | 128,000 토큰 | 65,536 토큰 |
| 멀티모달 지원 | 텍스트·이미지·오디오·비디오 | 텍스트·이미지·오디오·비디오 |
선택 기준: 성능이 최우선이고 복잡한 코딩·지식 작업이 많다면 오퍼스 5를 선택하세요. 대량의 문서 처리, 분류, 요약처럼 볼륨이 크고 단순한 작업에는 제미나이 3.6 Flash가 비용 대비 합리적인 선택입니다. 두 모델이 직접 경쟁하는 영역은 좁으며, 워크로드 성격에 따라 명확히 갈립니다.
오퍼스 5의 가장 독창적인 기능은 에포트 토글입니다. 단순한 ‘저렴한 모델’이 아니라, 같은 모델 안에서 추론 깊이를 조절할 수 있습니다.
실제 팀 운영에서는 전체 트래픽의 80%를 low/medium으로 처리하고 나머지 20%만 high로 에스컬레이션하면, 토큰 단가보다 훨씬 낮은 실효 비용으로 프론티어 수준의 추론을 확보할 수 있습니다. 오퍼스 5의 스티커 가격(25)은 실제 사용 비용의 상한선에 가깝습니다.
Claude Opus 5 공식 페이지: claude.ai API 문서 및 모델 ID: platform.claude.com