
Anthropic이 2026년 7월 24일 새 프론티어 모델 Claude Opus 5를 공개했어요. 두 달 전인 5월 28일 출시된 Opus 4.8의 후속작이자, 6월 9일에 나온 Fable 5·Mythos 5, 같은 달 출시된 Sonnet 5에 이은 네 번째 신모델이에요. 이번 글은 Anthropic 공식 발표문과 Fable 5·Mythos 5 발표문, 8월 7일자 생물학 안전장치 업데이트, TechCrunch 보도를 근거로 정리했어요.
팩트 정리
- Opus 5는 Claude Max의 기본 모델, Claude Pro의 최상위 모델로 지정됐어요. 가격은 입력 100만 토큰당 5달러, 출력 100만 토큰당 25달러로 Opus 4.8과 동일해요. (anthropic.com)
- Anthropic 자체 발표 기준 CursorBench 3.2 최대 노력 설정에서 Fable 5 성능의 99.5%를 절반 비용에 냈고, OSWorld 2.0에서는 Fable 5의 최고 결과를 3분의 1을 조금 넘는 비용으로 넘어섰다고 밝혔어요.
- Frontier-Bench v0.1에서는 Opus 4.8 대비 2배 이상, ARC-AGI 3에서는 차순위 모델의 3배 점수를 기록했다고 발표했어요. 다만 이 수치는 모두 상대 배수·점수차이고, 절대 퍼센트 점수는 공식 자료에 없어요.
- 자동화된 행동 감사에서 부정렬 행동 점수 2.3으로 최근 Claude 모델 중 가장 낮게(가장 안전하게) 나왔다고 밝혔어요. 사이버보안 안전 분류기 개입은 Fable 5 대비 약 85% 줄어들 것으로 예상된다고 전했어요.
- Fable 5는 6월 9일 Mythos 5와 함께 공개됐고, 가격은 입력 10달러·출력 50달러(100만 토큰)로 Opus 5의 두 배예요. 8월 7일에는 Fable 5의 생물학 안전 분류기를 재구성해 생물학 관련 요청 폴백이 약 85% 줄었고, 플랫폼별 전체 폴백(생물학 외 사유 포함)도 Claude.ai 약 67%, Cowork 약 55%, Claude Code 약 17%, Claude Platform 약 7% 줄어들 것으로 예상한다고 밝혔어요. (anthropic.com)
| 항목 | Claude Opus 5 | Claude Fable 5 / Mythos 5 |
|---|---|---|
| 발표일 | 2026-07-24 | 2026-06-09 |
| 가격(입력/출력, 100만 토큰) | $5 / $25 | $10 / $50 |
| 데이터 보존 | 일반 접근 기준 별도 요구사항 없음 | 30일 보존 |
왜 중요한가
두 달 사이 네 개 모델을 연이어 낸 것 자체가 눈에 띄는 변화예요. Opus 4.8부터 Opus 5까지 약 2개월밖에 걸리지 않았고, 그사이 안전장치 세부값도 계속 조정됐어요.
Fortune 보도에 따르면 기업 고객·개발자는 Fable 5의 높은 토큰 소비를 지적했고, 일부 사용자는 안전장치가 지나치게 빡빡해 코딩·사이버보안·일부 생물학 연구에서 모델이 덜 쓸모 있어졌다고 비판했다고 해요. 다만 이 불만의 구체적 근거(누가, 몇 명, 어떤 조사)는 기사에 명시되지 않아 사실로 단정하기보다는 업계 보도 수준으로만 받아들이는 게 맞아요.
Anthropic은 Opus 5를 두고 "가장 정렬된 Opus 모델"이라고 밝혔다고 Fortune이 전했어요.
같은 시기 OpenAI가 7월 9일 GPT-5.6을 토큰 효율성을 앞세워 출시한 것도 이 흐름과 맞물려 있다고 보여요. 가격 경쟁과 안전장치 재조정이 동시에 진행되는 국면으로 읽혀요.
나한테 뭐가 달라지나
Claude API나 Claude 구독을 쓰고 있다면 Opus 4.8과 같은 가격으로 더 상위 모델을 쓸 수 있게 된 셈이에요. 코드 작업·자동화 업무에서 Fable 5급 결과를 더 낮은 비용으로 기대할 수 있어요.
생물학 관련 질의를 자주 다뤘다면 Fable 5의 안전 분류기 오탐지가 8월 7일 업데이트로 크게 줄었으니, 예전에는 성능이 낮은 모델로 넘어가던(폴백되던) 일상적인 건강·실험실 결과 해석 질문을 이제는 Fable 5가 그대로 처리할 가능성이 커요. 다만 바이러스학·독성학·분자 설계 같은 이중용도 전문 연구 영역은 여전히 제한이 남아있어요.
아직 모르는 것
- Opus 5 벤치마크의 절대 점수(%)는 공식 발표문에 없어서 확인이 안 돼요. 일부 외부에서 도는 절대 수치는 이번 조사 출처에 근거가 없어 신뢰할 수 없어요.
- 부정렬 행동 점수 2.3이 정확히 어떤 방법론으로 산출됐는지는 System Card 원문을 봐야 하는데, 이번 조사에서는 확인하지 못했어요.
- Frontier-Bench v0.1·CursorBench 3.2·Zapier AutomationBench가 Anthropic 자체 지표인지 제3자 벤치마크인지도 확인되지 않았어요.
정리
Claude Opus 5는 이전 최상위 모델과 같은 가격에 성능을 끌어올리고, 동시에 안전 분류기 개입은 줄이는 방향으로 나왔어요. 6~7월 두 달 새 4개 모델이 연쇄 출시된 만큼, 다음 발표도 이 시리즈에서 이어서 확인해볼게요.
2026-08-08 작성 · 사실 확인이 안 된 항목은 본문에 그렇게 표시했습니다.
'AI > AI 동향' 카테고리의 다른 글
| 아이 여름사진, 필름카메라 감성 프롬프트 어떻게 쓸까요? (1) | 2026.08.02 |
|---|---|
| 허깅페이스 해킹, 5개 플랫폼 진짜일까 (1) | 2026.08.01 |
| AI 키링 스타일 SNS 이미지, 상황별 프롬프트 6가지 (0) | 2026.07.31 |
| Opus 5는 최상위 아니었다, AI 동향 7주 정리 (0) | 2026.07.30 |
| Y2K 플래시 디지캠 감성, 상황별 AI 프롬프트 4종 (0) | 2026.07.27 |