Claude Opus 5 vs Fable 5 완벽 비교 — 벤치마크, 가격, 언제 뭘 쓸까

비교 요약

Claude Opus 5는 Anthropic이 2026년 7월 24일에 출시한 최신 최상위(flagship) 모델입니다. 핵심 메시지는 하나로 요약됩니다. Fable 5에 근접한 지능을 절반 가격에 제공한다는 것입니다. Opus 5는 입력 100만 토큰당 5달러, 출력 25달러로 Fable 5(10달러 / 50달러)의 절반이면서, 12개 공유 벤치마크 중 7개에서 Fable 5를 앞섭니다. 다만 가장 어려운 SWE 작업과 사이버보안, 생물학 연구 영역에서는 Fable 5가 여전히 우위를 지킵니다.

두 모델은 경쟁 관계라기보다 역할이 다릅니다. 이 글에서는 벤치마크와 가격, 그리고 실제로 언제 어느 모델을 골라야 하는지를 정리합니다.

비교 항목

항목Claude Opus 5Claude Fable 5출시일2026-07-242026-06-09입력 가격 (1M 토큰)5달러10달러출력 가격 (1M 토큰)25달러50달러컨텍스트 윈도우1M 토큰1M 토큰최대 출력128k 토큰128k 토큰레이턴시(속도)중간더 느림적응형 사고지원지원(항상 켜짐)데이터 보존 정책보존 안 함안전 목적 30일 보존API 모델 IDclaude-opus-5claude-fable-5

가격표만 보면 Opus 5의 판정승입니다. 성능이 근소하게 밀리는 일부 지표를 감안해도, 같은 작업을 절반 비용으로 처리한다는 점은 대부분의 실무 상황에서 결정적입니다.

Opus 5가 앞서는 영역

Anthropic이 공개한 자료와 외부 벤치마크를 종합하면, Opus 5는 12개 공유 벤치마크 중 7개에서 Fable 5를 앞섭니다(출처: Decrypt, mer.vin 벤치마크 정리).

  • ARC-AGI 3(새로운 문제 해결): Opus 5의 점수가 차순위 모델의 약 3배
  • Frontier-Bench v0.1(에이전틱 코딩): Opus 5 43.3% vs Fable 5 33.7%로 9.6포인트 우위
  • OSWorld 2.0(컴퓨터 사용): Fable 5의 최고 결과를 약 3분의 1 비용으로 능가, 4.5포인트 우위
  • Zapier AutomationBench(업무 자동화): 차순위 모델의 약 1.5배 통과율

특히 눈여겨볼 대목은 Opus 5가 직전 모델인 Opus 4.8 대비 성능을 두 배 이상 끌어올리면서도 가격은 동일하게 유지했다는 점입니다. 같은 비용에서 두 배의 성능이 나온다는 뜻이고, 이는 작업당 비용이 절반으로 떨어졌다는 의미이기도 합니다.

Fable 5가 앞서는 영역

Opus 5가 대부분을 가져갔지만, Fable 5가 지키는 자리도 분명합니다.

  • SWE-bench Pro(실전 코드 수정): Fable 5 80.0% vs Opus 5 79.2%로 0.8포인트 우위
  • CursorBench 3.2(코드 편집): Fable 5가 근소하게 앞섬. Opus 5는 최대 노력(max effort) 설정에서 Fable 5 최고점의 0.5% 이내까지 추격
  • 사이버보안 작업: Anthropic 자체 평가에서 Opus 5가 Mythos 5에 뒤짐
  • 생물학 연구(단백질 등): 이 유형의 작업에서는 Mythos 5가 더 강한 모델

정리하면, 며칠에 걸친 자율 실행(multi-day autonomy)이나 가장 까다로운 SWE 과제처럼 실패 비용이 극도로 큰 작업에서는 여전히 Fable 5가 안전한 선택입니다. 0.8포인트 차이가 사소해 보이지만, 대규모 자율 에이전트가 며칠간 돌아가는 워크로드에서는 이 작은 정확도 차이가 누적되기 때문입니다.

이런 분에게 추천

  • Opus 5: 일상적인 에이전틱 코딩(PR 검토, 다중 파일 리팩토링, 터미널 에이전트)과 대규모 지식 작업을 최고 품질로, 그러나 비용 효율적으로 처리하고 싶은 팀. 대부분의 실무 기본값으로 삼기에 적합합니다.
  • Fable 5: 며칠 걸리는 자율 실행, 가장 어려운 SWE 과제, 사이버보안·생물학 최전선 연구처럼 실패 비용이 크고 최고 정확도가 필수인 작업.

신규 기능 두 가지

Opus 5에는 벤치마크 밖에서 실무에 영향을 주는 기능도 추가됐습니다.

첫째, 대화 중 도구 변경(mid-conversation tool changes)입니다. 세션을 새로 시작하지 않고도 대화 도중 Claude가 사용할 수 있는 도구 목록을 바꿀 수 있습니다. 긴 에이전트 세션에서 작업 단계마다 필요한 도구가 달라지는 상황에 유용합니다.

둘째, 자동 폴백(automatic fallbacks)입니다. 안전 분류기에 플래그된 요청이 자동으로 다른 모델로 라우팅됩니다. 운영 관점에서 요청이 중간에 막혀 멈추는 경우를 줄여줍니다.

자주 묻는 질문

Claude Opus 5는 Fable 5보다 무조건 좋은가요?

아닙니다. 12개 공유 벤치마크 중 7개에서 Opus 5가 앞서지만, SWE-bench Pro와 CursorBench, 그리고 사이버보안·생물학 영역에서는 Fable 5(및 Mythos 5)가 여전히 우위입니다. 대부분의 일상 작업은 Opus 5가 비용 대비 유리하고, 최고 난도의 자율 작업은 Fable 5가 안전합니다.

Opus 5 가격은 얼마인가요?

입력 100만 토큰당 5달러, 출력 100만 토큰당 25달러입니다. 직전 모델인 Opus 4.8과 동일하며, Fable 5(10달러 / 50달러)의 절반 수준입니다. Fast 모드는 기본 가격의 2배입니다.

Opus 5는 Opus 4.8에서 뭐가 달라졌나요?

가격은 그대로인데 성능이 두 배 이상 향상됐습니다. 같은 비용에서 두 배 성능이므로 작업당 비용이 실질적으로 절반으로 떨어졌고, 시각적 출력 품질도 크게 개선됐습니다. 내부 벤치마크 기준으로 유기화학은 10.2포인트, 단백질 예측은 7.7포인트 높아졌습니다.

API에서 Opus 5는 어떻게 쓰나요?

Claude API에서 모델 ID claude-opus-5로 바로 호출할 수 있습니다. 컨텍스트 윈도우는 1M 토큰, 최대 출력은 128k 토큰입니다.

인사이트

이번 발표의 진짜 메시지는 "Opus 5가 최강이다"가 아니라 가격-성능 곡선이 다시 한 단계 내려왔다는 데 있습니다. 불과 두 달 전 Opus 4.8이 세운 성능을, 같은 가격에 두 배로 갱신했습니다. 최상위 모델의 성능이 정체되지 않고 오히려 작업당 비용이 반복적으로 절반씩 떨어지는 흐름이라면, 모델 선택의 기준은 "가장 똑똑한 모델은 무엇인가"에서 "이 작업에 필요한 최소 사양은 무엇인가"로 옮겨갑니다.

이 관점에서 보면 Opus 5와 Fable 5는 대체재가 아니라 계단의 위아래 칸입니다. 대부분의 코딩·지식 작업은 Opus 5로 내려서 비용을 절반으로 아끼고, 며칠짜리 자율 에이전트나 사이버보안·생물학 최전선처럼 실패가 치명적인 소수 작업에만 Fable 5를 올려 쓰는 것이 합리적입니다. 실무에서 중요한 건 벤치마크 1위 모델을 전부에 붙이는 게 아니라, 작업별로 최소 사양을 골라 총비용을 관리하는 라우팅 감각입니다. 이제 모델 선택은 이분법이 아니라 노력(effort)과 비용을 조절하는 다이얼에 가깝습니다.

한국 팀 입장에서 실질적인 변화는 예산 계획입니다. 같은 결과물을 절반 토큰 비용으로 뽑을 수 있게 되면, 그동안 비용 때문에 최상위 모델을 못 붙였던 대량 처리 워크로드(문서 요약, 코드 리뷰 자동화, 대규모 마이그레이션)의 손익분기점이 다시 계산됩니다. 새 모델이 나올 때마다 "성능이 얼마나 올랐나"보다 "내 반복 작업의 단가가 얼마나 내려갔나"를 먼저 계산해보길 권합니다.


원문: Introducing Claude Opus 5 — Anthropic

참고: Decrypt, mer.vin