Anthropic, Claude Opus 5 발표 — Fable 5급 성능에 절반 가격
AI

Anthropic, Claude Opus 5 발표 — Fable 5급 성능에 절반 가격

zaq · · 3 min read

Anthropic이 Claude Opus 5를 공개했습니다. 최상위 모델인 Fable 5에 근접한 성능을 절반 가격에 쓸 수 있는, 한마디로 가성비 끝판왕 Opus입니다.

핵심 요약

Opus 5는 기존 Opus 4.8과 동일한 가격($5/$25 per Mtok)으로 대폭 향상된 성능을 제공합니다. Frontier-Bench, CursorBench, ARC-AGI 3 등 주요 벤치마크에서 최고 수준(state-of-the-art) 기록을 세웠고, Claude Max의 기본 모델로도 탑재되었습니다. 같은 돈으로 훨씬 더 똑똑한 모델을 쓸 수 있게 된 셈입니다.

성능 — 어디가 얼마나 좋아졌나?

코딩 벤치마크에서 압도적입니다. Frontier-Bench v0.1에서 Opus 4.8 대비 2배 이상의 성능을 더 낮은 태스크당 비용으로 기록했고, CursorBench 3.2에서는 Fable 5 최고점과 0.5% 차이를 냈습니다. Fable 5는 입력 $25 / 출력 $125 per Mtok이고, Opus 5는 $5/$25 per Mtok입니다. 절반 가격에 거의 동일한 성능입니다.

문제 해석 능력도 돋보입니다. ARC-AGI 3(새로운 문제 해결 벤치마크)에서 2위 모델의 3배 점수를 기록했고, OSWorld 2.0(컴퓨터 사용 벤치마크)에서도 Fable 5보다 1/3 비용으로 더 나은 결과를 냈습니다. 비즈니스 자동화를 측정하는 Zapier AutomationBench에서도 1.5배의 통과율을 보여줬습니다.

실제로 체감되는 차이

얼리 액세스 사용자들의 후기가 인상적입니다. 한 트레이딩 기업의 엔지니어는 Opus 5에게 새 거래소 마켓 데이터 피드 구축을 맡겼는데, 이전 모델들은 전혀 완료하지 못했던 작업을 단일 세션에서 끝냈습니다. 심지어 검증용 테스트 하네스까지 자체적으로 구축하면서요.

오픈소스 패키지 매니저 버그에서도 커뮤니티 패치가 놓친 엣지 케이스를 찾아내서 근본 원인을 수정했습니다. 경쟁 모델은 표면 증상만 고치고 끝냈다고 합니다. 과학 연학 분야에서도 단백질 기능 예측, 분자 구조 추론 등에서 Opus 4.8 대비 최대 10.2%p 향상을 기록했습니다.

가격 및 베타 기능

기본 가격은 Opus 4.8과 동일한 입력 $5 / 출력 $25 per Mtok입니다. Fast 모드를 켜면 약 2.5배 속도로 동작하며, 가격은 2배입니다. Claude Pro에서는 가장 강력한 모델, Claude Max에서는 기본 모델로 제공됩니다.

함께 베타 기능 두 개도 공개했습니다:

  • 대화 중 도구 변경: 프롬프트 캐시를 무효화하지 않고 도구 구성을 변경할 수 있습니다
  • 자동 폴백: 안전 분류기가 요청을 차단할 경우 자동으로 다른 모델로 라우팅됩니다. API 요청이 막히지 않고 항상 최적 모델로 흘러갑니다.

총평

Opus 4.5 이후 Opus 계열에서 가장 큰 도약이라는 평가가 설득력 있습니다. Fable 5급 지능을 일상적인 가격에 쓸 수 있다는 건, AI를 매일 쓰는 개발자에게 실질적인 생산성 향상으로 이어집니다. 이제 "비싼 모델 vs 싼 모델" 선택의 시대가 점점 끝나고 있네요.

출처: https://www.anthropic.com/news/claude-opus-5