오늘 이용 가능 · Anthropic 공식 차트

Claude Opus 5

Fable 5에 가까운 지능을 절반 가격에 — Claude Max의 새 기본 모델이자 Claude Pro에서 가장 강력한 모델.

Opus 5가 실제로 무엇인지

전문 용어는 건너뛰세요. 누구를 위한지, 무엇이 좋아졌는지, 가격, 오늘 쓰는 법 — 네 가지로 정리합니다.

누가 관심 가져야 하나

매일 Claude로 코딩·연구·자동화를 한다면 Anthropic이 권하는 모델입니다. Max 사용자는 기본값, Pro는 플랜 내 최강을 고르면 됩니다.

Opus 4.8 대비

정가 동일(백만 토큰 입력 $5 / 출력 $25). 어려운 코딩 벤치에서 4.8 점수의 두 배 이상, 작업당 비용은 더 낮음. 같은 청구, 훨씬 나은 결과.

Fable 5 대비

Fable은 여전히 Claude 스택의 정점. Opus 5는 ‘거의 거기’(예: CursorBench 0.5% 이내)이면서 비용은 약 절반 — 일상용 프론티어 선택.

시작 방법

Claude.ai / Claude Code를 열고 Opus 5를 고르세요(또는 Max 사용). 개발자는 API에서 claude-opus-5 호출. 속도가 필요하면 Fast mode(약 2.5× 빠름, 2× 토큰 가격).

2026년 7월 24일 출시 — 지금 이용 가능

Claude Opus 5는 Claude.ai, Claude Code, Claude Cowork, Claude API에 오늘 출시되었습니다. Anthropic은 일상 모델로 포지셔닝합니다: 자기 검증이 더 꼼꼼하고, 긴 다단계 작업에 더 강하며, 이전 Opus보다 토큰 효율이 좋고 — Opus 4.8 가격은 올리지 않았습니다.

출시일
2026/7/24모든 플랫폼에서 이용 가능
Claude Max
새 기본값일상 프론티어 코딩 & 지식 작업
Claude Pro
최강 모델API id: claude-opus-5

Anthropic 공식 차트

차트는 7월 24일 발표에서 가져왔습니다. 대부분 점수(위=좋음)와 비용(왼쪽=저렴)을 비교합니다. 점은 effort 설정: low → medium → high → xhigh → max — 연산을 더 쓰면 지능도 올라갑니다.

차트 읽는 법

  1. 위가 좋음 — 통과율 / Elo / 점수가 높음.
  2. 왼쪽이 저렴 — X축은 보통 작업당 또는 전체 실행 비용(USD, 로그).
  3. 주황선이 Opus 5 — 노랑 Fable 5, 파랑 Opus 4.8, 회색은 종종 GPT-5.6 Sol.
  4. 최적 영역 — 왼쪽 위: 예산을 태우지 않고 강한 결과. Anthropic이 Opus 5를 두고 싶은 자리.

핵심 숫자 한눈에

Anthropic의 스냅샷 표. 먼저 강조된 Opus 5 열을 보세요 — 다른 곳의 복숭아색 칸은 그 행에서 다른 모델이 이겼다는 뜻. Opus 5의 복숭아색 띠는 ‘여기를 보라’입니다.

  • 43.3% Frontier-Bench — 어려운 에이전트 코딩; Opus 4.8(21.1%)의 약 2배
  • 1861 GDPval-AA — 지식 작업 Elo; 보드 최고치
  • 30.2% ARC-AGI-3 — 신규 퍼즐; 다음 나열 모델의 약 3–4배
  • 26.0% AutomationBench — 비즈니스 워크플로 종단 완료

출처 © Anthropic · Introducing Claude Opus 5

Anthropic Opus 5 벤치마크 요약표 (Fable 5, Opus 4.8, GPT-5.6 Sol 대비)

프론티어 코딩

‘에이전트가 실제 코드를 쓰고 고친다’가 일이라면 이게 헤드라인 승리: Frontier-Bench에서 Opus 4.8의 2배 이상, 성공당 비용은 더 저렴.

Fable에 가깝고 절반 비용

항상 절대 최상위가 필요하지는 않습니다. CursorBench에서 max effort 시 Opus 5는 Fable 5 피크의 0.5% 이내, 작업당 비용은 약 절반.

신규 문제 해결

ARC-AGI는 숙제 암기가 아니라 해법 발명을 보상합니다. 다음 모델 대비 약 3배 격차가 Anthropic이 추론을 강조하는 이유입니다.

종단 자동화

Zapier 벤치는 묻습니다: 전체 업무 흐름이 끝났나? 같은 비용에서 Opus 5 통과율은 2위의 약 1.5배 — 채팅만이 아니라 일을 끝내는 에이전트를 중시한다면 유용합니다.

Opus 4.8과 동일 가격 — Fable 5의 약 절반

MTok = 백만 토큰(API가 읽고 쓰는 많은 글/코드). $5 / $25는 입력 백만 $5, 출력 백만 $25 — Opus 4.8과 동일해 요금표가 바뀌지 않습니다. Anthropic의 주장: Fable급 품질을 약 절반 비용에. 지연을 줄이려면 Fast mode(약 2.5× 속도, 요금 2×).

Claude Opus 4.8

$5 / $25

입력 $5 / MTok
출력 $25 / MTok

정가 동일 — Opus 5가 업그레이드.

Claude Fable 5

~2× Opus 5

상대 Opus 5 ≈ ½ Fable 가격
CursorBench Opus 0.5% 이내

Anthropic 기준, Fable급 지능을 약 절반 비용에.

일반 제공 Claude 중 가장 잘 정렬된 모델

미스얼라인먼트 차트는 낮을수록 좋음(Opus 5는 2.3). 실제로 Anthropic 감사에서 기만·무모한 행동이 Opus 4.8, Sonnet 5, Fable 5보다 적습니다. 사이버(OSS-Fuzz)에서는 취약점 발견이 Mythos 5에 가깝지만, 작동하는 익스플로잇으로 바꾸는 능력은 훨씬 약함 — Anthropic이 의도적으로 익스플로잇 능력을 낮춘 설계입니다.

Anthropic 자동 행동 감사: Opus 5 미스얼라인 행동 점수 최저
OSS-Fuzz: 취약점 식별은 Mythos 5에 가깝고 익스플로잇은 뒤처짐

자주 묻는 질문

Claude Opus 5는 어떻게 쓰나요?

오늘부터 이용 가능합니다. Claude Max에서는 이미 기본값 — 채팅하거나 Claude Code를 열면 됩니다. Claude Pro에서는 피커에서 최강인 Opus 5를 선택. 개발자는 API 모델 id를 claude-opus-5로. 더 빠른 응답이 필요하면 Fast mode(약 2.5×, 토큰 가격 2×).

Opus 4 / 4.8과 무엇이 다른가요?

Opus 4.8과 스티커 가격 동일($5 / $25 per million tokens)이지만 훨씬 강함: 코딩 벤치 대략 두 배, 자기 검증이 더 꼼꼼하고, 긴 에이전트 작업과 지식 작업(GDPval-AA)에서 앞서며, Anthropic은 일반 제공 Claude 중 가장 잘 정렬되었다고 합니다.

Opus 5와 Fable 5 중 무엇을 고르나요?

일상 코딩과 지식 작업은 Opus 5를 기본으로 — Fable급 품질에 약 절반 비용(CursorBench 0.5% 이내). Claude 스택의 절대 정점이 필요하고 가격이 부차적일 때만 Fable 5.

차트의 ‘effort’는 무슨 뜻인가요?

Effort(low → max)는 모델이 얼마나 깊게 생각하게 할지 — 어려운 문제일수록 토큰과 도구 사용이 늘어납니다. 각 차트는 보통 점으로 단계를 찍고 effort가 오르면 오른쪽/위로 이동합니다. Opus 5는 가장 비싼 단계 없이도 높은 점수를 내는 경우가 많습니다.

이 차트들은 어디서 왔나요?

모든 벤치마크 이미지는 Anthropic의 Introducing Claude Opus 5에서 왔습니다. 이 사이트는 독립적인 쉬운 요약이며 Anthropic과 제휴하지 않습니다.

Claude Opus 5 — 출시일, 벤치마크 & 가격 2026