AI

Claude Opus 5, Fable 5 절반 가격으로 코딩 점수 0.5% 차이

Adrian Kessler

클로드 오퍼스 5는 자신의 실수를 스스로 발견하고, 답변이 부족하면 다시 작성하며, 멀티스텝 과학 및 코딩 작업을 처음부터 끝까지 처리한다 — 가격은 Anthropic의 최강 모델인 페이블 5의 절반 수준이다. 코딩 벤치마크에서 오퍼스 5는 페이블 5 대비 0.5% 이내의 성능을 보이며, OSWorld 2.0 컴퓨터 사용 테스트에서는 플래그십 모델을 실제로 능가하면서 비용은 3분의 1에 불과하다.

오퍼스 5가 이전 모델들과 구조적으로 다른 점은 ‘노력 토글(Effort Toggle)’이다. 각 API 요청에 낮음, 중간, 높음의 세 가지 설정을 부착할 수 있다. 일상적인 문서 검토를 수행하는 법무팀은 낮음으로 실행할 수 있고, 복잡한 분산 시스템을 디버깅하는 소프트웨어 엔지니어링 워크플로는 높음으로 전환할 수 있다. 모델 자체는 변경하지 않은 채, 모델이 작업에 투입하는 컴퓨팅 자원량을 조정하고 그에 따라 사용자가 지불하는 비용도 달라진다.

가격은 입력 토큰 100만 개당 5달러, 출력 토큰 100만 개당 25달러로, 오퍼스 5의 직전 모델인 오퍼스 4.8과 동일한 요금제다. Anthropic의 플래그십 모델인 페이블 5는 대략 두 배의 비용이 든다. 오퍼스 5는 이제 Claude Max 구독의 기본 모델이며, API 엔드포인트 claude-opus-5를 통해 사용할 수 있다. 고속 모드는 기본 토큰 가격의 두 배로 추론 속도 2.5배를 제공하며, 지연 시간이 비용보다 중요한 실시간 파이프라인을 대상으로 한다.

한계점은 분명하며 Anthropic도 이를 명확히 밝히고 있다. 오퍼스 5는 여전히 회사의 특화 보안 모델인 미토스 5에 사이버보안 작업에서 뒤처지며, Anthropic이 안전상의 이유로 절대적 한계선으로 설정한 이중 용도 생물학 분야에서는 진전이 없다. 수개월에 걸친 자율적 생물학 연구 프로젝트에는 여전히 페이블 5가 권장된다. 0.5%의 코딩 성능 차이는 벤치마크 범위를 벗어나는 복잡하고 개방적인 문제에서 실제로 더 벌어질 수 있다.

이번 출시는 업계 전반의 빠른 연속 출시를 배경으로 이루어졌다. OpenAI는 7월 9일 GPT-5.6을 3단계로 출시했고, Google은 7월 21일 Gemini 3.6 Flash를 출시하며 출력 토큰 비용을 17% 인하했다. 각각의 물결이 기준선을 높이는 동시에, 기업이 이전 모델을 평가하고 배포할 수 있는 시간을 압축하고 있다.

오퍼스 5는 오늘부터 Claude API, Claude.ai, Claude Code, Claude Cowork를 통해 사용할 수 있으며, 가격은 입력 토큰 100만 개당 5달러, 출력 토큰 100만 개당 25달러다. Anthropic은 노력 토글이 모든 API 사용자와 Claude Max 구독자에게 즉시 제공된다고 밝혔다.

오퍼스 5는 Anthropic이 60일 만에 출시한 네 번째 모델이다. 비용 대비 성능의 최전선이 움직이는 속도는 이제 엔터프라이즈 구매자에게 다른 문제를 만들어낸다: 언제 평가를 멈추고 실제로 제품을 출시해야 하는지 아는 것.

태그: , , , , ,

토론

댓글 0개가 있습니다.