AI

Anthropic의 Fable 5.1, 캐시 비용 75% 절감 — 에이전트 성능 점수 두 배 이상 향상

Susan Hill

Anthropic이 9월 1일 Claude를 Fable 5.1로 업데이트하면서 캐시된 입력 토큰 비용을 백만 개당 1.00달러에서 0.25달러로 75% 인하했다. 이는 대부분의 프로덕션 AI 개발자들이 원시 연산 능력이 아니라 컨텍스트 누적이 인프라 예산의 실제 집중 지점임을 발견한 시점에 이루어졌다. 라이브 에이전틱 세션에서 단일 Claude 대화는 턴이 진행됨에 따라 컨텍스트가 쌓이면서 수십만 개의 토큰을 캐시에 보유할 수 있다. 백만 개당 0.25달러라면, 이러한 누적은 개발자가 회피해야 할 비용 상한선이 아니라 의도적인 설계 선택이 된다.

가격 변경과 함께 발표된 벤치마크 결과는 경제적 타당성을 더욱 강화하는 성능 향상을 보여준다. 실험 설계와 반복 분석을 요구하는 다단계 과학적 추론을 측정하는 Terminal-Bench-Science 0.1에서 Fable 5.1은 52.6%를 기록해 Fable 5의 24.7%보다 두 배 이상 높았다. AutomationBench는 17.1%에서 31.4%로, 더 광범위한 에이전틱 능력 평가인 Terminal-Bench 4.0은 42.0%에서 55.8%로 상승했다. CursorBench 3.2.0은 73.4%를 기록했다. 네 가지 평가 모두에서 일관된 패턴은 Fable 5.1이 미미한 개선에 그치는 것이 아니라, 에이전틱 가치를 정의하는 작업 범주에서 실질적으로 더 신뢰할 수 있다는 점이다.

이 결합 효과는 Claude로 구축하는 비용 산술을 다시 쓰게 만든다. 모델이 더 신뢰할 수 있기 때문에 더 적은 턴으로 작업을 완료하는 에이전틱 애플리케이션은 성공적인 결과에 도달하는 과정에서 더 적은 총 토큰 사이클을 소비한다. 사용하는 토큰에 75% 캐시 할인을 적용하면, 재사용 빈도가 높은 에이전틱 워크플로에서 작업당 유효 비용 절감은 45% 이상에 달한다. Anthropic은 복합 절감액에 대한 단일 헤드라인 수치를 발표하지 않았지만, 자체 토큰 경제를 모델링하는 개발자들은 컨텍스트가 많은 워크로드에서 그 범위의 수치에 도달할 것이다.

Fable 5.1은 모델 식별자 claude-fable-5-1로 Anthropic의 직접 API를 통해, 그리고 Amazon Web Services Bedrock, Google Cloud Platform, Microsoft Azure를 통해 즉시 사용 가능하다. Anthropic은 동시에 Enterprise Frontier Safeguards를 발표했다: 고객 제어 데이터 보존, 고객 관리 암호화 키, 각 고객의 기존 클라우드 인프라 테넌트 내 배포를 기본 클라우드 비용 외에 추가 요금 없이 제공한다.

일반 출시와 함께 Anthropic은 Mythos 5.1을 소개했다. 이는 동일한 기본 모델의 변형으로, 검증된 조직을 위해 회사가 설명하는 바에 따르면 더 관대한 안전장치(safeguards)로 작동한다. 접근은 검증된 사이버보안 연구 기관 및 생명과학 회사로 제한된다. 회사는 단백질 바인더 설계 및 생물학적 모델 최적화를 포함한 실제 응용 사례에서 표준 릴리스보다 최대 2.5배 높은 추론 처리량을 보여주었다. Mythos 5.1 접근은 셀프서비스가 아니다: Anthropic은 개별적으로 신청서를 검토하며 등록 코호트의 규모를 공개하지 않았다.

Fable 5.1의 에이전틱 수치, 특히 Terminal-Bench-Science에서의 결과는 Anthropic의 발표 결과를 비슷한 평가에서 OpenAI가 가장 최근에 공개한 수치보다 앞서게 한다. 교차 기업 벤치마크 비교는 방법론적 주의를 요한다—공급업체는 자신의 모델에 유리한 평가를 선택하며, Anthropic이 강조한 특정 테스트는 아마도 유리한 결과를 위해 선택되었을 것이다. 하지만 내부적인 두 배 패턴은 설명하기 어렵다: Fable 5.1은 가격 인하가 붙은 동일한 모델이 아니다. 성능 변화가 충분히 커서 가격 이야기와 성능 이야기를 분리할 수 없다.

현재 Claude를 사용하지 않는 개발자에게 캐시 가격 인하는 자신의 토큰 경제로 환산할 가치가 있는 숫자다. 캐시된 토큰 백만 개당 0.25달러에 근접하지 않는 모든 AI 제공업체는 이제 엔터프라이즈 영업 대화에서 직접적인 비용 비교 질문에 직면하게 될 것이다. Anthropic의 캐시 가격은 이번 인하 이전에도 여러 경쟁사보다 낮았으며, 그 격차는 더 벌어졌다. 성능 개선은 사용 사례별로 일반화하기 어렵지만, 에이전틱 및 과학적 추론 분야에서 Fable 5.1은 어떤 제공업체의 다음 주요 릴리스가 비교될 기준점을 설정했다.

태그: , , , ,

토론

댓글 0개가 있습니다.