AI

알리바바 Qwen 3.8 Max, 토큰 100만 개당 2달러 — 오픈 웨이트 8월 10일 공개 예정

Adrian Kessler

2.4조 파라미터 규모의 AI 모델이 시장에 등장했다. 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 6달러에 제공된다. 이 모델은 희소 혼합 전문가(Sparse Mixture-of-Experts) 아키텍처를 사용해 한 번에 950억 개의 파라미터만 활성화하고 나머지는 대기 상태로 두어 토큰당 비용을 낮춘다. 이 모델이 바로 알리바바의 Qwen 3.8 Max다.

미국 최상위 모델과의 가격 격차는 뚜렷하다. Qwen 3.8 Max는 여러 표준 벤치마크에서 경쟁력 있는 결과를 보여준다. PaperBench에서 93.0, OSWorld-Verified에서 86.1을 기록하며 해당 지표에서 Fable 5와 GPT-5.6 Sol을 앞선다. 컨텍스트 창은 100만 토큰까지 확장되어 단일 프롬프트에 약 100만 단어의 입력을 처리할 수 있다. 이는 장문 분석, 대규모 코드베이스, 확장된 추론 체인을 포괄한다. 또한 이 모델은 텍스트와 함께 이미지와 비디오를 지원하는 멀티모달이며, 1년 전까지만 해도 독점 모델에만 있던 가격대에 제공된다.

더 중요한 개발은 알리바바가 다음 주에 약속한 것일 수 있다. 회사는 모델 가중치를 공개적으로 배포할 것이라고 밝혔다. 이는 충분한 컴퓨팅 인프라를 갖춘 팀이 API 비용 없이, 알리바바 서버로 데이터를 보내지 않고, 사용 계약 없이 Qwen 3.8 Max를 로컬에서 실행할 수 있음을 의미한다. 이 약속이 계획대로 지켜진다면, 2.4조 파라미터 모델을 자체 호스팅하는 사용자에게 처음으로 제공하는 셈이 된다. 알리바바는 또한 컴퓨팅 자원이 제한된 조직을 위해 더 작은 270억 파라미터 체크포인트도 공개할 예정이다.

주의해야 할 점도 실재한다. 텍스트 중심의 Chatbot Arena 리더보드에서 Qwen 3.8 Max는 5위를 기록했다. Anthropic의 현재 라인업의 4개 모델 뒤에 위치한다. 기업 AI 팀에게 가장 중요한 코딩 에이전트 평가인 SWE-bench Pro에서는 Fable 5의 80.0 대비 67.7을 기록했다. 오픈 웨이트 공개는 8월 10일 주에 약속되어 있지만, 게시 시점 기준으로 Hugging Face나 ModelScope에는 아직 가중치가 나타나지 않았다. EU 데이터 거주 요건이나 미국 수출 통제 규칙을 다루는 조직에게 Qwen 3.8 Max는 다른 중국 연구소 모델과 동일한 관할권 문제를 수반한다.

8월 10일 공개 가중치 배포 시점은 첫 번째 중요한 분기점이다. 알리바바가 약속을 지키면, 자체 인프라를 운영할 의향이 있는 팀에게 최첨단 AI 추론의 비용 구조가 크게 낮아진다. 공개가 지연되거나 제한이 붙으면, 2달러 API 가격만으로도 현재 제공되는 가장 공격적인 가격의 최첨단 모델 중 하나로 남게 된다.

태그: , , , , ,

토론

댓글 0개가 있습니다.