기술

Gemini 4 Argon, 구글의 반격 카드지만 아직 거의 아무도 못 쓴다

Google DeepMind의 새 모델은 최대 100만 토큰을 출력하고 구글 자체 벤치마크에서 1위에 올랐지만, 가장 먼저 검증된 사이버 방어 인력에게만 돌아간다
Adrian Kessler
Google에서 추가하기

지난 1년 대부분 동안 구글의 인공지능 이야기는 구글이 아직 내놓지 못한 것에 관한 것이었다. Gemini 4 Argon은 그에 대한 답이며, 이 모델에서 가장 많은 것을 말해 주는 것은 벤치마크 점수가 아니다. 바로 누가 쓸 수 있느냐는 명단이다. Google DeepMind의 새 프런티어 모델은 회사의 Fairwind Program을 통해 검증을 거친 소수의 사이버보안 방어 인력에게 가장 먼저 제공되며, 그 외에는 누구에게도 제공되지 않는다.

Argon은 장기간에 걸친 작업을 위해 만들어졌다. 소프트웨어 엔지니어링, 법률·금융 리서치, 그리고 사이버 방어다. 핵심적인 구조 변화는 출력 길이다. 이 모델은 이제 한 번의 처리로 수십만 토큰을 추론하고 작성할 수 있어, 대규모 코드 마이그레이션을 조각조각 이어 붙이는 대신 끝까지 밀고 나갈 수 있다.

구글은 이미 수천 명의 자사 엔지니어가 이 모델을 쓰고 있다고 밝혔다. 발표에서 회사는 Argon 에이전트가 데이터센터 전반에서 300 TiB 이상의 메모리를 확보했으며, C와 C++ 코드를 메모리 안전 언어인 Rust로 이식하고 있다고 설명했다. 그 범위는 80만 줄이 넘는 Fuchsia Zircon 커널까지 이른다. 구글의 오픈소스 동영상 디코더인 libgav1에서는 Argon이 수작업으로 최적화한 32,000줄의 SIMD 코드를 안전한 Rust로 다시 작성했고, 이전 Rust 이식판보다 2.7배 빠르게 동작한다.

Bar chart comparing Gemini 4 Argon and Gemini 3.8 Flash Cyber on vulnerability discovery and the Wiz penetration test benchmark
Image: Google

출력 상한은 64,000토큰에서 100만 토큰으로 높아졌다. 벤치마크 수치는 구글 자체 발표다. DeepSWE v1.1에서 77.9%, 경제적 가중치를 반영한 지식 노동 지표인 Vals Index에서 1위, 장편 영상 이해를 평가하는 LVBench에서 91.7%를 기록했다. VentureBeat의 집계에 따르면 Argon은 공개된 18개 벤치마크 중 12개에서 단독 선두지만, FrontierSWE v2에서는 OpenAI의 GPT-6 Astra가 여전히 10점 넘게 앞선다. 외부 테스터가 직접 모델을 돌려 볼 수 있기 전까지 이 수치들은 주장일 뿐 판정이 아니다.

사이버보안이라는 틀이 이 좁은 문을 설명해 준다. 구글은 Argon이 스스로 취약점을 찾아내고, 검증하고, 패치하도록 훈련했으며, 신뢰할 수 있는 방어 인력에게는 사이버 관련 가드레일을 제거한 버전을 제공할 예정이다. Wiz의 Scan for Good 이니셔티브를 통해 이 모델은 병원 소프트웨어에서 개인정보를 노출시키는 치명적 결함을 찾아냈는데, 이는 이전 모델들이 놓친 것이었다. 불편한 진실은, 구멍을 메우는 데 이토록 능한 모델은 정의상 구멍을 찾는 데도 능하다는 점이다.

그래서 진짜 이야기는 안전장치다. 구글에 따르면 Argon은 사이버 공격과 화학·생물·방사능·핵 공격에 대한 도움을 거부하고, 지금까지 나온 구글 모델 가운데 프롬프트 인젝션에 가장 강하며, 사고의 연쇄를 감시하다가 사용자의 의도를 벗어나면 실행을 멈추는 모니터 아래에서 작동한다. 구글은 또한 미국 정부의 자발적 출시 전 모델 접근 절차에도 참여하고 있다.

그렇다면 지금 Gemini 4 Argon을 쓸 수 있는 사람은 누구인가. Fairwind 참여자와 구글 내부 팀뿐이다. 개발자, 기업, 일반 소비자를 위한 출시 일정은 없다. 접근은 유료 API 고객과 Google AI Ultra 구독자부터 시작된다. 출시 기념 가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러이며, 이후에는 각각 4달러와 20달러로 오른다.

이 모델은 9월 30일 코라이 카부크추오글루가 발표했다. 그는 데미스 허사비스가 8월 최고경영자 자리에서 물러난 뒤 Google DeepMind의 수장을 맡았다. 2025년 11월 Gemini 3 이후 구글이 처음 내놓는 새 플래그십이며, 진짜 시험대는 순위표가 아니라 가드레일 없이 풀린 모델이 원래 맡겨지려던 사람들의 손에 계속 머무르느냐에 있다.

태그: , , , , , ,

Google에서 추가하기

토론

댓글 0개가 있습니다.