AI

앤트로픽 공개: 클로드가 자체 AI 연구 26% 주도 — 9개월 만에 0%에서 급성장

Adrian Kessler
Google에서 추가하기

현재 Anthropic의 AI 연구 과제 4개 중 1개는 클로드가 주도하고 있습니다. 단순히 도우미로 참여하거나 사후 검토를 맡는 정도가 아니라, 높은 수준의 지시에서 시작해 최종 결과물까지 전 과정을 클로드가 책임지고, 완료된 결과물을 사람이 확인하는 방식입니다. 9개월 전만 해도 이 비율은 1% 미만이었습니다.

Anthropic은 두 가지를 구분합니다. 클로드가 과제를 주도할 때는 대부분의 작업을 독립적으로 처리하며, 상급자는 각 단계를 지시하기보다 결과물을 검토합니다. 이는 인간이 방향을 제시하고 클로드가 특정 부분을 처리하는, 협력자 역할에 그치는 전체 R&D의 90%와는 다른 범주입니다. ‘주도’는 더 엄격한 기준입니다. 현재 회사가 수행하는 전체 AI 연구의 26%를 차지하며, 연구자들이 해당 과제에 투입했을 시간을 기준으로 가중치를 적용했습니다.

그 규모는 구체적입니다. 약 3만 개의 클로드 에이전트가 Anthropic 내부 플랫폼에서 동시에 실행되며 모델 훈련, 평가, 해석 가능성 연구, 안전 분석 전반에 걸쳐 작업을 수행합니다. 8월에 이 에이전트들은 총 10억 건 이상의 결정을 내렸습니다. Anthropic의 실시간 모니터링 시스템은 이 중 0.002%인 약 47,000건당 1건꼴을 실행 전에 차단했습니다. 이후 오프라인 계층에서 매주 약 10만 건의 대화를 검토 대상으로 분류했고, 그중 약 50건이 사람에게 전달되었습니다.

안전에는 이 시스템 내에서 측정 가능한 예산이 배정되어 있습니다. 7월의 한 주 동안 에이전트 안전 유지 작업에는 전체 AI 연구 개발 컴퓨팅의 6%가, AI 주도 R&D 자체가 사용하는 컴퓨팅의 12%가 사용되었습니다. Anthropic은 전용 안전 분류기를 제외하는 등 보수적으로 분류했으며, 실제 비중은 더 높을 수 있다고 밝혔습니다.

이 모든 것의 중심에는 인식론적 문제가 자리합니다. 클로드의 연구 기여도는 부분적으로 클로드 자신에 의해 평가됩니다. 클로드 모델이 클로드의 작업을 평가하고, 감독 수치는 내부 플랫폼 하나만을 다루며, 컴퓨팅 분류는 클로드 모델이 자체 실행을 샘플링하고 레이블링하는 방식에 의존합니다. 외부 제3자가 방법론을 감사하지 않았습니다. Anthropic이 발표한 세 가지 수치는 정확하지만, 이는 자체 보고된 정확성일 뿐 검증된 정확성과는 다릅니다.

Anthropic은 곧 외부 평가자를 프로세스에 통합할 것이라고 밝혔습니다. 아직 이름, 시작 날짜, 다른 AI 연구소의 유사한 공개는 없습니다. 26%라는 수치는 현재 속도로 볼 때 상한선이 아니라 한순간의 스냅샷입니다.

태그: , , , , ,

Google에서 추가하기

토론

댓글 0개가 있습니다.