가드레일 없이 배포…유료 API·울트라는 이후

구글이 30일(현지시간) 제미니4 아르곤을 발표하고 신뢰할 수 있는 사이버 방어를 맡는 파트너에게 먼저 열어 일반 공개는 뒤로 미뤘다.

회사는 공식 블로그에서 미국 정부의 자발적 사전공개 절차에 참여 중이라고 밝혔다. 가드레일을 다듬은 뒤 개발자·기업·소비자에게 연되, 구체적 일정은 제시하지 않았다.

구글, 페어윈드 파트너에 먼저 개방

초기 접근 대상은 페어윈드 프로그램의 검증된 사이버 방어 조직과 구글 내부 팀이다. 프로그램에는 전 세계 650곳 넘는 파트너가 있다. 정부·국가 사이버 당국과 의료·통신·에너지·금융 등 핵심 인프라 운영자가 포함된다.

신뢰 방어팀과 내부에는 사이버 가드레일을 뺀 버전을 준다. 취약점을 스스로 찾고 검증·패치하는 능력을 그대로 쓰게 하려는 조치다. 클라우드 보안 업체 위즈는 공공 인프라 점검 프로그램에 아르곤을 넣었다.

위즈가 병원용 소프트웨어에서 개인정보를 노출하는 중대한 취약점을 찾아냈고, 이전 프론티어 모델들은 이를 놓쳤다고 구글은 전했다. 발표문은 구글 딥마인드 수석부사장 겸 최고 AI 설계자 코레이 카부크추오글루(Koray Kavukcuoglu)가 썼다.

이 수준의 프론티어 역량을 안전하게 내놓으려면 단계적 접근이 필요하다.

— 코레이 카부크추오글루, 구글 블로그 9월 30일 · “Safely releasing frontier capabilities at this level requires a phased approach.”

제미니 모델 제품 책임자 툴시 도지(Tulsee Doshi)는 CNBC에서 사이버 방어에 강한 모델을 방어팀에 최대한 빨리 넘길 수 있다고 말했다.

이 수준의 프론티어 성능을 갖춘 모델은 방어팀에 실질적으로 중요하다.

— 툴시 도지, CNBC 9월 30일 · “We really believe that a model of this caliber and this level of frontier performance is meaningfully important for defenders.”


아르곤, 출력 한도 100만으로 확대

아르곤의 출력 토큰 한도는 이전 제미니의 6만4000개에서 100만 개로 올렸다. 한 번의 긴 추론 궤적에서 수십만 토큰을 생성해 복잡한 문제를 한 번에 풀게 하려는 설계다.

구글이 공개한 수치로는 장기 소프트웨어 공학 벤치 DeepSWE v1.1에서 77.9%를 기록했다. 보안 취약점 패치 벤치 CWE-bench v1에서는 68%로 공동 1위다. 업무 자동화 벤치 AutomationBench는 51.3%, 장시간 영상 이해 LVBench는 91.7%다.

Ars Technica에 따르면 DeepSWE 표에서 GPT-6 아스트라, 클로드 오퍼스 5.5, 페이블 5.1을 앞섰다.

도입 가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러다. 캐시된 입력은 입력가의 95%를 깎는다. 도입 기간이 끝나면 각각 4달러·20달러로 오른다.


아르곤, 구글 내부에서 이미 가동

수천 명의 구글 직원이 이미 코딩·조사·글쓰기에 아르곤을 쓰고 있다. 에이전트 팀이 데이터센터 원격측정 자료를 분석해 메모리 최적화를 적용했고, 배포 후 300테비바이트 넘는 메모리를 비웠다. 추가 절감 추정치는 500테비바이트에서 1페비바이트다.

에이전트들은 C·C++ 코드베이스를 러스트로 옮기는 작업도 맡았고, 규모는 핵심 라이브러리 수만 줄에서 퓨크시아 OS 지르콘 커널의 80만 줄 이상까지다. 영상 디코더 libgav1에서는 기존 러스트 이식본의 SIMD 코드 3만2000줄을 안전한 러스트로 바꿨다. 이전 이식본보다 2.7배 빠르고 영상 출력은 동일하다.

양자 컴퓨팅 연구팀은 아르곤으로 시공간 자원(큐비트×게이트)을 최적화해, 한 사례에서 공개된 기준선보다 40% 나은 결과를 수 분 만에 냈다. 페어윈드 파트너는 아르곤을 CodeMender와 묶어 취약점 연구·패치에 쓸 수 있다.

광범위 공개 전 오용·프롬프트 주입·정렬 이탈·샌드박스 네 축의 안전장치를 강화한다. 추론 과정과 행동을 감시하는 장치가 사용자 의도를 넘는 실행을 중단한다.

페어윈드 사용은 인가된 위협 시뮬레이션·리버스 엔지니어링·멀웨어 분석으로 제한된다. 피싱 저항 다중인증과 직원별 접근 추적이 의무이며, 모델 접근권 공유·재판매는 금지다.


일반 공개 일정은 아직 미정

다음 개방 대상은 유료 API 고객과 구글 AI 울트라 구독자다. 그 뒤 개발자·기업·소비자로 순서를 넓힌다. 구체적 날짜는 밝히지 않았다.


#AI 안전#기업 AI