구글, 프런티어 모델 '제미나이 4 아르곤' 공개…사이버 방어 전문가에 먼저 배포

[테크수다 기자 도안구 eyeball@techsuda.com] 구글(Google)이 30일(현지시간) 차세대 프런티어 인공지능(AI) 모델 '제미나이 4 아르곤(Gemini 4 Argon)'을 공개하고 보안 전문가 대상 접근 프로그램 '페어윈드 프로그램(Fairwind Program)' 참여 기관에 먼저 배포하기 시작했다. 아르곤은 길고 복잡한 업무 흐름에서 깊이 있는 추론을 이어가도록 설계한 모델로, 소프트웨어 엔지니어링과 법률·금융 등 기업 지식 업무, 사이버 보안 방어를 주력 영역으로 삼는다. 구글은 출력 토큰 한도를 기존 6만4000개에서 100만 개로 늘렸고, 출시 기념가로 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 10달러를 책정했다. 개발자와 기업, 일반 이용자 대상 공개는 안전장치를 보완한 뒤 단계적으로 진행한다.

주요 내용

  • 페어윈드 프로그램 참여 보안 전문가에게 우선 배포하고, 이후 유료 API 이용자 및 구글 AI 울트라(Google AI Ultra) 구독자부터 순차 공개한다.
  • 출력 토큰 한도를 6만4000개에서 100만 개로 늘리고, 캐시된 입력 토큰에는 입력 가격 대비 95% 할인을 적용한다.
  • 딥SWE(DeepSWE) v1.1 77.9%, CWE 벤치(CWE-bench) v1 68%(공동 1위) 등 코딩·보안 평가에서 최고 수준을 기록했다(구글 발표 기준).

구글은 이미 내부 업무에 아르곤을 쓰고 있다. 회사에 따르면 아르곤은 양자 컴퓨팅 연구에서 병목을 일으키는 서브루틴의 큐비트·게이트 자원을 최적화해 기존 발표 기준치를 몇 분 만에 40% 이상 앞섰다. 아르곤 에이전트 팀은 데이터센터 전체 서버의 프로파일링 데이터를 분석해 메모리 최적화 방안을 스스로 찾아 300TiB가 넘는 메모리를 확보했고, 회사는 최종 절감 규모를 최대 1PiB로 내다봤다. 구글은 80만 줄이 넘는 푸크시아 OS 지르콘(Fuchsia OS Zircon) 커널 등 C/C++ 코드베이스를 러스트(Rust)로 전환하는 작업에도 아르곤을 투입했으며, 오픈소스 비디오 디코더를 기존 러스트 버전보다 2.7배 빠르게 개선했다.

구글 발표 기준으로 아르곤은 장기 소프트웨어 엔지니어링 능력을 평가하는 딥SWE v1.1에서 77.9%, 장편 영상 이해도를 재는 LV벤치(LVBench)에서 91.7%를 기록해 최고 수준에 올랐다. 금융·법률·세무 업무 성과를 평가하는 밸스 인덱스(Vals Index)와 재피어(Zapier)의 업무 자동화 평가 오토메이션벤치(AutomationBench)에서도 1위를 차지했다. 보안 분야에서 아르곤은 취약점 해결 능력을 재는 CWE 벤치 v1에서 68%로 공동 1위를 기록했다. 클라우드 보안 기업 위즈(Wiz)는 공공 인프라 무상 보호 사업 '스캔 포 굿(Scan for Good)'에 아르곤을 투입해 전 세계 병원이 쓰는 헬스케어 소프트웨어에서 개인정보 노출로 이어질 수 있는 치명적 취약점을 찾아냈다.

구글은 신뢰할 수 있는 보안 전문가와 내부 팀에 사이버 가드레일을 해제한 버전을 제공하는 한편, 오용 방지와 프롬프트 인젝션(prompt injection) 방어, 정렬 불일치(misalignment) 감시, 시스템 보안 등 4개 영역에서 안전장치를 보강하고 있다. 미국 정부의 자발적 사전 출시 모델 접근 절차에도 참여했다. 코라이 카바쿨루(Koray Kavukcuoglu) 구글 딥마인드(Google DeepMind) 최고기술책임자(CTO) 겸 구글 수석 AI 아키텍트는 아르곤이 개발자와 전문가, 기업이 가장 까다로운 난제를 푸는 과정에서 든든한 파트너가 되도록 설계했다고 밝혔다. 독립 AI 평가 기관 아티피셜 애널리시스(Artificial Analysis)는 아르곤이 오픈AI(OpenAI)의 GPT-6 아스트라(GPT-6 Astra)와 같은 종합 지능 지수를 기록하면서도 현재 할인가 기준 작업당 비용은 60% 수준이라고 평가했다.

구글 제미나이 4 아르곤, 이런 점이 궁금하다

Q. 지금 바로 쓸 수 있나요?

A. 아직 일반에 공개되지 않았다. 현재는 페어윈드 프로그램에 참여한 보안 전문가와 구글 내부 팀만 쓸 수 있다. 구글은 유료 API 이용자와 구글 AI 울트라 구독자를 시작으로 개발자, 기업, 일반 이용자 순으로 공개 범위를 넓힐 계획이며, 구체적 일정은 밝히지 않았다.

Q. 출력 토큰 한도 100만 개는 어떤 의미인가요?

A. 모델이 한 번 실행에서 생성할 수 있는 결과물의 최대 길이가 기존 6만4000개에서 약 16배로 늘었다는 뜻이다. 아르곤은 단일 실행 안에서 수십만 개의 토큰을 생성하며 깊이 사고할 여유를 확보했다. 대규모 코드 전환이나 다단계 리서치처럼 긴 결과물이 필요한 작업을 중간에 끊지 않고 처리하는 데 유리하다.

Q. 왜 보안 전문가에게 먼저 공개하나요?

A. 아르곤은 소프트웨어 취약점을 자율적으로 찾아 검증하고 패치할 만큼 사이버 역량이 높아 악용 위험도 함께 커졌다. 구글은 방어자에게 먼저 모델을 제공해 보안 역량을 강화하고, 초기 테스터의 피드백으로 안전장치를 정교화한 뒤 공개 범위를 넓히는 단계적 방식을 택했다. 페어윈드 프로그램은 구글이 2026년 9월 초 정부와 구글 클라우드 고객, 보안 파트너를 대상으로 시작한 제한적 접근 프로그램이다.

[테크수다 기자 도안구 eyeball@techsuda.com]

Newsletter
디지털 시대, 새로운 정보를 받아보세요!

테크가 전 산업 영역에 스며드는 소식에 관심이 많다. 1999년 정보시대 PCWEEK 테크 전문지 기자로 입문한 후 월간 텔레닷컴, 인터넷 미디어 블로터닷넷 창간 멤버로 활동했다. 개발자 잡지 마이크로소프트웨어 편집장을 거쳐 테크수다를 창간해 지금까지 활동하고 있다. 태블릿을 가지고 얼굴이 꽉 찬 방송, 스마트폰을 활용한 현장 라이브를 한국 최초로 진행했다.