# 구글 “Gemini 4 Argon” 발표, 출력 제한 100만 토큰, 기업 업무의 4가지 지표에서 GPT-6 Astra 등 상회, 우선 사이버 방어용으로 제한 제공

> https://bookfactory.kr/board/news/19956
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-10-04T05:40:12.511Z

---

이미지 출처: Google

Google는 2026년 9월 30일(현지 시간), 새로운 프론티어 AI 모델 “Gemini 4 Argon”을 발표했다. 출력 상한을 기존의 6만 4천 토큰에서 100만 토큰으로 확대하고, 대규모 코드의 개정이나 금융 및 법무의 조사 등 장시간에 걸쳐 복잡한 업무에 대응한다. 처음에는 사이버 방어 관계자에게만 제한적으로 제공한다.

구글이 자체적으로 300TiB 이상의 메모리를 확보하고, 영상 처리 속도를 2.7배 향상시켰습니다.

구글은 이미 아르곤을 사용하여 내부 업무의 결과를 발표하고 있습니다. 여러 개의 아르곤 에이전트가 데이터 센터의 가동 데이터를 분석하여 메모리 사용량을 줄일 수 있는 부분을 특정하고 최적화를 적용합니다. 확산 후에 300TiB 이상의 메모리를 해방했다고 합니다.

영상 디코딩용 오픈 소스 소프트웨어 “libgav1”에서는 기존의 Rust 이식 버전의 약 3만 2000 행의 코드를 대체했다. 실험과 컴파일러 출력 분석을 반복적으로 거쳐 동일한 영상 출력을 유지하면서, 그 Rust 이식 버전의 2.7배의 속도로 동작하는 디코더를 만들었다.

아르곤 에이전트는 C/C++로 작성된 코드를 Rust로 이식하는 작업에도 참여하고 있습니다. 대상에는 80만 행을 초과하는 Fuchsia의 Zircon 커널도 포함됩니다. 구글은こうした 대규모 재작업에 대해 실제 환경에의 배포 전에 감사 및 테스트, 검토를 진행하고 있습니다.

## 금융 및 법무 업무 지표에서 타사 모델을 상회

Google에서 공개한 비교에 따르면, 장시간 소프트웨어 개발을 평가하는 “DeepSWE v1.1”에서 77.9%를 기록했다. 비교 대상인 GPT-6 Astra는 74.1%, Claude Opus 5.5는 74.2%였다.

다중 단계의 금융 조사를 측정하는 “Vals Finance Agent v2”에서는 65.4%, 법무 조사 및 문서 작성 평가를 측정하는 “Harvey’s Legal Agent Benchmark”에서는 19.6%가 되었다. 이 두 지표에, 재무, 코딩, 법무, 세무를 종합적으로 평가하는 “Vals Index”와 업무를 처음부터 끝까지 실행하는 능력을 측정하는 “AutomationBench”를 더하여 기업 업무의 4가지 지표에서 GPT-6 Astra, Claude Fable 5.1, Claude Opus 5.5를 상회했다.

■ 기업 업무의 4가지 지표에서는 Argon이 게재된 다른 3개 모델을 상회했다. 반면, 소프트웨어 개발의 FrontierSWE v2 및 Terminal-bench 4.0에서는 다른 모델의 점수가 높았으며, 개발 작업 전반에 걸쳐 우위라는 결과는 아니었다.

이미지 출처: Google

## 의료 소프트웨어의 취약점 발견, 외부로부터의 악의적인 지시 대응 능력도 강화

아르곤(Argon)은 소프트웨어의 취약점을 자율적으로 발견하고 검증하며 수정하는 기능을 갖춘다. 구글(Google)에 따르면, 위즈(Wiz)는 공공 인프라를 무료로 보호하는 “Scan for Good”에서 이미 아르곤(Argon)을 활용하고 있다. 초기 이용에서는 전 세계 각지의 병원에서 사용되는 의료 소프트웨어에서 민감한 개인 정보가 노출되는 심각한 취약점을 발견했다. 기존의 프론티어 모델(Frontier Model)이 간과했던 문제였다고 한다.

20개 언어의 소스 코드를 조사하는 구글(Google)의 내부 평가에서는 85.8%, 소스 코드를 사용하지 않고 운영 중인 웹 시스템을 조사하는 위즈(Wiz)의 내부 침입 테스트 평가에서는 70.9%를 기록했다.

■ 젬마이(Gemini) 3.8 Flash 사이버(Cyber)에 대해, 소스 코드를 조사하는 취약성 평가에서는 14.8점, 소스 코드를 사용하지 않는 위즈(Wiz)의 침입 테스트 평가에서는 12.7점 개선되었다.

이미지 출처: 구글(Google)

외부 정보에 섞어든 악의적인 지시로 AI의 동작을 가로채는, 간접적 프롬프트 인젝션(Prompt Injection)에 대한 대책도 강화했다. 일반 제공을 위해, 모델의 사고와 행동을 감시하고 사용자의 의도에서 벗어나는 동작을 필요에 따라 중단하는 메커니즘의 도입도 진행하고 있다.

■ Gray Swan IPI로 15회까지 공격을 시도했을 경우 성공률은 0.7%(Argon), 1.0%(Claude Opus 5.5, Claude Fable 5.1), 8.5%(GPT-6 Astra)이다. 성공률이 낮을수록 악의적인 지시로 동작을 가로채기 어렵다.

이미지 출처: Google

## 일반 사용자 대상 시작일은 미공개, 도입 가격은 입력 2달러, 출력 10달러

현재는 심사받은 사이버 방어 관계자 대상의 Fairwind 프로그램を通じて 순차적으로 제공하고 있다. 대상자와 Google의 내부 팀에는 사이버 영역의 경계를 허용한 상태로 제공한다. 유료 API 사용자 및 Google AI Ultra 등록자로부터 제공을 확대할 계획이지만, 구체적인 시작일은 밝히지 않았다.

도입 가격은 100만 입력 토큰당 2달러, 100만 출력 토큰당 10달러이다. 캐시된 입력은 입력 요금의 95% 할인된다. 영어판 공식 발표에서는 도입 기간 종료 후 입력 4달러, 출력 20달러로 변경될 예정이라고 명시되어 있다.

관련 기사: Google “Gemini 3.8 Flash”, Meta “Muse Spark 1.3” AI 신 모델 연이어 출시, Google은 AI 이미지 생성 및 편집 툴 “Google Pics”도 제공 시작

관련 기사: 구글 “Gemini”도 실제 기업 침투 확인, 5월 사이버 시험 중 실네트워크 연결, 3개 회사 접근

관련 기사: OpenAI, “GPT-6.1 Sol” 공개, 이전 모델에서 1주일 만에 업데이트, GPT-6.1 Astra 공개 보류도, DevDay에서 판단 처리 API 및 상시 가동 에이전트 등 발표

[원문 보기](https://ledge.ai/articles/google_gemini_4_argon) | 출처: Ledge.ai