Gemini 4 Argon 출시: 출력 1M 토큰, 코딩·사이버 방어 특화 모델
Google DeepMind가 Gemini 4 Argon을 발표했다. 출력 한도를 64K에서 1M 토큰으로 늘렸고 Fairwind Program으로 먼저 배포한다. 벤치마크는 Google 발표 수치다.
Google DeepMind가 Gemini 4 Argon을 발표했다. 출력 한도를 64K에서 1M 토큰으로 늘렸고 Fairwind Program으로 먼저 배포한다. 벤치마크는 Google 발표 수치다.
핵심 요약
Google DeepMind가 2026년 9월 30일 Gemini 4 Argon을 발표했다. 발표는 Koray Kavukcuoglu가 맡았다. 코딩, 엔터프라이즈 업무, 사이버 방어를 겨냥한 프런티어 모델이다. 가장 큰 변화는 출력 한도다. 기존 64K 토큰에서 1M 토큰으로 확대됐다. 9월 26일에 다룬 'post-training 진입' 소식과는 별개로, 이번이 실제 출시 발표다.
이 글의 벤치마크 수치는 모두 Google 발표 기준이다. 독립 기관의 검증 여부는 확인되지 않았다.
주요 기능
1. 출력 한도 1M 토큰
출력 한도가 64K에서 1M 토큰으로 늘었다. 긴 코드 생성이나 장문 보고서 작성처럼 한 번에 많은 결과물이 필요한 작업에 관련된 변화다.
2. 사이버 방어 특화
Google은 데모에서 병원 소프트웨어의 심각한 취약점을 발견하는 장면을 공개했다. 또 간접 프롬프트 인젝션(IPI)에 가장 강한 모델이라고 주장한다. IPI는 문서나 웹페이지에 숨긴 지시문으로 AI를 조종하는 공격이다. Google에 따르면 Gray Swan IPI 벤치마크에서 1위다.
3. 벤치마크 결과 (Google 발표)
| 벤치마크 | 점수 | 순위 |
|---|---|---|
| DeepSWE v1.1 | 77.9% | 순위 미명시 |
| Vals Index | 68.9% | 1위 |
| CWE-bench v1 | 68% | 공동 1위 |
| LVBench | 91.7% | 순위 미명시 |
| Zapier AutomationBench | 51.3% | 1위 |
| FrontierSWE v2 | 55.0% | 경쟁 모델에 뒤짐 |
FrontierSWE v2에서는 경쟁 모델에 뒤진다는 점도 함께 공개됐다. 모든 영역에서 앞서는 모델은 아니라는 뜻이다.
접근 방식과 가격
일반 공개는 아직 아니다. 검증된 보안 전문가를 대상으로 한 Fairwind Program으로 먼저 배포한다. 이후 유료 API 고객과 Google AI Ultra 구독자로 넓힐 계획이다. 일반 공개일은 정해지지 않았다.
가격은 100만 토큰당 기준이다.
| 구분 | 입력 | 출력 | 캐시 입력 |
|---|---|---|---|
| 도입가 | $2 | $10 | $0.10 |
| 이후 가격 | $4 | $20 | 미공개 |
도입가 적용 기간은 확인된 정보에 없다. 이후 가격은 도입가의 2배다.
사용성 분석
현재 대부분의 개발자는 바로 쓸 수 없다. 초기 사용자는 검증을 통과한 보안 전문가로 한정된다. 취약점 분석, 코드 감사, 대규모 코드 생성을 하는 팀이 먼저 관심을 가질 만하다. 업무 자동화 용도라면 Zapier AutomationBench 결과를 참고할 수 있다. 다만 실제 업무 환경의 성능은 접근이 열린 뒤 직접 확인해야 한다.
한계와 유의점
벤치마크가 모두 벤더 발표 수치다. 'IPI에 가장 강하다'는 표현도 Google의 주장이다. 제한 접근 방식이라 외부 검증이 늦어질 수 있다. 도입가가 한시적이어서 장기 비용은 이후 가격으로 계산해야 한다.
전망
단계적 배포는 사이버 역량이 높은 모델을 신중하게 푸는 방식으로 읽힌다. 접근이 API 고객과 Ultra 구독자로 확대되면 독립 평가가 나올 것이다. 그때 Google 수치와 비교할 수 있다.
결론
Gemini 4 Argon은 출력 1M 토큰과 보안 특화가 뚜렷한 모델이다. 반면 접근 제한과 자체 발표 수치라는 한계가 있다. 보안 팀과 대규모 코드 생성이 필요한 개발 조직은 접근 확대 시점을 주시할 만하다. 일반 사용자는 독립 평가를 기다려도 늦지 않다.
장점
- 출력 한도 1M 토큰으로 대용량 생성 작업에 유리
- Vals Index 1위, CWE-bench v1 공동 1위 등 보안·업무 벤치마크에서 상위권(Google 발표)
- 도입가 기준 캐시 입력 $0.10으로 반복 호출 비용 절감 여지
- 단계적 배포로 사이버 역량 모델의 오남용 위험을 관리하려는 접근
단점/한계
- 현재 접근이 검증된 보안 전문가로 제한되고 일반 공개일 미정
- 벤치마크가 모두 Google 발표 수치이며 독립 검증 여부 불명
- FrontierSWE v2에서 경쟁 모델에 뒤짐
- 도입가 이후 가격이 2배로 오르며 적용 기간은 확인되지 않음
참고 자료
댓글0개
주요 기능/특징
1. 2026-09-30 Google DeepMind 발표, 코딩·엔터프라이즈 업무·사이버 방어용 프런티어 모델 2. 출력 한도 64K에서 1M 토큰으로 확대 3. Fairwind Program(검증된 보안 전문가) 선행 배포, 이후 유료 API 고객과 Google AI Ultra 구독자로 확대 예정 4. Google 발표 기준 Vals Index 68.9%(1위), CWE-bench v1 68%(공동 1위), DeepSWE v1.1 77.9% 5. 100만 토큰당 도입가 입력 $2, 출력 $10, 캐시 입력 $0.10, 이후 입력 $4, 출력 $20
핵심 인사이트
- 출력 한도가 64K에서 1M 토큰으로 커져 장문 코드·문서 생성 작업의 제약이 줄어든다
- Google은 데모에서 병원 소프트웨어의 심각한 취약점을 발견했다고 밝혀 사이버 방어 용도를 전면에 내세웠다
- Gray Swan IPI 벤치마크 1위라는 주장은 Google 발표이며 독립 검증 여부는 확인되지 않았다
- FrontierSWE v2(55.0%)에서 경쟁 모델에 뒤진다고 Google이 밝혀, 모든 코딩 평가에서 앞서는 것은 아니다
- Fairwind Program 선행 배포는 검증된 보안 전문가부터 접근시키는 단계적 공개 전략이다
- 이후 가격은 도입가의 2배(입력 $2에서 $4, 출력 $10에서 $20)여서 장기 비용 계획은 이후 가격 기준이 필요하다
- 일반 공개일이 정해지지 않아 현재는 평가 정보가 제한적이며, 외부 검증은 접근 확대 이후에야 가능하다
- 9월 26일의 post-training 진입 소식 이후 4일 만에 실제 출시 발표가 나왔다
이 리뷰가 유용했나요?
공유하기
관련 AI 리뷰
Gemini·AI 모드에 Flipkart 구매 버튼...인도서 결제 테스트 시작
Google이 인도 일부 사용자 대상으로 Gemini와 AI 모드 안에서 Flipkart 상품을 바로 결제할 수 있는 테스트를 시작했다. 일부 카테고리로 한정되며 10월 확대가 예정돼 있다.
Gemini 4 포스트트레이닝 진입, 이례적 속도로 조기 출시 예고
Google DeepMind 신임 수석부사장 Koray Kavukcuoglu가 Gemini 4의 post-training 진입을 공개했다. 7월 21일 프리트레이닝 시작 후 약 2개월 만이다. 얼리 버전을 최대한 빨리 출시하겠다고 밝혔다.
Experian, Google Gemini 생태계 첫 개인 금융 앱으로 통합
신용평가사 Experian이 Gemini에 공식 통합된 최초의 개인 금융 앱이 됐다. 채팅으로 FICO 점수를 확인할 수 있다. 현재 미국 소비자 대상이다.
Gemini 3.8 Live 공개, 실시간 음성 대화 중 추론까지 수행
Google이 2026년 9월 15일 실시간 음성 AI 'Gemini 3.8 Live'와 확장 추론판 'Live Extended Thinking'을 발표했다. 97개 언어 자동 전환과 말하며 추론하는 기능이 핵심이다.
