- 시작
- 2026년 9월 30일신뢰도 90%출처 제공
제미나이 4 아르곤 발표
원문에서 자동 번역됨
원본 제목: Gemini 4 Argon Announced
- 구글은 2026년 9월 30일 제미나이 4 아르곤을 발표하며 실제 소프트웨어 엔지니어링, 법률·금융 같은 기업 지식 업무, 사이버 보안 방어를 위한 "새로운 프런티어 모델"이라고 소개했다[1]
- 페어윈드 프로그램을 통해 신뢰할 수 있는 일부 사이버 방어 담당자에게 먼저 제공되며, 구글은 접근을 점진적으로 넓히는 동안 미국 정부의 자발적 사전 출시 모델 접근 절차에도 참여하고 있다[1]
- 구글은 유료 API 고객과 구글 AI 울트라 구독자부터 시작해 개발자, 기업, 일반 소비자에게 "가능한 한 빨리" 제공할 계획이어서 전면 출시는 아직 남아 있다[1]
- 내부적으로는 이미 구글 업무 흐름을 움직이고 있다. 에이전트가 데이터센터 전반에서 300 TiB 넘는 메모리를 확보했고, 양자 서브루틴 기준선을 40% 앞섰으며, 퓨시아 OS 지르콘 커널의 C/C++ 코드를 최대 800K+ 줄까지 러스트로 옮기는 작업을 도왔다[1]
- 사이버 방어 시연에서는 이전 프런티어 모델들이 놓친, 전 세계 병원에서 쓰는 의료 소프트웨어의 치명적 취약점을 찾아냈다[1]
주요 특징
- 출력 한도가 64K에서 1 million 토큰으로 늘어, 하나의 추론 경로에서 수십만 토큰에 걸쳐 사고할 수 있다[1]
- 도입 가격은 입력 100만 토큰당 $2, 출력 100만 토큰당 $10이며 캐시된 입력은 95% 저렴하다. 이후에는 각각 $4와 $20이 된다[1]
- DeepSWE v1.1에서 77.9%로 새 최고 기록을 세웠고(GPT-6 Astra 74.1%, Claude Opus 5.5 74.2%), AutomationBench 51.3%와 Vals Index 68.9%에서는 1위다[1][2]
- 긴 영상 이해 LVBench 91.7%, Vals Finance Agent v2 65.4%, Harvey의 Legal Agent Benchmark 19.6%[1][2]
- 취약점 수정 능력을 보는 CWE-bench v1 68.0%로 공동 1위이며, 구글은 사이버 안전장치를 해제한 버전을 신뢰할 수 있는 방어 담당자와 자사 팀에 제공한다[1][2]
- 안전장치: 정당한 이중 용도 과학은 허용하면서 유해한 요청은 거부하고, Gray Swan의 간접 프롬프트 인젝션 벤치마크에서 최고 점수를 받았으며, 범위를 벗어난 실행을 중단시키는 사고 과정·행동 모니터링과 강화된 샌드박스를 갖췄다[1][2]
벤치마크[2]
| 벤치마크 | Gemini 4 Argon | GPT-6 Astra | Claude Fable 5.1 | Claude Opus 5.5 |
|---|---|---|---|---|
| Vals Index (지식 업무) | 68.9% | 63.1% | 65.8% | 67.0% |
| AutomationBench (지식 업무, 점수) | 51.3% | 41.4% | 31.4% | 42.5% |
| Vals Finance Agent v2 (지식 업무) | 65.4% | 53.5% | 58.9% | 58.6% |
| Harvey's Legal Agent Benchmark (지식 업무) | 19.6% | 5.4% | 6.7% | 3.8% |
| DeepSWE v1.1 (에이전트 코딩) | 77.9% | 74.1% | 67.4% | 74.2% |
| FrontierSWE v2 (에이전트 코딩) | 55.0% | 65.5% | 56.3% | 62.3% |
| Vibe Code Bench (에이전트 코딩) | 91.9% | 89.6% | 90.3% | 90.3% |
| Terminal-bench 4.0 (에이전트 코딩) | 57.4% | 58.2% | 57.9% | 66.4% |
| PostTrainBench (ML 엔지니어링) | 45.3% | 44.3% | 40.2% | 49.3% |
| Terminal-Bench Science 0.1 (과학 및 수학) | 57.6% | 68.1% | 52.6% | 63.3% |
| LABBench 2 (과학 및 수학) | 88.8% | 85.4% | 68.6% | 73.1% |
| RiemannBench (과학 및 수학) | 76.0% | 72.0% | 65.6% | 69.6% |
| GraphWalks (긴 컨텍스트, 최대 128k, BFS (F1)) | 99.7% | 98.7% | 91.4% | 90.6% |
| GraphWalks (긴 컨텍스트, 256k~1M, BFS (F1)) | 84.2% | 71.8% | 65.0% | 66.8% |
| Agent's Last Exam (컴퓨터 사용, 통과율) | 39.5% | 34.2% | — | 38.2% |
| OSWorld-2.0 (컴퓨터 사용, 오프라인 하위 집합 부분 점수) | 69.2% | 72.6% | — | — |
| Chartography (멀티모달 이해) | 71.6% | 71.0% | 46.2% | 66.3% |
| LVBench (멀티모달 이해) | 91.7% | 87.5% | 79.7% | 83.7% |
| CWE-bench v1 (사이버 보안) | 68.0% | 68.0% | 58.0% | 67.0% |
참고자료 2신뢰도 87%종합 신뢰도: 87%핀의 출처와 참고 자료가 날짜를 얼마나 뒷받침하는지.출처를 포함한 자료 2건이 핀의 시작·종료 시각을 얼마나 강하게 뒷받침하는지에 대한 가중 평균. 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다신뢰도 75% 이상 핀 모두 보기
첫 번째 항목은 항상 핀의 출처입니다. 전체 신뢰도는 각 자료가 위의 시작·종료 시각을 얼마나 확실히 뒷받침하는지에 대한 가중 평균이며, 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다.
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argonblog.google· 게시 2026년 9월 30일· 시작 2026년 9월 30일 ✓· 점수의 50%
구글의 게시글 "Gemini 4 Argon: our next era of frontier intelligence"는 2026년 9월 30일자이며, "Today, we're announcing our new frontier model, Gemini 4 Argon, which is rolling out to a set of trusted cyber defenders"(오늘 새 프런티어 모델 제미나이 4 아르곤을 발표하며, 신뢰할 수 있는 일부 사이버 방어 담당자에게 먼저 제공한다)라고 밝혔다. 개발자, 기업, 소비자 대상 전면 제공은 "가능한 한 빨리" 이어진다(추정 핀 4810 참조).
- [2]85%Gemini - Google DeepMinddeepmind.google· 추가 2026년 9월 30일· 시작 2026년 9월 30일· 점수의 50%
DeepMind's Gemini page now leads with Gemini 4 Argon and carries its benchmark table against GPT-6 Astra, Claude Fable 5.1 and Claude Opus 5.5, plus the four safeguard areas Google is strengthening before broad availability.
수정 제안
빠지거나 잘못된 점이 있나요? 이 핀을 뒷받침하는 링크, 다른 시작일이나 종료일과 그 이유, 빠지거나 잘못된 사실을 자신의 말로 알려주세요. AI가 이 핀의 출처와 대조하고 더 나은 자료를 찾아, 뒷받침하는 페이지를 추가합니다. 핀 자체의 출처가 여전히 가장 중요하게 반영됩니다. AI는 이미지도 확인합니다. 다른 것을 보여주거나 제대로 보여주지 못하는 이미지는 뒤로 옮기거나 교체합니다.