- 시작
- 2026년 8월 13일신뢰도 95%deepmind.google 제공
제미나이 3.7 플래시 출시
원문에서 자동 번역됨
원본 제목: Gemini 3.7 Flash Released
구글이 3.6 플래시 출시 3주 만에 제미나이 3.7 플래시를 절반 가격에 내놨다. 2026년 말까지 입력 100만 토큰당 $0.75, 출력 100만 토큰당 $3.75이며, DeepSWE는 49.0%에서 65.3%로 뛰었다.
- 구글은 3.6 플래시 출시 불과 3주 뒤인 2026년 8월 13일 제미나이 3.7 플래시를 출시하며 "개발자 피드백과 알고리즘 혁신의 직접적 결과"라고 설명했다[1]
- 디버깅과 이슈 해결에서 3.6 플래시보다 "큰 폭의 향상"을 보였다. DeepSWE v1.1은 49.0%에서 65.3%로, FrontierCode 1.1 Main은 34.4%에서 43.6%로 올랐다[1]
- 제미나이 앱에서는 구글 AI 프로와 울트라 구독자용 스파크에 먼저 적용됐다[1]
주요 특징
- 2026년 말까지 적용되는 도입 가격은 입력 100만 토큰당 $0.75, 출력 100만 토큰당 $3.75로, 3.6 플래시가 출시됐을 때 가격의 절반이다[1][2]
- WebDev Arena Elo 1588(3.6 플래시 1538), GDP.pdf 문서 이해 34.0% 대 22.0%, AutomationBench 30.4% 대 17.0%[1]
- Terminal-bench 2.1 85.8%, OSWorld-2.0 47.9%, Artificial Analysis Intelligence Index 56[2]
- 화학·생물·방사능·핵(CBRN) 오남용과 사이버 공격에 대한 안전장치를 업데이트했다[1]
벤치마크[2]
| 벤치마크 | Gemini 3.7 Flash | Gemini 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra | Muse Spark 1.2 |
|---|---|---|---|---|---|
| 입력 가격 ($/1M 토큰) | $0.75* | $0.75* | $2.00 | $2.00 | $1.25 |
| 출력 가격 ($/1M 토큰) | $3.75* | $3.75* | $10.00 | $12.00 | $4.25 |
| Artificial Analysis Intelligence Index (종합 모델 지능) | 56 | 52 | 55 | 57 | 57 |
| FrontierCode 1.1 Main (실서비스 코드 품질, 점수) | 43.6% | 34.4% | 42.7% | 41.3% | — |
| DeepSWE v1.1 (장기 소프트웨어 엔지니어링) | 65.3% | 48.6% | 53.8% | 69.6% | 54.9% |
| Code Arena (웹 개발, Elo) | 1588 | 1538 | 1541 | 1523 | 1535 |
| Terminal-bench 2.1 (에이전트 터미널 코딩) | 85.8% | 78.0% | 80.4% | 87.4% | 82.9% |
| Terminal-bench 3.0 (범용 에이전트 역량) | 14.9% | 5.4% | 14.6% | 20.8% | — |
| AutomationBench (기업 업무 자동화, 비공개 세트) | 30.4% | 17.0% | 10.7% | 23.6% | — |
| GDPVal-AA v2 (지식 업무, Elo) | 1525 | 1422 | 1598 | 1578 | 1628 |
| Harvey LAB-AA (복잡한 법률 업무) | 90.7% | 85.1% | 90.1% | 85.2% | — |
| GDP.pdf (전문가급 PDF 문서 이해) | 34.0% | 22.0% | 28.0% | 24.7% | 16.0% |
| CharXiv Reasoning (복잡한 차트에서의 정보 종합, 도구 미사용) | 84.5% | 85.2% | 77.0% | 85.9% | — |
| CharXiv Reasoning (복잡한 차트에서의 정보 종합, 도구 사용) | 88.7% | 89.4% | 88.3% | — | — |
| LVBench (긴 영상 이해) | 85.4% | 84.2% | 68.5% | 78.9% | — |
| GDM-MRCR v2 (8-needle) (긴 컨텍스트 성능, 128k(평균)) | 97.0% | 91.8% | 81.5% | 93.5% | — |
| OSWorld-2.0 (에이전트 컴퓨터 사용) | 47.9% | 33.8% | — | 50.2% | — |
| Agent's Last Exam (멀티모달 데스크톱·OS 에이전트 과제, 통과율) | 26.3% | 24.2% | 33.3% | 28.0% | — |
| HLE-Verified (다학제 전문가 추론) | 53.6% | 51.2% | 31.0% | 51.1% | — |
| BioMysteryBench (생물정보학 연구 추론, 사람이 풀 수 있는 문제) | 87.1% | 80.6% | 87.5% | 83.8% | — |
| BioMysteryBench (생물정보학 연구 추론, 사람에게 어려운 문제) | 43.5% | 41.2% | 34.1% | 49.4% | — |
| LABBench2 (생물학 실제 연구 과제) | 82.1% | 76.1% | 80.1% | 81.2% | — |
참고자료 2신뢰도 92%종합 신뢰도: 92%핀의 출처와 참고 자료가 날짜를 얼마나 뒷받침하는지.출처를 포함한 자료 2건이 핀의 시작·종료 시각을 얼마나 강하게 뒷받침하는지에 대한 가중 평균. 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다신뢰도 75% 이상 핀 모두 보기
첫 번째 항목은 항상 핀의 출처입니다. 전체 신뢰도는 각 자료가 위의 시작·종료 시각을 얼마나 확실히 뒷받침하는지에 대한 가중 평균이며, 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다.
- [1]90%9to5google.com/2026/08/13/gemini-3-7-flash-launch9to5google.com· 게시 2026년 9월 30일· 시작 2026년 8월 13일· 점수의 55%
9to5Google의 출시 기사는 2026년 8월 13일자이며, 구글이 "오늘 제미나이 3.7 플래시를 발표했다"고 전한다. 딥마인드의 모델 카드도 2026년 8월 13일 공개됐다.
- [2]95%Gemini 3.7 Flash - Model Carddeepmind.google· 게재 2026년 8월 13일· 시작 2026년 8월 13일 ✓· 점수의 45%
DeepMind's model card, published 13 August 2026, lists the introductory prices and a benchmark table against 3.6 Flash, Claude Sonnet 5, GPT-5.6 Terra and Muse Spark 1.2.
수정 제안
빠지거나 잘못된 점이 있나요? 이 핀을 뒷받침하는 링크, 다른 시작일이나 종료일과 그 이유, 빠지거나 잘못된 사실을 자신의 말로 알려주세요. AI가 이 핀의 출처와 대조하고 더 나은 자료를 찾아, 뒷받침하는 페이지를 추가합니다. 핀 자체의 출처가 여전히 가장 중요하게 반영됩니다. AI는 이미지도 확인합니다. 다른 것을 보여주거나 제대로 보여주지 못하는 이미지는 뒤로 옮기거나 교체합니다.