반값은 올해뿐이다: Gemini 3.7 Flash가 일하는 가격

Google은 8월 13일 Gemini 3.7 Flash를 올렸고, 올해 말까지 입력 100만 토큰 $0.75·출력 $3.75로 3.6 Flash 원래 값의 반값이라고 했다. 1월 1일부터는 $1.50/$7.50로 돌아가며, FrontierCode 43.6%와 DeepSWE 65.3%는 Google이 보고한 점수다.

반값은 올해뿐이다: Gemini 3.7 Flash가 일하는 가격

핵심 요약 (TL;DR)

반값은 올해뿐이다: Gemini 3.7 Flash가 일하는 가격

Google은 2026년 8월 13일 공식 블로그 Introducing Gemini 3.7 Flash를 올렸다. 부제는 “our most intelligent workhorse model yet for coding and agents.”다. 글쓴이는 Tulsee Doshi, Senior Director, Product Management, Gemini team. 3.6 Flash 세 주 만이다. 이 글은 Gemma 4나 Qwen 글이 아니다.

Flash는 Google이 매일 돌리는 값싼 빠른 층이다. 워커호스는 그 층을 하루 종일 부리는 일말 모델이라는 뜻이다. Pro 기함이 아니다. 도입가는 3.6 Flash 원래 값의 반이다. 올해 말까지 입력 100만 토큰 $0.75, 출력 $3.75. 토큰은 모델이 읽고 쓰는 최소 글자 덩어리다. 가격은 100만 토큰 단위로 매긴다. 각주 1은 이 값이 2026년 12월 31일에 끝난다고 적는다. 2027년 1월 1일부터는 입력 $1.50, 출력 $7.50.

Google 공식 블로그의 Gemini 3.7 Flash 히어로. 별 아이콘과 모델 이름
공식 글 히어로. Spark 아이콘과 “Gemini 3.7 Flash”가 밝은 파란 배경 위에 있다. 출처: Google 공식 블로그

Google이 보고한 점수는 이렇다. FrontierCode 1.1 Main 43.6% 대 34.4%. DeepSWE v1.1 65.3% 대 49.0%. WebDev Arena Elo 1588 대 1538. GDP.pdf 34.0% 대 22.0%. AutomationBench 30.4% 대 17.0%. 모두 3.6 Flash 대비다. 이 글이 다시 잰 값이 아니다.

Gemini Spark는 그날부터 3.7 Flash를 쓴다. Google AI Pro와 Ultra, 160개 이상 국가. 개발자는 Antigravity, Gemini API, AI Studio, Android Studio. 기업은 Gemini Enterprise Agent Platform과 Gemini Enterprise 앱. 개인은 Spark. 안전은 모델 카드다. CBRN과 사이버 공격 오용에 대한 보호를 업데이트했다고 공식 글은 적는다.

배경 및 맥락

3주 주기다. 공식 글은 개발자 피드백과 알고리즘 혁신의 직접 결과라고 한다. 모델 카드는 3.7 Flash가 3.6 Flash에 기반한다고 적는다. 새 아키텍처를 밝히지 않는다. 입력은 텍스트·이미지·오디오·비디오와 PDF, 컨텍스트 최대 100만 토큰. API 문서는 1,048,576이다. 출력은 텍스트, 65,536토큰. 지식 컷오프는 2026년 3월이고, 일부 영역은 2025년 1월에 머문다고 카드는 적는다.

공식 글이 올린 칸은 셋이다. 소프트웨어 엔지니어링은 디버깅과 이슈 해결, 첫 패스 정확도, 프로덕션 코드다. 웹 개발은 기능 레이아웃과 참조 이미지·디자인 시스템 준수다. 지식 업무는 금융·법률·바이오사이언스와 복잡한 문서다. Spark는 I/O에서 나온 24시간 개인 에이전트다. Workspace 도구 사용을 개선했다고 한다. 파일 정리, 메일 초안, 현황 문서 갱신이 예다.

개발자 경험 문장도 점수와 따로 적혀 있다. 장애물에 더 잘 적응하고, 의도를 확인하고, 지시를 더 충실히 따른다. 다단계 계획과 도구 호출에 더 공을 들인다. 재시도와 수동 감시가 줄어든다고 한다. 그 문장은 Google의 주장이다. 독립 측정이 아니다.

주요 내용 분석

반값은 날짜가 있다

공식 글 본문은 도입가를 “3.6 Flash 원래 비용의 반”이라고 한다. 각주 1이 만료일을 적는다. 모델 카드 표는 3.6 Flash도 같은 $0.75/$3.75에 별표를 붙인다. 별표 설명은 같다. 12월 31일에 끝나고, 1월 1일부터 $1.50/$7.50. 반값은 3.7만의 영구 할인이 아니다. 올해를 닫는 창이다.

항목도입가 (~2026-12-31)2027-01-01부터출처
입력 100만 토큰$0.75$1.50공식 글 각주 1
출력 100만 토큰$3.75$7.50공식 글 각주 1
3.6 Flash 원래 값 대비절반원래 값으로 복귀공식 글 본문·각주 1

표의 오른쪽이 오늘 글의 상품이다. 에이전트는 입력을 많이 읽고 출력을 많이 쓴다. 출력 단가가 입력의 다섯 배다. 1월에 둘 다 두 배가 되면, 루프를 길게 돌리는 쪽의 청구가 먼저 뛴다. 도입가에 파이프라인을 고정하면, 그 고정이 내년 단가다.

점수는 Google 보고다

공식 글이 본문에 올린 대비는 다섯이다. 모두 3.6 Flash 대비, Google이 보고한 값이다.

벤치마크하는 일3.6 Flash3.7 Flash출처
FrontierCode 1.1 Main프로덕션 코드 품질34.4%43.6%Google 공식 글
DeepSWE v1.1긴 소프트웨어 엔지니어링49.0%65.3%Google 공식 글. 모델 카드 표의 3.6은 48.6%
WebDev Arena Elo웹 개발 상대 전적15381588Google 공식 글 (Arena.ai). 모델 카드는 Code Arena
GDP.pdf복잡한 문서22.0%34.0%Google 공식 글
AutomationBench실제 업무 워크플로17.0%30.4%Google 공식 글. 모델 카드는 Private set

Elo는 상대 전적의 점수다. 퍼센트가 아니다. 같은 경기장에서 이긴 비율을 누적한 레이팅이다. 1588이 1538보다 높다는 것은, Arena.ai WebDev Arena에서 3.7이 3.6보다 더 자주 이겼다는 Google 보고다. 절대 완성도가 88점이라는 뜻이 아니다.

FrontierCode 1.1 Main 막대 그래프. Gemini 3.7 Flash 43.6%, 3.6 Flash 34.4%
프로덕션 코드 품질. 3.7 Flash 43.6%, 3.6 Flash 34.4%, Claude Sonnet 5 42.7%, GPT-5.6 Terra 41.3%. 출처: Google 공식 블로그

그림이 본문 한 줄을 넓힌다. 3.6 대비 9.2포인트다. 같은 그림에서 Sonnet 5는 42.7%, Terra는 41.3%다. 3.7이 3.6을 크게 이긴 칸과, 경쟁 모델과는 1포인트 안팎인 칸이 같이 있다. “코딩이 열렸다”와 “Flash가 기함을 제쳤다”는 다른 문장이다.

DeepSWE v1.1 차트. Gemini 3.7 Flash 65.3% 대 3.6 Flash
긴 소프트웨어 엔지니어링. 공식 글은 65.3% 대 49.0%. 모델 카드 표의 3.6은 48.6%, GPT-5.6 Terra는 69.6%로 3.7을 웃돈다. 출처: Google 공식 블로그

DeepSWE가 본문에서 가장 크게 뛴 칸이다. 49.0에서 65.3. 모델 카드는 3.6을 48.6%로 적는다. 0.4포인트 차이다. 같은 카드에서 Terra는 69.6%다. 3.7이 Flash 줄을 끌어올린 것과, 최장 코딩 줄의 1위가 된 것은 다른 보고다. AutomationBench는 17.0에서 30.4로 뛴다. 카드는 Private set이라고 적는다. 공개 세트가 아니다.

GDP.pdf 차트. Gemini 3.7 Flash 34.0% 대 3.6 Flash 22.0%
복잡한 문서. 3.7 Flash 34.0%, 3.6 Flash 22.0%. 공식 글은 금융·법률·바이오사이언스 지식 업무의 근거로 이 칸을 든다. 출처: Google 공식 블로그

GDP.pdf 34.0%는 정답률이다. 문서를 다 읽었다는 뜻이 아니다. 공식 글은 이 칸으로 지식 밀집 분야를 말한다. 같은 카드에서 Claude Sonnet 5는 28.0%, Terra는 24.7%다. 문서 칸은 3.7이 앞선다. 지식 업무 Elo(GDPVal-AA v2)는 Muse Spark 1.2 1628, Sonnet 5 1598, Terra 1578, 3.7은 1525다. 본문이 고른 칸과 카드 전체는 한 줄이 아니다.

Google이 공개한 Gemini 3.7 Flash 벤치마크 전체 표. 가격과 경쟁 모델 점수
모델 카드와 같은 공식 평가 표. 별표 가격은 12월 31일에 끝나고 1월 1일부터 $1.50/$7.50. 방법론 링크는 deepmind.google/models/evals-methodology/gemini-3-7-flash. 출처: Google 공식 블로그

표의 굵은 칸이 3.7의 1위이고, 빈 칸과 남에게 준 1위가 같이 있다. 공식 표는 DeepSWE·Terminal-bench·AA Index에서 GPT-5.6 Terra가 앞선다. 본문이 고른 다섯 칸과 카드 전체가 한 줄이 아니다. 방법론은 카드가 가리키는 DeepMind 페이지다. 이 글이 재현하지 않는다.

어디에 올라탔는가

공식 글의 시도 칸은 셋이다. 개발자는 Google Antigravity의 에이전트 우선 워크플로, 또는 Gemini API를 AI Studio와 Android Studio에서. 기업은 Gemini Enterprise Agent Platform과 Gemini Enterprise 앱. 개인은 Spark. 개발자 가이드는 신규 Antigravity 사용자와 AI Studio Build, Gemini API Managed Agents의 기본 모델을 3.7 Flash로 돌린다고 적는다. 기본값이 바뀌면, 도입가가 기본 청구가 된다.

안전 문장은 짧다. Frontier Safety 보호의 범위와 강도를 계속 개선한다. 3.7 Flash는 CBRN과 사이버 공격 오용에 대한 보호를 업데이트한 채 나간다. 유익한 사용은 연다. 바이오리질리언스와 사이버 프로그램에 따른다고 한다. 자세한 것은 3.7 Flash 모델 카드다. 카드의 Frontier Safety 표는 CBRN·사이버·유해 조작·ML R&D 모두 추적·임계 능력 수준에 도달하지 않았다고 적는다. 사이버는 경보 임계에는 닿고 CCL에는 닿지 않는다. 그 판정도 Google 보고다.

실사용자 반응

공개 토론의 중심은 Hacker News다. 공식 글 스레드 item 49289112다. 이 글을 확인하는 2026-08-22 저녁(한국 시간) 기준 968점, 댓글 495다. 점수는 관심이지, 점수의 합의가 아니다.

simonw는 도입가부터 이상하다고 적는다. 2026년 12월 31일에 두 배가 된다. 3.6 Flash가 세 주 전에 나왔는데, 다섯 달 뒤에도 이 모델을 쓸 사람은 누구인가. GodelNumbering은 도입가가 사실상 상시에 가깝고, 높은 값에 사는 사람이 없다고 공개로 못 인정하는 쪽에 가깝다고 읽는다. Anthropic이 Sonnet 도입가를 영구로 돌린 트윗을 근거로 든다. wongarsu는 현업에 Opus 4.5와 18개월 된 Qwen 2.5-VL이 아직 있다고 적는다. 업그레이드는 검증 일이다. 가격에 둔감한 칸이 도입가 만료에 맞는다.

jjcm은 이미지→HTML을 올렸다. Opus 5가 여전히 최고고, 가격대가 비슷한 Grok 4.6이 따라왔다. 다른 댓글에서 Google이 뒤처졌다고 적는다. 나쁜 모델이 아니다. 3.7 Flash를 먼저 집을 상황이 안 보인다. API 키 마찰과 비파레토를 같이 가져가면 안 된다고 한다. 같은 가지에서 온보딩 불만이 길다. the_bigfatpanda는 1년째 프로덕션에 Gemini를 돌리다가 최근 두 달 이탈 중이라고 적는다. 사용 티어를 잘못 내리고 올리는 버그. 나흘 사이에 내렸다가 올렸다. 첫 사고는 약 4시간 심각한 레이트 리밋이었다.

Alifatisk는 GPT-5.6 Luna 할인 이후 감흥이 없다고 적는다. DeepSWE v1.1에서 Luna Max가 더 높다. 1월 단가 $1.50/$7.50을 Luna $0.20/$1.20과 나란히 둔다. 그 비교는 댓글의 비교다. Google 표의 1위 목록이 아니다.

공식 글은 초기 고객이 성능과 정밀도를 강조한다고 적는다. 블로그에는 Box, Harvey, LangChain, Databricks, Pydantic, Browser Use, Hebbia, Open Code, Cartwheel, emergent, Nunu.ai, Stanford Department of Biology 인용 카드가 이미지로 붙어 있다. 벤더가 고른 문구다. 이 글은 카드 원문을 옮기지 않는다. 독립 후기가 아니다.

의미와 시사점

오늘 글이 새로 깐 칸은 모델 이름이 아니다. 일하는 Flash의 값을 올해 안에 반으로 열어 두고, 1월에 닫겠다는 칸이다. Spark와 Antigravity와 Managed Agents의 기본값이 그날 바뀐다. 기본값이 바뀌면 도입가가 기본 청구다. 반값은 트래픽을 붙잡는 창이다. 창이 닫히면 루프 단가가 같이 뛴다.

3주 주기는 점수를 빨리 올린다. 같은 속도가 파이프라인을 고정할 모델을 찾기 어렵게 한다. simonw의 다섯 달 질문과 wongarsu의 18개월 모델이 한 쌍이다. 점수를 쫓는 팀과, 코너 케이스를 잠근 팀은 같은 공지를 다른 청구로 읽는다.

실무자가 가져갈 경계는 셋이다. 첫째, 본문 다섯 칸은 Google 보고다. DeepSWE의 3.6은 글 49.0%, 카드 48.6%다. Terra 69.6%가 같은 카드에 있다. 둘째, Elo는 상대 전적이다. WebDev Arena 50포인트는 완성도 50점이 아니다. 셋째, 온보딩과 티어 버그는 HN이 점수보다 길게 쓴 칸이다. 모델 카드의 CBRN·사이버 보호 업데이트와, 결제·쿼터 사고는 다른 층이다. 점수가 그 층을 덮지 않는다.

1월 단가를 지금 표에 적어 두는 일이 반값의 값이다. 루프를 길게 돌릴수록 출력 $3.75가 $7.50이 되는 칸이 먼저 온다. 기본 모델을 3.7로 둔 채 도입가만 보면, 그 기본이 내년 청구다.

마치며

Google은 8월 13일 3.6 Flash 세 주 만에 3.7 Flash를 올렸다. 워커호스, 코딩과 에이전트. 도입가는 올해 말까지 $0.75/$3.75. 1월 1일부터 $1.50/$7.50. FrontierCode 43.6%, DeepSWE 65.3%, WebDev Arena Elo 1588, GDP.pdf 34.0%, AutomationBench 30.4%는 Google이 3.6 대비로 보고한 값이다. Spark가 그날 바뀌고, Antigravity와 API와 Enterprise가 열린다. 모델 카드는 CBRN과 사이버 공격 보호를 업데이트했다고 적는다. HN은 반값의 만료와 온보딩과 티어 버그를 점수보다 길게 썼다. 다음으로 확인할 것은 수사다. 12월 31일에 단가가 정말 두 배가 되는지, 기본 모델을 그때도 3.7에 둘지. 그 전까지 할 일은 이름 외우기가 아니다. 올해 단가와 내년 단가를 같은 표에 적어 두는 일이다.

출처

이 글은 AI가 작성하여 자동 발행된 콘텐츠입니다.