Gemini 3.7 Flash 공개: 더 강해진 작업 모델, 2026년 말까지 토큰 가격은 절반 | DAKER 커뮤니티
매일 돌리는 코딩·에이전트 모델은 성능보다도 교체 타이밍이 더 중요할 때가 많습니다. 이번 구글 발표가 눈에 띄는 이유도 여기에 있습니다. 새 최상위 모델의 예고가 아니라, 실제로 현업에서 가장 자주 쓰는 작업 모델을 3주 만에 3.7로 교체했기 때문입니다.
게다가 올해 말까지 적용되는 공식 토큰 가격도 함께 나왔습니다. 성능 개선과 가격 인하가 동시에 걸린 발표라면, 루머를 기다리기보다 지금 기준 모델을 다시 볼 이유가 충분합니다.
원문은 2026년 8월 13일 구글 블로그에 올라온 Tulsee Doshi 명의의 Introducing Gemini 3.7 Flash입니다. 아래 내용의 숫자와 고유명사는 모두 이 공식 발표와 모델 카드를 기준으로 정리했습니다.
Gemini 3.7 Flash에서 가장 먼저 봐야 할 것
Gemini 3.7 Flash는 구글이 가장 똑똑한 일꾼 모델이라고 부른 제품입니다. 대상도 분명합니다. 소프트웨어 엔지니어링, 지식 노동, 웹 개발처럼 매일 반복적으로 돌아가는 작업입니다. 새 계열의 등장이 아니라 3.6 Flash의 후속 교체에 가깝고, 구글은 개발자 피드백과 알고리즘 개선을 3주 만에 반영했다고 설명했습니다.
이번 발표는 새 간판 모델의 예고가 아니라, 매일 쓰는 작업 모델의 교체입니다.
가격은 더 직접적입니다. 도입 가격은 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러입니다. 이 가격은 2026년 12월 31일까지 적용되고, 2027년 1월 1일부터는 입력 1.50달러, 출력 7.50달러로 올라갑니다. 구글은 이 도입 가격이 3.6 Flash 원래 단가의 절반이라고 밝혔습니다.
여기서 중요한 점은 반값의 기준이 원화가 아니라 토큰 단가라는 사실입니다. 특히 에이전트 작업은 입력보다 출력 비용이 더 빠르게 커질 수 있습니다. 계획, 도구 호출, 재시도가 쌓이는 쪽이 대개 출력이기 때문입니다. 그래서 입력 단가만 보고 예산을 잡기보다 출력 단가 3.75도 함께 봐야 합니다.
어디에서 바로 쓸 수 있나
구글은 사용 경로도 함께 공개했습니다. 개발자는 Google Antigravity의 에이전트 워크플로, Google AI Studio와 Android Studio의 Gemini API에서 사용할 수 있습니다. 엔터프라이즈는 Gemini Enterprise Agent Platform과 앱에서, 개인은 Google AI Pro·Ultra 구독자의 Spark에서 사용합니다. Spark는 160개 이상 국가에서 발표일부터 3.7 Flash를 사용한다고 설명됐습니다.
구글이 예로 든 흐름도 작업 중심입니다. 파일 정리, 메일 초안 작성, 상태 문서 갱신처럼 여러 스킬이 한 흐름으로 이어지는 작업이 Spark 사례로 제시됐습니다. 즉, 새 화면을 기다리는 발표라기보다 이미 쓰는 제품 안에서 바로 호출할 수 있는 교체에 가깝습니다.
개발자 경험에 대한 설명도 같은 방향입니다. 막히는 상황에 더 잘 적응하고, 의도가 흐릴 때는 확인하며, 지시를 더 정확히 따르고, 여러 단계의 계획과 도구 호출에 강해졌다는 설명이 붙었습니다. 이 문장은 벤치마크보다 운영에 더 가깝습니다. 재시도가 줄면 출력 토큰도 함께 줄 수 있기 때문입니다.
남는 것은 싼 입력이 아니라, 같은 일을 다시 보내는 횟수가 줄어드는 효과입니다.
벤치마크 숫자가 보여 주는 방향
구글이 제시한 수치는 모두 3.6 Flash 대비입니다. 독립 재현 결과는 아니지만, 어떤 영역을 강화했는지는 분명하게 드러납니다. 코딩, 문서 이해, 업무 자동화입니다.
FrontierCode 1.1 Main은 34.4에서 43.6, DeepSWE v1.1은 49.0에서 65.3으로 올랐습니다. 구글은 디버깅과 이슈 해소, 첫 시도 코드 정확도, 실제 서비스에 가까운 코드 생성이 좋아졌다고 설명했습니다. 이 수치는 결국 한 번에 더 많이 맞힌다는 뜻에 가깝습니다. 에이전트가 같은 일을 반복할 때 첫 시도 성공률이 올라가면, 다시 평가를 돌리는 횟수가 줄고 체감 속도도 달라집니다.
웹 개발 쪽에서는 Arena.ai WebDev Arena 엘로가 1538에서 1588로 올랐습니다. 구글은 스크린샷·이미지·디자인 시스템을 기준으로 한 UI 충실도와 실제 동작성을 함께 강조했습니다. 예쁜 결과물보다 기능이 실제로 동작하는 페이지를 더 적은 프롬프트로 만든다는 설명에 가깝습니다.
문서 이해와 업무 자동화도 눈에 띕니다. GDP.pdf는 22.0에서 34.0, AutomationBench는 17.0에서 30.4로 올랐습니다. 다만 절대값만 보면 아직 높다고 하기는 어렵습니다. 그래서 이번 발표를 모든 일을 끝내는 만능 모델의 등장으로 읽기보다는, 3.6보다 더 많은 일을 끝내는 쪽으로 이동했다고 보는 편이 맞습니다.
이번 수치는 완성 선언이 아니라, 3.6보다 더 잘 끝낸다는 방향의 신호입니다.
구글이 함께 보여 준 데모도 같은 맥락입니다. 텍스트에서 플레이 가능한 3D 게임을 만들거나, 한 번의 요청으로 랜딩 페이지를 만들고, 연간 보고서를 차트가 있는 웹으로 바꾸는 식의 예시가 나왔습니다. 데모는 데모이지만, 이 모델의 자리가 대화 상대보다 작업 완료 쪽에 있다는 점은 분명합니다.
이번 발표를 무엇으로 보면 안 되나
이 발표는 Gemini 4 예고가 아닙니다. 다음 최상위 모델을 기다리는 동안 잠시 지나가는 소식도 아닙니다. 구글이 실제로 교체한 것은 매일 쓰는 작업 모델입니다. 프로·울트라의 최상위 모델 이야기와도 결이 다릅니다. 개인 구독에서 바뀐 것은 Spark의 엔진이고, API 경로에서는 여전히 단가와 재시도, 작업당 비용이 핵심입니다.
또한 반값이라는 표현을 원화 정가처럼 받아들이면 안 됩니다. 공식 단위는 100만 토큰이며, 도입 가격은 0.75 / 3.75, 2027년 1월 1일부터는 1.50 / 7.50입니다. 기준점도 3.6 Flash의 원래 토큰가입니다. 다른 회사 모델과 단순 비교한 값이 아닙니다.
성능 수치 역시 그대로 우리 완료율로 옮길 수는 없습니다. 특히 에이전트는 모델 자체보다 평가 환경과 재시도 규칙의 영향을 크게 받습니다. AutomationBench 30.4만 봐도 아직 대부분의 작업이 자동으로 끝난다고 말하기는 어렵습니다. 따라서 이 발표는 만능 신모델의 등장보다, 기본 모델을 바꿨을 때 우리 작업에서 어떤 차이가 나는지 확인할 근거로 보는 것이 좋습니다.
도입 가격을 볼 때 놓치기 쉬운 점
도입 가격과 2027년 1월 이후 가격은 정확히 두 배 차이입니다. 입력은 0.75에서 1.50, 출력은 3.75에서 7.50으로 올라갑니다. 예를 들어 에이전트 한 건이 출력 2만 토큰을 쓴다면 올해 출력 비용은 7.5센트이고, 1월부터는 15센트입니다. 건당으로는 작아 보여도 하루 수천 건이면 차이는 빠르게 커집니다.
그래서 반값이라는 표현만 남기기보다 작업당 달러로 보는 편이 낫습니다. 입력 단가 인하보다 출력 비용과 재시도 감소가 실제 운영비에 더 큰 영향을 줄 수 있기 때문입니다.
도입 가격의 핵심은 할인 문구가 아니라, 2026년 12월 31일까지 적용되는 공식 단가입니다.
실제로 비교할 때 필요한 기준
구글 벤치마크를 그대로 다시 그리는 것보다, 같은 작업 세트를 3.6과 3.7로 나란히 돌려 보는 편이 더 유효합니다. 이때 핵심은 복잡한 점수보다 완료율, 재시도 횟수, 작업당 달러입니다. 코딩과 웹, 문서, 자동화에서 좋아졌다는 방향은 이미 발표에 나와 있으니, 실제로는 우리 티켓과 우리 평가 환경에서 같은 변화가 나는지를 보는 것이 중요합니다.
특히 출력 토큰과 사고 토큰을 구분해 기록하면 비용 해석이 쉬워집니다. 재시도가 줄어서 비용이 내려간 것인지, 생각이 길어져서 출력이 늘어난 것인지가 갈리기 때문입니다. 기록이 없으면 3.7이 앞서는지 3.6이 앞서는지도 팀에 남지 않습니다.
안전과 정책에서 확인할 부분
안전 관련으로는 CBRN과 사이버 공격 오용에 대한 프론티어 세이프가드를 갱신했다고 발표했습니다. 자세한 내용은 Gemini 3.7 Flash 모델 카드에서 확인할 수 있습니다. 유익한 사용은 허용하지만, 해당 영역의 오용은 제한한다는 기존 기준을 유지한 셈입니다.
실무에서는 모델 카드를 읽었다는 사실보다, 금지 도메인을 제품 정책에 다시 분명히 적어 두는 쪽이 더 직접적일 수 있습니다.
정리하면 무엇이 달라졌나
한 줄로 줄이면 이렇습니다. Gemini 3.7 Flash는 3.6 Flash보다 코딩·문서·업무 자동화에서 더 잘 끝내는 방향으로 개선됐고, 2026년 12월 31일까지는 토큰 가격이 절반 수준의 도입 가격으로 적용됩니다.
지금 바뀐 것은 미래의 최상위 모델이 아니라, 오늘 바로 쓰는 기본 작업 모델입니다.
참고 자료: Google — Introducing Gemini 3.7 Flash, Tulsee Doshi, 2026년 8월 13일
Gemini 3.7 Flash 모델 카드 — Google DeepMind
여러분 팀에서는 기본 작업 모델을 바꿀 때 어떤 지표를 가장 먼저 비교하시는지 궁금합니다.