일꾼이 세졌다. 가격은 반값이다 | DAKER 커뮤니티
구글이 매일 쓰는 작업 모델을 바꿨습니다. 이름은 그대로 Gemini 3.7 Flash입니다. 3.6을 올린 지 3주 만에 3.7을 넣었습니다. 올해 말까지 토큰 가격은 절반입니다.
제목 「일꾼이 세졌다. 가격은 반값이다」는 구글이 이 모델을 “가장 똑똑한 일꾼 모델”이라고 부른 말을 가져온 제목입니다. 여기서 일꾼은 매일 코딩과 에이전트를 돌리는 모델입니다. 세졌다는 말은 3.6보다 같은 일을 더 잘 끝낸다는 뜻입니다. 반값은 원화가 아닙니다. 토큰 단가가 3.6 Flash 원래 가격의 절반이라는 뜻입니다. 이름에 4가 없습니다. 프로도 울트라도 아닙니다. 코딩과 에이전트를 매일 돌리는 쪽을 먼저 교체한 발표입니다. 루머를 기다릴 글이 아닙니다. 이번 주 기본 모델을 정하는 글입니다. 기본 모델을 바꾸지 않으면, 올해 말까지의 반값 가격은 다른 팀이 쓰게 됩니다. 이 결론을 글 끝에도 다시 적습니다. 먼저 적습니다.
원문은 2026년 8월 13일 구글 블로그입니다. Gemini 팀 프로덕트 총괄 Tulsee Doshi 명의로 올라온 Introducing Gemini 3.7 Flash가 공식 원문입니다. 아래 숫자는 그 글에 적힌 공식 토큰가와 벤치마크입니다. 썸네일의 원 가격은 연출입니다. 본문에는 쓰지 않습니다.
무엇이 실제로 나왔습니까
Gemini 3.7 Flash는 구글이 “가장 똑똑한 일꾼 모델”이라고 부른 제품입니다. 대상이 분명합니다. 소프트웨어 엔지니어링, 지식 노동, 웹 개발. 3.6 Flash의 후속입니다. 개발자 피드백과 알고리즘 개선을 3주 만에 반영했다고 합니다. 새 모델 계열이 아닙니다. 매일 쓰는 모델의 교체입니다.
이번 발표에서 가장 중요한 숫자는 가격입니다. 도입 가격은 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러입니다. 이 가격은 2026년 12월 31일에 끝납니다. 2027년 1월 1일부터는 입력 1.50달러, 출력 7.50달러가 적용됩니다. 구글은 이 도입 가격이 3.6 Flash 원래 단가의 절반이라고 적었습니다. 반값의 대상은 원 단위 정가가 아닙니다. 토큰 단가입니다. 에이전트 한 건의 비용은 입력보다 출력에서 더 빨리 커집니다. 입력 0.75만 외우면 견적이 틀립니다. 출력은 3.75입니다. 계획과 도구 호출과 재시도가 쌓이는 쪽이 출력입니다. 그래서 이 기간을 “할인 이벤트”로 읽으면 안 됩니다. 올해 남은 4개월 동안 적용할 수 있는 공식 단가입니다.
어디서 쓰는지도 같이 발표됐습니다. 개발자는 Google Antigravity의 에이전트 워크플로, Google AI Studio와 Android Studio의 Gemini API에서 씁니다. 엔터프라이즈는 Gemini Enterprise Agent Platform과 앱에서 씁니다. 개인은 Google AI Pro·Ultra 구독자의 Spark입니다. Spark는 160개 이상 국가에서 돌아갑니다. 발표일부터 3.7 Flash를 씁니다. I/O에서 나온 24시간 개인 에이전트가 워크스페이스 도구 사용과 지식 노동 정확도를 이 모델로 끌어올린다는 설명입니다. 파일 정리, 메일 초안, 상태 문서 갱신처럼 여러 스킬이 한 흐름으로 붙는 일이 Spark의 예로 올라와 있습니다. 새 화면을 기다릴 필요가 없습니다. 팀이 이미 쓰는 제품에서 오늘 호출하면 됩니다.
구글이 개발자 경험으로 적은 문장도 매일 작업을 돌리는 모델의 이야깁니다. 막히면 더 잘 적응합니다. 의도가 흐리면 확인합니다. 지시를 더 정확히 따릅니다. 여러 단계의 계획과 도구 호출에 힘을 더 넣습니다. 감독과 재시도가 줄어든다는 약속입니다. 새 벤치마크 표보다 이 문장이 운영에 가깝습니다. 재시도가 줄면 출력 토큰도 같이 줄어듭니다. 반값 입력만 보고 예산을 짜면 그 문장을 놓칩니다. 남는 것은 싼 입력이 아닙니다. 같은 일을 다시 보내는 횟수가 줄어드는 것입니다.
안전 쪽도 한 줄이 있습니다. CBRN과 사이버 공격 오용에 대한 프론티어 세이프가드를 갱신했다고 적혀 있습니다. 모델 카드가 따로 있습니다. 유익한 사용은 허용합니다. 그 두 영역의 오용은 제한합니다. 구글의 기존 기준입니다. 빌더가 오늘 할 일은 그 카드를 처음부터 끝까지 읽는 일이 아닙니다. 금지 도메인을 제품 정책에 다시 한 줄 적어 두는 일입니다. 카드를 읽었다고 제출이 되지는 않습니다.
벤치마크 숫자가 가리키는 것
숫자는 모두 3.6 Flash 대비 구글 표입니다. 독립 재현이 아닙니다. 만든 회사의 발표입니다. 그래도 방향은 한쪽으로 모여 있습니다. 코딩, 문서, 업무 자동화. 채팅 승률 표가 아닙니다. 이 표를 우리 티켓의 완료율로 옮기지 않습니다. 방향만 가져옵니다. 이번 주는 구글 표를 다시 그리는 주가 아닙니다. 우리 작업을 같은 평가 환경에 넣는 주입니다.
FrontierCode 1.1 Main은 34.4에서 43.6입니다. DeepSWE v1.1은 49.0에서 65.3입니다. 구글은 디버깅과 이슈 해소, 첫 시도 코드 정확도, 실제 서비스에 가까운 코드 생성이 좋아졌다고 썼습니다. 두 숫자 모두 “한 번에 더 많이 맞춘다”는 쪽입니다. 에이전트가 같은 일을 반복할 때, 첫 시도에서 맞히는 비율이 올라가면 평가가 다시 돌아가는 횟수가 줄어듭니다. 그게 체감 속도입니다. 체감 속도는 엘로 점수가 아닙니다. 같은 티켓을 다시 넣는 횟수입니다.
웹은 Arena.ai WebDev Arena 엘로가 1538에서 1588입니다. 레이아웃이 실제로 동작합니다. 스크린샷·이미지·디자인 시스템을 기준으로 한 UI 충실도가 올라갔다는 설명입니다. 예쁜 페이지가 아닙니다. 기능이 실제로 동작하는 페이지를 더 적은 프롬프트로 만든다는 문장과 짝입니다. 랜딩 페이지를 한 번의 요청으로 만드는 데모가 그 설명 옆에 붙어 있습니다. 데모 화면이 예쁜 상태로 멈추면 그건 제출이 아닙니다. 다른 사람이 링크를 열어 한 번 성공하는 지점까지 갑니다. 배포가 제출입니다.
복잡한 문서 쪽은 GDP.pdf가 22.0에서 34.0입니다. 복잡한 문서를 읽는 평가입니다. 금융·법·바이오처럼 근거가 문서 안에 있는 일을 염두에 둔 숫자로 구글이 소개했습니다. AutomationBench는 17.0에서 30.4입니다. 실제 업무 흐름을 끝까지 끝내는 쪽입니다. 두 평가 모두 절대값은 아직 낮습니다. 구글 표에서도 절반을 넘지 못합니다. 그래서 제목의 「일꾼이 세졌다」는 모든 일을 끝낸다는 선언이 아닙니다. 3.6보다 일이 더 끝나는 쪽으로 옮겼다는 뜻으로 읽습니다.
구글이 보여 준 데모도 그 방향입니다. 텍스트에서 플레이 가능한 3D 게임. 한 번의 요청으로 나오는 랜딩 페이지. 로봇 학습에서 여러 에이전트가 같이 도는 작업. 연간 보고서를 차트 있는 웹으로 바꾸는 작업. Nano Banana로 캐릭터와 텍스처를 실시간 생성합니다. Gemini Omni로 패럴랙스 컴포넌트를 붙입니다. 그 식의 조합이 예로 올라옵니다. 데모는 데모입니다. 다만 제품의 자리는 분명합니다. 대화 상대가 아닙니다. 작업을 끝내는 모델입니다. 이번 주는 데모를 그대로 베끼는 주가 아닙니다. 데모가 가리킨 코딩과 문서와 업무 자동화에 기본 모델을 올리는 주입니다.
무엇이 아닙니까
이건 Gemini 4 예고가 아닙니다. 다음 최상위 모델을 기다리는 동안, 매일 쓰는 작업 모델을 교체한 발표입니다. 프로·울트라의 최상위 모델 교체 이야기도 아닙니다. 그 구독에서 바뀐 것은 Spark의 엔진입니다. 4를 일정에 넣어 3.7을 건너뛰는 팀이 있습니다. 그 팀은 구글이 3주를 쓴 이유를 반대로 읽은 것입니다. 3주는 연구 주기가 아닙니다. 교체 주기입니다. 기본 모델을 미루면 그 3주가 팀의 대기 시간이 됩니다. 다음 최상위 모델이 와도 매일 쓰는 작업 모델의 자리는 따로 남습니다. 지금 바꿀 것은 그 자리입니다. 최상위 모델과 매일 쓰는 작업 모델을 같은 것으로 보면, 4가 올 때까지 매일 작업이 멈춥니다.
가격을 원 정가로 환산한 이야기도 아닙니다. 공식 단위는 100만 토큰입니다. 도입 가격 0.75 / 3.75. 내년 1월부터 1.50 / 7.50. 이 네 숫자만 기억하면 됩니다. 연출용 원 가격을 본문에 옮기면 견적이 틀립니다. 반값의 기준점도 3.6 Flash의 원래 토큰가입니다. 다른 회사의 프로 모델과 직접 나눈 값이 아닙니다. 슬라이드에 원화를 먼저 올리면, 토큰 단가가 아니라 환율 이야기가 됩니다. 그 순간 도입 가격을 계약에 고정하는 일이 흐려집니다.
만능 코딩 신모델도 아닙니다. 구글 표에서 3.6 대비 올랐다는 뜻입니다. 당신 저장소, 당신 티켓, 당신 평가 과정에서 같은 폭이 나온다는 보장은 없습니다. 특히 에이전트는 모델보다 평가 환경과 재시도 규칙이 먼저입니다. AutomationBench 30.4는 아직 “대부분 실패한다”에 더 가깝습니다. 3.6보다 일을 더 잘 끝내는 모델입니다. 모든 일이 끝나는 모델은 아닙니다. 표의 상승을 우리 완료율로 가정하고 기본 모델을 올리면, 그 가정은 월요일에 티켓이 설명합니다.
개인 구독의 Spark 체감을 API로 부르는 작업 모델의 체감으로 옮기는 글도 아닙니다. Spark는 이미 엔진이 바뀌었습니다. 워크스페이스에서 파일이 모이고 메일이 초안되고 상태 문서가 갱신되는 흐름이 그 자리입니다. API 경로는 단가와 재시도와 작업당 달러가 남습니다. 가격을 정하는 경로가 다릅니다. 제품 결정은 API 경로에서 합니다. Spark에서 메일이 잘 나온다고 실제 서비스 에이전트의 견적을 고정한 것이 아닙니다.
도입 가격을 어떻게 고정합니까
도입 가격과 1월부터의 가격은 두 배입니다. 입력은 0.75에서 1.50. 출력은 3.75에서 7.50. 에이전트 한 건이 출력 2만 토큰을 쓴다면, 올해 출력 비용은 7.5센트입니다. 1월부터는 15센트입니다. 작은 숫자로 보입니다. 하루 수천 건이면 도입 가격과 1월부터의 가격 차이가 먼저 보입니다. 입력 반값만 슬라이드에 올리지 않습니다. 출력이 두 배인 쪽을 같이 적습니다. 반값 입력만 보고 예산을 짜면, 에이전트는 출력에서 다시 돈이 나갑니다. 재시도가 줄면 출력 토큰도 같이 줄어듭니다. 그 문장이 운영입니다. 단가만 고정하고 재시도를 그대로 두면, 도입 가격으로 아낀 돈이 다시 사라집니다.
팀이 오늘 만들 표는 세 열이면 충분합니다. 작업 이름. 3.6의 완료·재시도·달러. 3.7의 완료·재시도·달러. 엘로 점수를 옮기지 않습니다. 구글 표의 FrontierCode와 DeepSWE와 WebDev Arena는 코딩과 웹 점수가 올랐다는 방향만 줍니다. 당신 티켓의 실패는 그 표에 없습니다. 디버깅이 좋아졌다는 문장을 믿으려면, 이번 주 막힌 이슈 10개를 같은 평가 환경에 넣으면 됩니다. 같은 작업 세트 30건을 3.6과 3.7로 나란히 돌립니다. 측정은 엘로 점수가 아닙니다. 세 항목이면 됩니다. 완료율, 재시도 횟수, 작업당 달러. 출력 토큰과 사고 토큰을 따로 적습니다. 사고 토큰을 출력에 섞어 적으면, 재시도가 준 건지 생각이 길어진 건지가 갈리지 않습니다. 둘을 나눠 적어야 견적이 맞습니다.
견적서에 “반값”이라고 쓰지 않습니다. 작업당 달러로 남깁니다. 도입 가격 마감일을 캘린더에 박습니다. 2026년 12월 31일. 그 전에 실제 서비스 경로를 3.7로 고정한 팀만 올해 남은 4개월 동안 이 가격을 적용받습니다. 1월 1일의 1.50 / 7.50을 “나중의 일”로 두면, 연말에 견적이 두 배가 됩니다. 계약과 한도를 지금 숫자로 써 두는 것이 고정하는 일입니다. 한도를 나중에 맞추겠다는 메모는 고정이 아닙니다. 지금 숫자로 남은 한도만 고정입니다.
기본 모델을 바꿨다는 메모는 제출이 아닙니다. 실제 서비스 경로가 3.7로 고정되고, 그 경로에서 나온 링크가 열려야 합니다. 화면이 예쁜 상태로 멈추지 않습니다. 다른 사람이 그 링크를 열어 한 번 성공하는 지점까지 갑니다. DAKER에서 배포가 제출입니다. 모델 이름만 바꾼 슬라이드는 배포가 아닙니다. 경로를 고정했다는 슬랙 메시지와, 그 경로가 실제로 호출되는 로그는 다른 제출입니다. 로그가 있는 쪽만 올해 남은 4개월의 도입 가격을 적용받습니다.
Antigravity에서 에이전트를 이미 돌리는 팀은 모델만 3.7로 바꾸고 같은 티켓을 다시 넣으면 됩니다. 새 프로젝트를 열 필요가 없습니다. 이미 쓰는 제품에서 호출하면 됩니다. Antigravity, AI Studio, Android Studio, Gemini Enterprise 중 팀이 쓰는 곳에서 오늘 호출하면 됩니다. 새 화면을 기다리지 않습니다. Spark를 쓰는 개인 구독자도 엔진이 바뀌었는지 한 번만 확인하면 됩니다. 워크스페이스 도구가 붙는 흐름이면, 체감은 그 흐름에서 확인합니다.
이번 주에 할 일
Flash를 예비용으로 두지 않습니다. 매일 도는 코딩·에이전트 작업의 기본 모델로 올립니다. 연구용 최상위 모델과 생산용 작업 모델을 한 자리에 넣지 않습니다. 3.7은 생산용 자리입니다. 기본 모델을 바꾸지 않으면, 올해 말까지의 반값 가격은 다른 팀이 쓰게 됩니다. 다음 최상위 모델이 와도 매일 쓰는 작업 모델의 자리는 따로 남습니다. 지금 바꿀 것은 그 자리입니다. 예비로 남겨 둔 Flash는 견적서에 안 남습니다. 매일 작업에 올린 Flash만 올해 남은 4개월의 도입 가격을 적용받습니다.
팀 기본 모델을 바꾸는 회의는 금요일에 해도 됩니다. 수요일까지는 개인 실험입니다. 같은 평가 환경, 같은 티켓, 모델만 바꾼 로그가 있어야 회의가 견적을 논합니다. 로그가 없으면 그 회의는 루머를 다시 읽는 자리입니다. Gemini 4 루머를 스프린트에 넣지 않습니다. 4를 기다리며 3.7을 쓰지 않으면, 12월 31일이 먼저 옵니다. 도입 가격이 끝난 뒤에 기본 모델을 올리면, 그때의 단가는 1.50 / 7.50입니다. 그 숫자를 “나중의 일”로 두지 않습니다.
- 매일 도는 코딩·에이전트 작업의 기본 모델을 3.7 Flash로 올립니다. 예비용으로 남겨 두지 않습니다. 연구용 최상위 모델과 생산용 작업 모델을 한 자리에 넣지 않습니다.
- 같은 작업 세트 30건을 3.6과 3.7로 나란히 돌립니다. 완료율, 재시도 횟수, 작업당 달러를 적습니다. 출력 토큰과 사고 토큰을 따로 적습니다. 엘로 점수를 옮기지 않습니다.
- 이번 주 막힌 이슈 10개를 같은 평가 환경에 넣습니다. 디버깅과 이슈 해소가 좋아졌다는 구글 문장을, 우리 티켓으로 확인합니다.
- 도입 가격 네 숫자를 견적 첫 줄에 씁니다. 입력 0.75 / 출력 3.75. 2027년 1월 1일부터 1.50 / 7.50. 반값의 기준은 3.6 Flash의 원래 토큰가입니다. 원 정가로 환산하지 않습니다.
- 마감일을 캘린더에 박습니다. 2026년 12월 31일. 그 전에 실제 서비스 경로를 3.7로 고정합니다. 계약과 한도를 지금 숫자로 남깁니다.
- 에이전트 한 건의 출력 2만 토큰이면 올해 출력은 7.5센트, 1월부터는 15센트입니다. 하루 수천 건이면 도입 가격과 1월부터의 가격 차이가 먼저 보입니다. 입력 반값만 슬라이드에 올리지 않습니다.
- 이미 쓰는 제품에서 오늘 호출합니다. Antigravity, AI Studio, Android Studio, Gemini Enterprise 중 팀이 쓰는 곳입니다. 새 화면을 기다리지 않습니다.
- Spark를 쓰는 개인 구독자는 엔진이 바뀌었는지 한 번 확인합니다. 파일 정리, 메일 초안, 상태 문서 갱신 흐름을 한 바퀴 돌립니다. 그 체감을 API 견적과 섞지 않습니다.
- 금지 도메인을 제품 정책에 한 줄 다시 적습니다. CBRN과 사이버 공격 오용. 모델 카드를 읽은 척하지 않습니다. 정책 한 줄이 오늘의 일입니다.
- Gemini 4 루머를 스프린트에 넣지 않습니다. 3주는 교체 주기입니다. 기본 모델을 미루면 그 3주가 팀의 대기 시간이 됩니다.
기록이 없으면 3.7이 앞서든 3.6이 앞서든 팀에는 남는 게 없습니다. 세션 끝에는 작업 이름, 완료 여부, 재시도, 작업당 달러를 남깁니다. 그 네 줄이 있어야 금요일 회의가 견적을 논합니다. 네 줄이 없으면 그 회의는 구글 표를 다시 읽는 자리입니다.
한 줄로 줄이면 이렇습니다. 매일 쓰는 작업 모델이 3.6보다 일을 더 잘 끝내고, 올해 말까지 토큰은 반값입니다. 기본 모델을 바꿉니다. 도입 가격이 끝나기 전에 실제 서비스 경로를 3.7로 고정합니다. 다음 최상위 모델을 기다리지 않습니다. 경로가 고정되고 링크가 열려야 그 주가 끝납니다.
원문: Google — Introducing Gemini 3.7 Flash, Tulsee Doshi, 2026년 8월 13일 · Gemini 3.7 Flash 모델 카드 — Google DeepMind