DeepSeek V4.1 Flash 정식 출시 — 멀티모달을 품은 플래시 모델이 V4-Pro 자리까지 맡습니다 | DAKER 커뮤니티
DeepSeek의 가장 작은 새 모델이 상위 모델의 자리까지 맡게 됐습니다. DeepSeek는 9월 10일 V4.1-Flash를 API로 정식 출시했습니다. 이미지를 기본으로 이해하는 멀티모달 모델이고, 9월 14일부터는 V4-Pro로 보내던 요청까지 이 모델이 처리합니다. DeepSeek API를 쓰는 팀이라면 코드 속 모델 이름과 비용을 다시 확인해야 하는 소식이라 정리했습니다.
V4.1-Flash는 어떤 모델인가
V4.1-Flash는 DeepSeek의 새 아키텍처 계열에서 가장 작은 모델입니다. 별도 비전 모델 없이 이미지를 직접 이해하는 네이티브 멀티모달 모델이고, 인과적 인코더-디코더 구조를 씁니다. 공식 설명에 따르면 입력 쪽에서 약 80억, 출력 쪽에서 약 160억 개의 파라미터가 활성화됩니다.
DeepSeek는 능력의 한계, 추론 속도, 처리량, 그리고 더 큰 모델로 확장하기 쉬운 구조를 목표로 설계했다고 밝혔습니다. 앞으로는 deepseek-flash라는 이름으로 호출하라고 안내합니다.
모델 이름과 라우팅이 바뀌었습니다
이번 발표에서 가장 조심해야 할 부분은 라우팅입니다.
- 기존 V4-Flash와 V4-Flash-Vision-Exp는 서비스가 종료됐습니다.
deepseek-v4-flash,deepseek-v4-flash-vision-exp로 호출하면 당분간 V4.1-Flash가 대신 응답합니다. - 2026년 9월 14일 13시(한국 시간)부터는
deepseek-v4-pro로 보낸 요청도 V4.1-Flash가 처리하고, 요금도 Flash 기준으로 매깁니다. V4.1-Pro가 나올 때까지 이렇게 운영됩니다.
DeepSeek가 V4-Pro를 내리는 이유는 여러 테스트에서 V4.1-Flash가 성능, 비용, 속도, 전체 실행 시간 모두 V4-Pro보다 나았기 때문이라고 합니다.
코드에 V4-Pro를 그대로 적어 두었다면, 이미 다른 모델이 다른 요금으로 응답하고 있습니다. 호출 이름과 실제로 처리한 모델이 다를 수 있다는 점을 기억해 두세요.
요금은 시간대에 따라 다릅니다
새 요금은 9월 10일 13시(한국 시간)부터 적용됐고, 사용량이 적은 시간대에는 요금이 절반입니다. DeepSeek는 에이전트 작업에서는 캐시 적중 비용이 전체 비용의 큰 부분을 차지할 수 있으니, 캐시를 잘 쓰도록 프롬프트를 짜면 비용을 줄일 수 있다고도 설명했습니다. 구체적인 단가는 요금 페이지에서 직접 확인하시기 바랍니다.
어디서 쓸 수 있나
DeepSeek API 외에 WorkBuddy(CodeBuddy 포함)와 OpenCode가 V4.1-Flash를 지원합니다. Hugging Face 모델 카드와 기술 보고서도 함께 공개됐습니다. 다른 클라우드에서 호스팅한다는 기사도 있지만 대부분 2차 보도라서, 이 글에서는 DeepSeek 공식 발표 내용만 다뤘습니다. 총 파라미터 수처럼 공식 문서에 없는 수치도 같은 이유로 넣지 않았습니다.
우리 팀이 할 일: 3단계 점검 가이드
1단계. 코드 속 모델 이름을 바꿉니다
코드와 대시보드에서 deepseek-v4-pro나 deepseek-v4-flash를 찾아 deepseek-flash로 바꾸세요. 로그에는 호출한 이름이 아니라 실제로 응답한 모델 이름을 남기도록 해 두면 나중에 비용과 품질을 추적하기 쉽습니다.
2단계. 같은 프롬프트로 다시 측정합니다
평소 쓰는 프롬프트 다섯 건을 골라 응답 지연, 토큰, 품질을 다시 재 보세요. 이미지 입력을 쓰는 파이프라인이라면 텍스트와 이미지를 한 엔드포인트로 합칠 수 있는지도 함께 확인하면 좋습니다. 샘플이 적을 때는 평균보다 중앙값과 실패 사례를 적는 편이 정확합니다.
3단계. 배치 작업은 시간대를 옮깁니다
급하지 않은 대량 작업은 요금이 절반인 시간대로 옮기세요. 시간대별 배치 계획을 표로 만들어 두면 비용 관리가 쉬워집니다.
팀 위키에는 이렇게 적어 두면 됩니다.
기본 호출은 deepseek-flash로 한다. v4-pro 하드코딩은 지우고, 9월 14일 이후 트래픽이 Flash 요금으로 처리되는지 로그로 확인한다.
마치며
V4.1-Flash는 작은 모델이 상위 모델을 대신하게 된 흔치 않은 경우입니다. 성능과 비용 면에서는 반가운 소식이지만, 이름만 믿고 코드를 그대로 두면 모르는 사이에 동작과 청구 금액이 함께 바뀝니다. 여러분 팀의 코드에는 아직 V4-Pro가 남아 있지 않나요? 점검 결과나 측정해 본 수치가 있다면 댓글로 나눠 주세요.
참고 자료
- DeepSeek API 문서, V4.1-Flash 출시 공지 (2026년 9월 10일): https://api-docs.deepseek.com/news/news260910
- DeepSeek, V4.1-Flash 소개: https://www.deepseek.com/en/news/deepseek-v4-1-flash/