라이프스타일

DeepSeek-V4.1-Flash 출시, V4-Pro 존속 여부는 설명이 엇갈려: 모델이 교체될 때 주의할 점

DeepSeek는 2026년 9월 10일 V4.1-Flash를 출시했으며, 기존 V4-Flash 모델명은 일시적으로 새 모델로 연결됩니다. 출시 공지에는 V4-Pro를 9월 14일부터 새 모델로 전환한다고 적혀 있지만, 업데이트 로그와 가격 페이지에는 9월 14일 이후에도 계속 제공한다고 적혀 있습니다. 본 기사는 공식 페이지를 바탕으로 두 설명의 선후 관계와 확인 시점의 현황을 정리하고, 서드파티 도구를 통해 간접적으로 사용하는 사람이 모델 교체를 알아차리고 가격과 개인정보 조항을 이해하는 방법을 설명합니다.

수정일: 읽는 데 약 10분

모델명은 그대로인데 그 뒤의 모델은 이미 교체된 상황을 표현한 오리지널 일러스트
사진: Mokaair (© Mokaair)

2026년 9월 10일 DeepSeek는 공식 API 문서에 DeepSeek-V4.1-Flash를 공개했습니다. 새 아키텍처 계열 중 가장 작은 모델로 네이티브 이미지 이해 기능을 갖췄으며, 호출할 때의 모델명은 deepseek-flash라고 설명했습니다. 이전 세대인 V4-Flash와 V4-Flash-Vision-Exp는 동시에 퇴역했고, 기존 이름은 일시적으로 새 모델로 연결됩니다. 공지에는 V4-Pro 요청도 9월 14일부터 V4.1-Flash로 전환한다고 적혀 있었지만, 확인 시점의 공식 업데이트 로그와 가격 페이지에는 9월 14일 이후에도 V4-Pro를 계속 제공한다고 적혀 있었습니다.

본 기사는 2026년 9월 15일에 확인했습니다. 이번 공지가 설명하는 것은 API 변경 사항이며, DeepSeek 앱과 웹 버전이 현재 어떤 모델을 쓰는지는 이 공식 페이지들에 나와 있지 않으므로 본 기사는 추정하지 않습니다. 본 사이트는 이 모델을 실제로 호출하거나 평가하지 않았으며, 글에 나오는 성능과 평가 관련 내용은 모두 DeepSeek 자체의 설명입니다. 일상과 업무 상황은 에디터가 설계한 예시입니다.

V4.1-Flash 공지에 적힌 내용

DeepSeek에 따르면 V4.1-Flash는 파라미터 규모 552B의 전문가 혼합(MoE) 모델로, 새로운 Causal Encoder-Decoder 아키텍처를 채택했습니다. 입력을 읽을 때는 8B, 출력을 생성할 때는 16B 파라미터를 활성화하며, DeepSeek는 이를 입력과 출력의 비대칭이라고 부릅니다. 공지는 또 새로운 사전 학습 방식과 더 큰 규모의 강화학습 사후 학습 덕분에 DeepSeek-V4-Pro를 포함한 플래그십 모델을 벤치마크에서 앞섰다고 밝혔습니다. 이는 업체의 주장이며, 모델 카드의 비교표에는 다른 업체 모델보다 뒤처지는 항목도 있습니다. 본 사이트는 다시 테스트하지 않았습니다.

또 하나의 핵심은 캐시입니다. 모델은 긴 대화를 처리할 때 중간 계산 데이터를 임시로 저장하는데, 이를 KV 캐시라고 합니다. 공지에 따르면 이전 세대와 비교해 V4.1-Flash의 KV 캐시는 HBM 요구량이 4분의 1, SSD 요구량이 8분의 1로 줄었으며, 아키텍처가 더 효율적이어서 API 가격을 인하했다고 설명합니다.

가중치와 관련해 공지에는 공식 Hugging Face 페이지 링크가 첨부되어 있습니다. 모델 카드에는 저장소와 모델 가중치가 MIT 라이선스로 제공되고, 최대 100만 토큰의 컨텍스트를 지원하며, 이미지와 텍스트를 직접 처리해 텍스트를 출력할 수 있다고 명시되어 있습니다. 다만 내려받을 수 있다고 해서 일반 컴퓨터에서 돌릴 수 있다는 뜻은 아닙니다. 모델 카드에 연결된 추론 예제는 8-way 모델 병렬 설정으로 실행됩니다. 출시 공지는 별도로 GPU 2,000장과 스토리지 클러스터로 대규모 배포를 계획하는 기관에 DeepSeek로 연락해 달라고 안내했습니다.

기존 모델명 전환과 V4-Pro의 거취: 두 가지 설명의 선후 관계

첫 번째 설명은 9월 10일 출시 공지에서 나왔습니다. 공지는 여러 테스트에서 V4.1-Flash가 성능, 비용, 속도, 총 소요 시간 모두에서 V4-Pro를 앞섰기 때문에 V4-Pro를 퇴장시킬 계획이라고 밝혔습니다. 2026년 9월 14일 UTC 04:00(대만 시간 정오)부터 모든 deepseek-v4-pro 요청을 V4.1-Flash가 처리하고 V4.1-Flash 가격으로 과금하며, 이는 V4.1-Pro가 출시될 때까지 이어진다는 내용이었습니다.

두 번째 설명은 업데이트 로그와 가격 페이지에 있습니다. 확인 당일 업데이트 로그의 9월 10일 항목과 가격 페이지의 주석에는, 사용자 요구에 따라 DeepSeek가 2026년 9월 14일 이후에도 V4-Pro API 서비스를 계속 제공하기로 결정했으며 과금 방식은 변하지 않고 변경이 있으면 별도로 알리겠다고 적혀 있었습니다. 가격 페이지에서 deepseek-v4-pro에 대응하는 버전은 DeepSeek-V4-Pro-0813입니다. '계속 제공하기로 결정했다'는 표현으로 보면 전환 계획 이후에 내린 결정이지만, 페이지에 날짜가 표시되어 있지 않고 API 문서의 뉴스 목록에도 별도 공지가 없습니다.

9월 15일 확인 시점에도 영어판과 중국어 간체판 출시 공지 페이지에는 '9월 14일부터 전환한다'는 원래 문구가 남아 있었습니다. 공지만 읽은 사람은 V4-Pro가 이미 대체되었다고 생각할 수 있습니다. 업데이트 로그와 가격 페이지의 설명에 따르면 deepseek-v4-pro는 9월 14일 이후에도 계속 제공되며, V4-Flash의 기존 이름 두 개는 V4.1-Flash가 처리하고 Flash 가격으로 과금됩니다.

2026년 9월 15일 확인 기준. DeepSeek 업데이트 로그와 모델 및 가격 페이지를 바탕으로 정리했으며 공식 API에 한합니다.
모델명실제 처리 모델과금
deepseek-flashDeepSeek-V4.1-FlashFlash 가격
deepseek-v4-flashV4.1-Flash(원래 모델 퇴역)Flash 가격
deepseek-v4-flash-vision-expV4.1-Flash(원래 모델 퇴역)Flash 가격
deepseek-v4-proDeepSeek-V4-Pro-0813과금 방식 변동 없음

API를 직접 호출하지 않는 사람도 영향을 받는 이유

대만 독자 대부분은 DeepSeek API를 직접 호출하지 않지만 간접적으로 사용하고 있을 수 있습니다. 일부 번역 확장 프로그램, 글쓰기 앱, 사내 질의응답 도구는 설정에 특정 DeepSeek 모델명을 입력한 뒤 사용자의 입력을 그쪽으로 전달합니다. DeepSeek 공지도 WorkBuddy(CodeBuddy 포함)와 OpenCode가 V4.1-Flash를 전면 지원한다고 언급했습니다. 서비스 제공자가 기존 이름을 새 모델로 연결하면 도구 설정은 바꿀 필요가 없지만, 뒤에서 답변하는 모델은 이미 바뀐 상태입니다.

이번 사례가 이를 잘 보여 줍니다. deepseek-v4-flash라는 이름에는 V4가 들어 있지만 실제로 처리하는 모델은 V4.1-Flash입니다. 업데이트 로그에는 4월 24일 V4를 출시할 때 deepseek-chat과 deepseek-reasoner 두 기존 이름이 전환 기간 동안 각각 deepseek-v4-flash의 비사고 모드와 사고 모드를 가리키며, 2026년 7월 24일에 사용이 중단된다고 예고한 내용도 기록되어 있습니다.

에디터가 설계한 상황을 예로 들어 보겠습니다. 한 직장인이 매일 사내 요약 도구로 회의록을 정리하다가 9월 10일 이후 요약이 길어지고 단락을 나누는 방식도 달라졌다는 것을 알아차렸습니다. 먼저 도구의 업데이트 안내를 확인하거나 관리자에게 문의해 백엔드가 DeepSeek에 연결되어 있는지, 어떤 모델명이 입력되어 있는지 확인할 수 있습니다. 답변 스타일, 길이, 출력 형식, 이미지 인식 능력이 갑자기 달라졌다면 한번 물어볼 만한 신호입니다. 반드시 품질이 나빠졌다는 뜻은 아니지만, 출력을 공식 문서에 붙여 넣어야 한다면 다시 표본을 뽑아 점검하는 것이 좋습니다.

모델이 교체될 때의 네 가지 점검: 도구 업데이트 안내 확인, 답변 비교, 모델명과 버전 확인, 개인정보 처리방침 읽기
모델이 교체될 때의 네 가지 점검: 도구 업데이트 안내 확인, 답변 길이와 형식 비교, 모델명과 실제 버전 확인, 공식 개인정보 처리방침 읽기. · 사진: Mokaair (© Mokaair)

가격, 피크 시간대, 고정 버전의 의미

API 가격은 간단히만 짚겠습니다. 가격 페이지에 따르면 deepseek-flash의 피크 시간대 가격은 100만 토큰당 입력(캐시 미적중) 0.3달러, 출력 1.2달러이며, deepseek-v4-pro는 각각 1.32달러와 3.96달러입니다. 비피크 가격은 피크 가격의 절반이고, 피크 시간대는 월요일부터 금요일까지 UTC 01:00~04:00과 06:00~10:00으로, 대만 시간으로는 오전 9시~12시와 오후 2시~6시입니다. 공지에 따르면 새 가격은 9월 10일 UTC 04:00부터 적용되었습니다.

기존 이름이 새 모델로 연결되면 청구 금액도 함께 달라집니다. 가격 페이지는 V4-Flash 기존 이름으로 들어오는 요청을 Flash 가격으로 과금한다고 설명합니다. 만약 V4-Pro가 원래 계획대로 전환되었다면, 가격 페이지 수치로 볼 때 V4-Pro를 쓰던 사람의 비용은 줄었겠지만 답변은 다른 모델이 하게 되었을 것입니다. 기능도 다릅니다. 가격 페이지에는 deepseek-flash는 이미지 이해를 지원하고 deepseek-v4-pro는 지원하지 않는다고 표시되어 있습니다. 서드파티 도구에 월 요금을 내는 사람이라면 요금제 가격이 따라서 바뀌는지는 각 도구의 안내를 확인해야 합니다.

고정 버전이란 도구가 조용히 바뀌지 않는 모델 버전을 지정해 동작을 더 예측 가능하게 만드는 것을 말합니다. DeepSeek 가격 페이지는 모델명과 실제 버전을 따로 표기하지만, 날짜가 붙은 버전명으로 호출할 수 있는지는 설명하지 않습니다. 8월 13일 업데이트 로그에도 deepseek-v4-pro라는 이름을 계속 쓰면 최신 버전을 사용하게 된다고 적혀 있습니다. 도구를 직접 관리하는 사람은 모델명, 버전, 확인 날짜를 기록해 두고 업데이트 로그를 정기적으로 확인하는 것이 좋습니다.

중국 업체 서비스를 쓰기 전에 직접 읽어야 할 약관

DeepSeek 공식 API나 앱을 통해 사용하면 입력한 내용이 DeepSeek 서비스로 전송되어 처리됩니다. 데이터가 어떻게 보관되는지, 어디에 저장되는지, 서비스 개선에 쓰이는지는 DeepSeek 공식 개인정보 처리방침과 서비스 약관을 읽어 보시기 바랍니다. 본 기사는 이를 대신 해석하지 않습니다. 회사가 내부 데이터를 외부 AI 서비스로 보내려 한다면, 업체가 어느 나라 회사이든 먼저 내부 데이터 규정이 이를 허용하는지 확인해야 합니다.

간접적으로 사용할 때는 한 단계 더 확인해야 합니다. 서드파티 도구는 DeepSeek 공식 API에 직접 연결할 수도 있고, 다른 클라우드 플랫폼이 호스팅하는 모델을 사용할 수도 있으며, 두 경우에 적용되는 약관이 다릅니다. 도구의 도움말 페이지나 개인정보 처리방침에서 '모델 제공업체', '데이터 전송' 같은 항목을 찾아보십시오. 답을 찾기 전까지는 신분증 번호, 고객 명단, 공개되지 않은 계약서를 붙여 넣지 않는 것이 좋습니다.

오픈 가중치는 또 다른 선택지입니다. 모델 카드는 MIT 라이선스를 채택하고 있어 기관이 자체 환경에 배포할 수 있으며, 데이터를 DeepSeek API로 보낼 필요가 없습니다. 다만 자체 배포에는 하드웨어, 운영, 데이터 관리 부담이 따르며, 이러한 절충점은 본 사이트의 Qwen3.5 오픈 가중치 기사에서 이미 설명했습니다.

최신 여행 소식·가이드

출처

라이프스타일