라이프스타일
DeepSeek-V4.1-Flash 출시, V4-Pro 존속 여부는 설명이 엇갈려: 모델이 교체될 때 주의할 점
DeepSeek는 2026년 9월 10일 V4.1-Flash를 출시했으며, 기존 V4-Flash 모델명은 일시적으로 새 모델로 연결됩니다. 출시 공지에는 V4-Pro를 9월 14일부터 새 모델로 전환한다고 적혀 있지만, 업데이트 로그와 가격 페이지에는 9월 14일 이후에도 계속 제공한다고 적혀 있습니다. 본 기사는 공식 페이지를 바탕으로 두 설명의 선후 관계와 확인 시점의 현황을 정리하고, 서드파티 도구를 통해 간접적으로 사용하는 사람이 모델 교체를 알아차리고 가격과 개인정보 조항을 이해하는 방법을 설명합니다.
수정일: 읽는 데 약 10분

2026년 9월 10일 DeepSeek는 공식 API 문서에 DeepSeek-V4.1-Flash를 공개했습니다. 새 아키텍처 계열 중 가장 작은 모델로 네이티브 이미지 이해 기능을 갖췄으며, 호출할 때의 모델명은 deepseek-flash라고 설명했습니다. 이전 세대인 V4-Flash와 V4-Flash-Vision-Exp는 동시에 퇴역했고, 기존 이름은 일시적으로 새 모델로 연결됩니다. 공지에는 V4-Pro 요청도 9월 14일부터 V4.1-Flash로 전환한다고 적혀 있었지만, 확인 시점의 공식 업데이트 로그와 가격 페이지에는 9월 14일 이후에도 V4-Pro를 계속 제공한다고 적혀 있었습니다.
본 기사는 2026년 9월 15일에 확인했습니다. 이번 공지가 설명하는 것은 API 변경 사항이며, DeepSeek 앱과 웹 버전이 현재 어떤 모델을 쓰는지는 이 공식 페이지들에 나와 있지 않으므로 본 기사는 추정하지 않습니다. 본 사이트는 이 모델을 실제로 호출하거나 평가하지 않았으며, 글에 나오는 성능과 평가 관련 내용은 모두 DeepSeek 자체의 설명입니다. 일상과 업무 상황은 에디터가 설계한 예시입니다.
V4.1-Flash 공지에 적힌 내용
DeepSeek에 따르면 V4.1-Flash는 파라미터 규모 552B의 전문가 혼합(MoE) 모델로, 새로운 Causal Encoder-Decoder 아키텍처를 채택했습니다. 입력을 읽을 때는 8B, 출력을 생성할 때는 16B 파라미터를 활성화하며, DeepSeek는 이를 입력과 출력의 비대칭이라고 부릅니다. 공지는 또 새로운 사전 학습 방식과 더 큰 규모의 강화학습 사후 학습 덕분에 DeepSeek-V4-Pro를 포함한 플래그십 모델을 벤치마크에서 앞섰다고 밝혔습니다. 이는 업체의 주장이며, 모델 카드의 비교표에는 다른 업체 모델보다 뒤처지는 항목도 있습니다. 본 사이트는 다시 테스트하지 않았습니다.
또 하나의 핵심은 캐시입니다. 모델은 긴 대화를 처리할 때 중간 계산 데이터를 임시로 저장하는데, 이를 KV 캐시라고 합니다. 공지에 따르면 이전 세대와 비교해 V4.1-Flash의 KV 캐시는 HBM 요구량이 4분의 1, SSD 요구량이 8분의 1로 줄었으며, 아키텍처가 더 효율적이어서 API 가격을 인하했다고 설명합니다.
가중치와 관련해 공지에는 공식 Hugging Face 페이지 링크가 첨부되어 있습니다. 모델 카드에는 저장소와 모델 가중치가 MIT 라이선스로 제공되고, 최대 100만 토큰의 컨텍스트를 지원하며, 이미지와 텍스트를 직접 처리해 텍스트를 출력할 수 있다고 명시되어 있습니다. 다만 내려받을 수 있다고 해서 일반 컴퓨터에서 돌릴 수 있다는 뜻은 아닙니다. 모델 카드에 연결된 추론 예제는 8-way 모델 병렬 설정으로 실행됩니다. 출시 공지는 별도로 GPU 2,000장과 스토리지 클러스터로 대규모 배포를 계획하는 기관에 DeepSeek로 연락해 달라고 안내했습니다.
기존 모델명 전환과 V4-Pro의 거취: 두 가지 설명의 선후 관계
첫 번째 설명은 9월 10일 출시 공지에서 나왔습니다. 공지는 여러 테스트에서 V4.1-Flash가 성능, 비용, 속도, 총 소요 시간 모두에서 V4-Pro를 앞섰기 때문에 V4-Pro를 퇴장시킬 계획이라고 밝혔습니다. 2026년 9월 14일 UTC 04:00(대만 시간 정오)부터 모든 deepseek-v4-pro 요청을 V4.1-Flash가 처리하고 V4.1-Flash 가격으로 과금하며, 이는 V4.1-Pro가 출시될 때까지 이어진다는 내용이었습니다.
두 번째 설명은 업데이트 로그와 가격 페이지에 있습니다. 확인 당일 업데이트 로그의 9월 10일 항목과 가격 페이지의 주석에는, 사용자 요구에 따라 DeepSeek가 2026년 9월 14일 이후에도 V4-Pro API 서비스를 계속 제공하기로 결정했으며 과금 방식은 변하지 않고 변경이 있으면 별도로 알리겠다고 적혀 있었습니다. 가격 페이지에서 deepseek-v4-pro에 대응하는 버전은 DeepSeek-V4-Pro-0813입니다. '계속 제공하기로 결정했다'는 표현으로 보면 전환 계획 이후에 내린 결정이지만, 페이지에 날짜가 표시되어 있지 않고 API 문서의 뉴스 목록에도 별도 공지가 없습니다.
9월 15일 확인 시점에도 영어판과 중국어 간체판 출시 공지 페이지에는 '9월 14일부터 전환한다'는 원래 문구가 남아 있었습니다. 공지만 읽은 사람은 V4-Pro가 이미 대체되었다고 생각할 수 있습니다. 업데이트 로그와 가격 페이지의 설명에 따르면 deepseek-v4-pro는 9월 14일 이후에도 계속 제공되며, V4-Flash의 기존 이름 두 개는 V4.1-Flash가 처리하고 Flash 가격으로 과금됩니다.
| 모델명 | 실제 처리 모델 | 과금 |
|---|---|---|
| deepseek-flash | DeepSeek-V4.1-Flash | Flash 가격 |
| deepseek-v4-flash | V4.1-Flash(원래 모델 퇴역) | Flash 가격 |
| deepseek-v4-flash-vision-exp | V4.1-Flash(원래 모델 퇴역) | Flash 가격 |
| deepseek-v4-pro | DeepSeek-V4-Pro-0813 | 과금 방식 변동 없음 |
API를 직접 호출하지 않는 사람도 영향을 받는 이유
대만 독자 대부분은 DeepSeek API를 직접 호출하지 않지만 간접적으로 사용하고 있을 수 있습니다. 일부 번역 확장 프로그램, 글쓰기 앱, 사내 질의응답 도구는 설정에 특정 DeepSeek 모델명을 입력한 뒤 사용자의 입력을 그쪽으로 전달합니다. DeepSeek 공지도 WorkBuddy(CodeBuddy 포함)와 OpenCode가 V4.1-Flash를 전면 지원한다고 언급했습니다. 서비스 제공자가 기존 이름을 새 모델로 연결하면 도구 설정은 바꿀 필요가 없지만, 뒤에서 답변하는 모델은 이미 바뀐 상태입니다.
이번 사례가 이를 잘 보여 줍니다. deepseek-v4-flash라는 이름에는 V4가 들어 있지만 실제로 처리하는 모델은 V4.1-Flash입니다. 업데이트 로그에는 4월 24일 V4를 출시할 때 deepseek-chat과 deepseek-reasoner 두 기존 이름이 전환 기간 동안 각각 deepseek-v4-flash의 비사고 모드와 사고 모드를 가리키며, 2026년 7월 24일에 사용이 중단된다고 예고한 내용도 기록되어 있습니다.
에디터가 설계한 상황을 예로 들어 보겠습니다. 한 직장인이 매일 사내 요약 도구로 회의록을 정리하다가 9월 10일 이후 요약이 길어지고 단락을 나누는 방식도 달라졌다는 것을 알아차렸습니다. 먼저 도구의 업데이트 안내를 확인하거나 관리자에게 문의해 백엔드가 DeepSeek에 연결되어 있는지, 어떤 모델명이 입력되어 있는지 확인할 수 있습니다. 답변 스타일, 길이, 출력 형식, 이미지 인식 능력이 갑자기 달라졌다면 한번 물어볼 만한 신호입니다. 반드시 품질이 나빠졌다는 뜻은 아니지만, 출력을 공식 문서에 붙여 넣어야 한다면 다시 표본을 뽑아 점검하는 것이 좋습니다.
가격, 피크 시간대, 고정 버전의 의미
API 가격은 간단히만 짚겠습니다. 가격 페이지에 따르면 deepseek-flash의 피크 시간대 가격은 100만 토큰당 입력(캐시 미적중) 0.3달러, 출력 1.2달러이며, deepseek-v4-pro는 각각 1.32달러와 3.96달러입니다. 비피크 가격은 피크 가격의 절반이고, 피크 시간대는 월요일부터 금요일까지 UTC 01:00~04:00과 06:00~10:00으로, 대만 시간으로는 오전 9시~12시와 오후 2시~6시입니다. 공지에 따르면 새 가격은 9월 10일 UTC 04:00부터 적용되었습니다.
기존 이름이 새 모델로 연결되면 청구 금액도 함께 달라집니다. 가격 페이지는 V4-Flash 기존 이름으로 들어오는 요청을 Flash 가격으로 과금한다고 설명합니다. 만약 V4-Pro가 원래 계획대로 전환되었다면, 가격 페이지 수치로 볼 때 V4-Pro를 쓰던 사람의 비용은 줄었겠지만 답변은 다른 모델이 하게 되었을 것입니다. 기능도 다릅니다. 가격 페이지에는 deepseek-flash는 이미지 이해를 지원하고 deepseek-v4-pro는 지원하지 않는다고 표시되어 있습니다. 서드파티 도구에 월 요금을 내는 사람이라면 요금제 가격이 따라서 바뀌는지는 각 도구의 안내를 확인해야 합니다.
고정 버전이란 도구가 조용히 바뀌지 않는 모델 버전을 지정해 동작을 더 예측 가능하게 만드는 것을 말합니다. DeepSeek 가격 페이지는 모델명과 실제 버전을 따로 표기하지만, 날짜가 붙은 버전명으로 호출할 수 있는지는 설명하지 않습니다. 8월 13일 업데이트 로그에도 deepseek-v4-pro라는 이름을 계속 쓰면 최신 버전을 사용하게 된다고 적혀 있습니다. 도구를 직접 관리하는 사람은 모델명, 버전, 확인 날짜를 기록해 두고 업데이트 로그를 정기적으로 확인하는 것이 좋습니다.
중국 업체 서비스를 쓰기 전에 직접 읽어야 할 약관
DeepSeek 공식 API나 앱을 통해 사용하면 입력한 내용이 DeepSeek 서비스로 전송되어 처리됩니다. 데이터가 어떻게 보관되는지, 어디에 저장되는지, 서비스 개선에 쓰이는지는 DeepSeek 공식 개인정보 처리방침과 서비스 약관을 읽어 보시기 바랍니다. 본 기사는 이를 대신 해석하지 않습니다. 회사가 내부 데이터를 외부 AI 서비스로 보내려 한다면, 업체가 어느 나라 회사이든 먼저 내부 데이터 규정이 이를 허용하는지 확인해야 합니다.
간접적으로 사용할 때는 한 단계 더 확인해야 합니다. 서드파티 도구는 DeepSeek 공식 API에 직접 연결할 수도 있고, 다른 클라우드 플랫폼이 호스팅하는 모델을 사용할 수도 있으며, 두 경우에 적용되는 약관이 다릅니다. 도구의 도움말 페이지나 개인정보 처리방침에서 '모델 제공업체', '데이터 전송' 같은 항목을 찾아보십시오. 답을 찾기 전까지는 신분증 번호, 고객 명단, 공개되지 않은 계약서를 붙여 넣지 않는 것이 좋습니다.
오픈 가중치는 또 다른 선택지입니다. 모델 카드는 MIT 라이선스를 채택하고 있어 기관이 자체 환경에 배포할 수 있으며, 데이터를 DeepSeek API로 보낼 필요가 없습니다. 다만 자체 배포에는 하드웨어, 운영, 데이터 관리 부담이 따르며, 이러한 절충점은 본 사이트의 Qwen3.5 오픈 가중치 기사에서 이미 설명했습니다.
2026년 AI 뉴스 총정리: 1월부터 9월까지의 핵심과 일상 적용2026년 AI 뉴스 총정리: 1월부터 9월까지의 핵심과 일상 적용2026년 1월부터 9월까지의 주요 AI 뉴스를 월별로 정리하여 5개 언어 상세 심층 분석으로 연결합니다. 모델, 업무 도구, 창작, 비용, 투명성을 아우르며 사건 배경과 일상적 활용, 서비스 제공 제한 사항을 설명합니다.전체 글 읽기
Qwen3.5 오픈 가중치: 다운로드 가능한 모델과 내 컴퓨터 구동의 차이는?Qwen3.5 오픈 가중치: 다운로드 가능한 모델과 내 컴퓨터 구동의 차이는?2026-02-16 공개된 Qwen3.5-397B-A17B 오픈 가중치 모델을 돌아보며 오픈 가중치, 하드웨어 부담, 클라우드 호스팅의 차이를 명확히 짚고 중소기업을 위한 실무 평가 지침을 제공합니다.전체 글 읽기
같은 주제의 글
라이프스타일
NVIDIA, DGX Spark 64GB 모델 출시: 10월 23일 판매 시작, 시작가 4,999달러, 두 대 연결 시 128GB
NVIDIA는 2026년 10월 2일 개인용 AI 컴퓨터 DGX Spark에 더 저렴한 64GB 메모리 모델을 추가한다고 발표했다. 10월 23일부터 Acer, ASUS 등 6개 제조사를 통해 공급되며, 주요 대상은 자신의 기기에서 AI 모델을 실행하려는 개발자와 연구자다. NVIDIA가 공개한 사양, 두 대 연결에 관한 설명, 그리고 일반 독자에게 갖는 의미를 정리했다.
라이프스타일
Google Cloud, Spanner queues 정식 출시 발표: 메시지 큐를 데이터베이스 트랜잭션에 통합해 AI 에이전트 신뢰성 겨냥
Google Cloud가 Spanner queues 정식 출시를 발표했다. 메시지 생성을 데이터베이스 트랜잭션의 일부로 만들어 AI 에이전트의 '상태'와 '동작'이 어긋나는 문제를 해결하겠다는 것이다. 공식 설명, 주요 기능, 일반 독자에게 갖는 의미를 정리했다.
라이프스타일
GPT-6.1 Sol 출시: 새 버전 Sol, API·Codex·ChatGPT Work에서 제공, Chat에는 없음
OpenAI는 2026년 9월 29일 GPT-6.1 Sol을 출시했습니다. API 이름은 gpt-6.1-sol이며, Plus, Pro, Business, Enterprise, Edu 요금제의 Codex와 ChatGPT Work가 출시 시 제공 범위에 포함되고(Enterprise와 Edu는 관리자가 켜야 함), Free와 Go는 출시 시 포함되지 않으며, Chat에는 없습니다(2026년 9월 확인).
라이프스타일
Claude Sonnet 5.5 출시: 정가는 Sonnet 5와 같고, API·클라우드 플랫폼·Claude.ai에서 사용 가능
Anthropic은 2026년 9월 28일 Claude Sonnet 5.5를 출시했습니다. API 정가는 Sonnet 5와 같고(100만 tokens당 입력 2달러, 출력 10달러), Claude.ai, API, 여러 클라우드 플랫폼에서 사용할 수 있으며, 위험도가 높은 사이버 보안 요청은 Sonnet 5로 되돌려 처리됩니다(2026년 9월 확인).
이 글을 인용한 글
최신 여행 소식·가이드

가이드도쿄
도쿄 어디에 묵을까? 신주쿠·우에노·도쿄역·시부야·아사쿠사·이케부쿠로·긴자 일곱 지역 비교: 공항 교통, 숙박세, 짐 배송까지
도쿄 어디에 묵을까? 신주쿠, 우에노, 도쿄역, 시부야, 아사쿠사, 이케부쿠로, 긴자 일곱 지역을 같은 기준으로 비교한다. 나리타·하네다 공항에서 오는 방법, 교통 노선, 주변의 볼거리, 동네 분위기, 적합한 여행자를 비교표와 야마노테선 안내도로 살펴보고, 2026년 9월에 확인한 도쿄도 숙박세(2027년 4월부터 3%)와 공항 택배로 짐을 보내는 규정도 정리했다.
- 예산
- 호텔

가이드도쿄
도쿄 교통패스 선택법: Suica/Welcome Suica, Tokyo Subway Ticket, JR Pass는 살 만할까?
도쿄를 처음 여행한다면 먼저 1인당 IC 카드 한 장으로 탈 때마다 결제한다(Welcome Suica는 보증금이 없고 28일간 유효). 하루에 지하철을 4번 이상 타면 2,000엔짜리 Tokyo Subway Ticket 72시간권을 추가하고, 간사이에 가지 않고 도쿄만 여행한다면 JR Pass는 반드시 손해다. TOURIST PASMO, iPhone의 Suica, 도쿄 Metro 하루권의 이용 가능·불가 범위를 결정도로 비교한다. 가격은 2026년 9월 확인.
- 교통
- 예산

가이드도쿄
도쿄 디즈니랜드·디즈니씨 가이드: 티켓 가격, 판타지 스프링스 Fantasy Springs, 디즈니 프리미어 액세스 DPA와 스탠바이 패스 이용법, 첫 방문에는 어느 파크가 좋을까
도쿄 디즈니 하루짜리 패스포트는 변동 가격제로, 2026년 9월에는 평일 대부분이 9,900엔, 주말이 10,900엔이다. 공식 홈페이지에서 매일 14:00에 두 달 뒤 같은 날짜의 티켓을 판매한다. 무료 프라이오리티 패스는 공식 서비스 목록에서 빠져 대기 시간을 줄이는 방법은 유료 디즈니 프리미어 액세스(한 사람당 한 번 1,000~3,500엔)뿐이다. 운영 시간, 25주년 행사, 스탠바이 패스, 엔트리 리퀘스트, 판타지 스프링스 이용법, 첫 방문 때 디즈니랜드와 디즈니씨 중 어디를 고를지도 담았다. 2026년 9월 공식 홈페이지에서 확인했다.
- 추천 일정
- 가족 여행