生活分享
DeepSeek-V4.1-Flash 上线、V4-Pro 去留有两种说法:模型换手时该注意什么
DeepSeek 于 2026 年 9 月 10 日推出 V4.1-Flash,V4-Flash 旧模型名暂时指向新模型;发布公告写 V4-Pro 自 9 月 14 日起改为指向新模型,更新日志与价格页则写 9 月 14 日之后继续提供。本文依据官方页面梳理两种说法的先后与核实时的现状,并说明通过第三方工具间接使用的人,如何察觉模型换手、看懂价格与隐私条款。
更新日期: 阅读时间约 7 分钟

2026 年 9 月 10 日,DeepSeek 在官方 API 文档发布 DeepSeek-V4.1-Flash,说明它是新架构系列中最小的模型,具备原生的图像理解能力,调用时的模型名称是 deepseek-flash。前一代 V4-Flash 与 V4-Flash-Vision-Exp 同时退役,旧名暂时指向新模型。公告还写道,V4-Pro 的请求将自 9 月 14 日起改为指向 V4.1-Flash,但核实时官方更新日志与价格页写的是 9 月 14 日之后继续提供 V4-Pro。
本文于 2026 年 9 月 15 日核实。这次公告说明的是 API 的变动,DeepSeek App 与网页版目前使用哪个模型,官方这几页没有交代,本文不做推断。本站没有实际调用或评测这个模型,文中的能力与评测说法都是 DeepSeek 自己的表述;生活与工作场景则是编辑设计的例子。
V4.1-Flash 的公告写了什么
DeepSeek 表示,V4.1-Flash 是参数规模 552B 的混合专家(MoE)模型,采用新的 Causal Encoder-Decoder 架构,读取输入时激活 8B 参数、生成输出时激活 16B,官方称之为输入与输出不对称。公告还说,新的预训练方式加上更大规模的强化学习后训练,让它在基准测试上超过包括 DeepSeek-V4-Pro 在内的旗舰模型。这是厂商的说法,模型卡的对照表里也有它落后于其他厂商模型的项目,本站没有重新测试。
另一个重点是缓存。模型处理长对话时会暂存中间计算数据,称为 KV 缓存(KV cache)。公告说与上一代相比,V4.1-Flash 的 KV 缓存对 HBM 的需求降到四分之一、对 SSD 的需求降到八分之一,并表示架构更高效,因此下调了 API 价格。
权重方面,公告附上了官方 Hugging Face 页面。模型卡写明仓库与模型权重采用 MIT 许可证,支持最长一百万 token 的上下文,能直接处理图片与文字并输出文字。开放下载不代表普通电脑跑得动:模型卡链接的推理示例以 8 路模型并行的设置运行。发布公告另外邀请计划以两千张 GPU 加存储集群大规模部署的机构联系 DeepSeek。
旧模型名改为指向新模型、V4-Pro 去留:两种说法的先后
第一种说法来自 9 月 10 日的发布公告。它说多方测试显示 V4.1-Flash 在性能、费用、速度与总用时上都胜过 V4-Pro,因此计划让 V4-Pro 退场:自 2026 年 9 月 14 日 UTC 04:00(台湾时间中午 12 点)起,所有 deepseek-v4-pro 的请求改由 V4.1-Flash 处理并按 V4.1-Flash 的价格计费,直到 V4.1-Pro 推出。
第二种说法在更新日志与价格页。核实当天,更新日志 9 月 10 日那一条与价格页的注释写着:根据用户需求,DeepSeek 决定在 2026 年 9 月 14 日之后继续提供 V4-Pro 的 API 服务,计费方式不变,如有变动会另行通知。价格页上 deepseek-v4-pro 对应的版本是 DeepSeek-V4-Pro-0813。从“决定继续提供”的措辞看,这是改为指向新模型的计划之后作出的决定,但页面未标注日期,API 文档的新闻列表也没有另发公告。
9 月 15 日核实时,英文与简体中文的发布公告页仍保留原本“9 月 14 日起改为指向 V4.1-Flash”的文字。只读公告的人,可能以为 V4-Pro 已被取代;根据更新日志与价格页的说明,deepseek-v4-pro 在 9 月 14 日之后继续提供,V4-Flash 的两个旧名则由 V4.1-Flash 提供服务并按 Flash 价格计费。
| 模型名称 | 实际提供服务的模型 | 计价 |
|---|---|---|
| deepseek-flash | DeepSeek-V4.1-Flash | Flash 价格 |
| deepseek-v4-flash | V4.1-Flash(原模型已退役) | Flash 价格 |
| deepseek-v4-flash-vision-exp | V4.1-Flash(原模型已退役) | Flash 价格 |
| deepseek-v4-pro | DeepSeek-V4-Pro-0813 | 计费方式不变 |
没有直接调用 API 的人,为什么也会受影响
多数台湾读者不会自己调用 DeepSeek API,但可能间接用到它。有些翻译插件、写作 App 或公司内部的问答工具,会在设置里填入某个 DeepSeek 模型名,再把用户的输入转发过去;DeepSeek 公告也点名 WorkBuddy(含 CodeBuddy)与 OpenCode 已全面支持 V4.1-Flash。服务商把旧名指向新模型时,工具设置不必修改,背后回答的模型却已经换了。
这次的例子很清楚:deepseek-v4-flash 名称里写着 V4,实际提供服务的却是 V4.1-Flash。更新日志也记载,4 月 24 日推出 V4 时,deepseek-chat 与 deepseek-reasoner 两个旧名在过渡期间分别指向 deepseek-v4-flash 的非思考与思考模式,并预告 2026 年 7 月 24 日停用。
以编辑设计的场景为例:一位上班族每天用公司内部的摘要工具整理会议纪要,9 月 10 日之后发现摘要变长、分段方式也不同。可以先查看工具的更新说明或询问管理员,确认后端是否接入 DeepSeek、填的是哪个模型名。回答风格、长度、输出格式或看图能力突然改变,都是值得问一句的信号;不一定代表变差,但输出如果要贴进正式文件,最好重新抽样检查。
价格、高峰时段与固定版本的意义
API 价格只简单带过。根据定价页,deepseek-flash 在高峰时段每百万 token 的输入(未命中缓存)为 0.3 美元、输出为 1.2 美元;deepseek-v4-pro 分别是 1.32 与 3.96 美元。非高峰价格是高峰的一半,高峰时段为周一到周五 UTC 01:00 至 04:00 与 06:00 至 10:00,即台湾时间上午 9 点到 12 点、下午 2 点到 6 点。公告写新价格自 9 月 10 日 UTC 04:00 生效。
旧名指向新模型时,账单也会跟着变。价格页说 V4-Flash 旧名的请求改按 Flash 价格计费;如果 V4-Pro 当初按原计划改为指向新模型,根据定价页的数字,原本使用 V4-Pro 的人费用会下降,回答却会换成另一个模型。功能也不同:价格页标注 deepseek-flash 支持图像理解、deepseek-v4-pro 不支持。付月费使用第三方工具的人,套餐价格是否跟着变,要看各工具自己的说明。
所谓固定版本,是指工具指定一个不会悄悄更换的模型版本,让行为更可预期。DeepSeek 价格页把模型名称与实际版本分开列出,但没有说明能否用带日期的版本名调用;8 月 13 日的更新日志也写道,沿用 deepseek-v4-pro 这个名称就会用到最新版本。自己管理工具的人,可以记下模型名、版本与核实日期,并定期查看更新日志。
使用中国厂商服务前,自己要读的条款
通过 DeepSeek 官方 API 或 App 使用时,输入的内容会发送到 DeepSeek 的服务处理。数据如何保存、存放在哪里、是否用于改进服务,请阅读 DeepSeek 官方隐私政策与服务条款,本文不代为解读。公司如果要把内部数据发送到任何外部 AI 服务,无论厂商来自哪个国家,都应先确认内部的数据规范是否允许。
间接使用时要多问一层。第三方工具可能直接接入 DeepSeek 官方 API,也可能使用其他云平台托管的模型,两者适用的条款不同。可以在工具的说明页或隐私政策里找“模型供应商”“数据传输”之类的段落;找到答案之前,不要先把身份证号码、客户名单或未公开的合同粘贴进去。
开放权重提供了另一种选择:模型卡采用 MIT 许可证,机构可以在自己的环境中部署,数据不必发送到 DeepSeek 的 API。不过自行部署要承担硬件、运维与数据管理,这些取舍在本站 Qwen3.5 开放权重那篇已有说明。
2026 年 AI 新闻总整理:1 月至 9 月的重点与生活应用2026 年 AI 新闻总整理:1 月至 9 月的重点与生活应用从 2026 年 1 月至 9 月,按月份整理 AI 重要新闻,直达五语完整解析。涵盖模型、工作工具、创作、费用与透明度,说明事件背景、生活用途与开放限制。阅读全文
Qwen3.5 开放权重:可下载模型,与能在自己电脑运行差在哪?Qwen3.5 开放权重:可下载模型,与能在自己电脑运行差在哪?回顾 2026-02-16 发布的 Qwen3.5-397B-A17B 开放权重模型,厘清开放权重、硬件负担与云端托管差异,提供中小企业务实评估指引。阅读全文
同主题延伸阅读
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起价 4,999 美元,两台可串接成 128GB
NVIDIA 于 2026 年 10 月 2 日宣布,个人 AI 电脑 DGX Spark 新增较平价的 64GB 内存版本,10 月 23 日起由 Acer、ASUS 等六家厂商供应,主要面向希望在自己机器上运行 AI 模型的开发者与研究人员。以下整理 NVIDIA 公布的规格、双机串接说法,以及对普通读者的意义。
生活分享
Google Cloud 宣布 Spanner queues 正式推出:把消息队列放进数据库事务,瞄准 AI 智能体可靠性
Google Cloud 宣布 Spanner queues 正式推出,让消息创建成为数据库事务的一部分,目标是解决 AI 智能体“状态”与“动作”不同步的问题。本文整理官方说法、主要功能以及对普通读者的意义。
生活分享
GPT-6.1 Sol 推出:新一版 Sol 上 API、Codex 与 ChatGPT Work,Chat 里没有
OpenAI 在 2026 年 9 月 29 日推出 GPT-6.1 Sol,API 名称是 gpt-6.1-sol:Plus、Pro、Business、Enterprise、Edu 方案的 Codex 与 ChatGPT Work 在首发推出范围内,Enterprise 与 Edu 要管理员启用,Free 与 Go 首发不含,Chat 里没有(2026 年 9 月查证)。
生活分享
Claude Sonnet 5.5 推出:标价与 Sonnet 5 相同,API、云平台与 Claude.ai 都能用
Anthropic 在 2026 年 9 月 28 日推出 Claude Sonnet 5.5,API 标价与 Sonnet 5 相同(每百万 tokens 输入 2 美元、输出 10 美元);Claude.ai、API 与多个云平台可用,较高风险的网络安全请求会退回 Sonnet 5 处理(2026 年 9 月查证)。
引用本文的文章
最新旅游情报攻略

攻略东京
东京住哪一区:新宿、上野、东京站、涩谷、浅草、池袋、银座七区比较,机场交通、住宿税、行李寄送一次看
东京住哪一区?用同一套标准比较新宿、上野、东京站、涩谷、浅草、池袋、银座七个区域:从成田、羽田机场怎么过来、有哪些线路、周边有什么、街区氛围、适合谁。附比较表与山手线示意图,以及 2026 年 9 月核实的东京都住宿税(2027 年 4 月改为 3%)和机场宅急便寄送行李的规则。
- 预算
- 酒店

攻略东京
东京交通票券怎么选:Suica/Welcome Suica、Tokyo Subway Ticket、JR Pass 值不值得买
第一次去东京,每人先用一张 IC 卡按次付费(Welcome Suica 免押金、有效期 28 天)。一天搭四趟以上地铁,再加买 2,000 日元的 Tokyo Subway Ticket 72 小时券;只玩东京、不去关西,买 JR Pass 一定不划算。用决策图比较 TOURIST PASMO、iPhone 里的 Suica、东京 Metro 一日券能搭什么、不能搭什么;价格于 2026 年 9 月核实。
- 交通
- 预算

攻略东京
东京迪士尼乐园、海洋攻略:票价、梦幻泉乡 Fantasy Springs、尊享卡 DPA 与预约等候卡怎么用,第一次去选哪个园区
东京迪士尼一日护照采用浮动票价,2026 年 9 月平日大多为 9,900 日元、周末为 10,900 日元,官网每天 14:00 开售两个月后同一天的门票;免费的优先通行卡已不在官网服务清单,缩短排队时间只剩付费的迪士尼尊享卡(每人每次 1,000 至 3,500 日元)。另有运营时间与 25 周年活动、预约等候卡与报名体验、梦幻泉乡如何进入,以及第一次去选乐园还是海洋;2026 年 9 月通过东京迪士尼度假区官网核实。
- 行程范例
- 亲子
资料来源
- DeepSeek:DeepSeek-V4.1-Flash 发布公告 · 查证日期:
- DeepSeek:API 更新日志(Change Log) · 查证日期:
- DeepSeek:模型与价格 · 查证日期:
- DeepSeek:DeepSeek-V4.1-Flash 官方模型卡(Hugging Face) · 查证日期: