生活分享

DeepSeek-V4.1-Flash 上线、V4-Pro 去留有两种说法:模型换手时该注意什么

DeepSeek 于 2026 年 9 月 10 日推出 V4.1-Flash,V4-Flash 旧模型名暂时指向新模型;发布公告写 V4-Pro 自 9 月 14 日起改为指向新模型,更新日志与价格页则写 9 月 14 日之后继续提供。本文依据官方页面梳理两种说法的先后与核实时的现状,并说明通过第三方工具间接使用的人,如何察觉模型换手、看懂价格与隐私条款。

更新日期: 阅读时间约 7 分钟

模型名称不变、背后模型已经换手的原创插图
图片:Mokaair (© Mokaair)

2026 年 9 月 10 日,DeepSeek 在官方 API 文档发布 DeepSeek-V4.1-Flash,说明它是新架构系列中最小的模型,具备原生的图像理解能力,调用时的模型名称是 deepseek-flash。前一代 V4-Flash 与 V4-Flash-Vision-Exp 同时退役,旧名暂时指向新模型。公告还写道,V4-Pro 的请求将自 9 月 14 日起改为指向 V4.1-Flash,但核实时官方更新日志与价格页写的是 9 月 14 日之后继续提供 V4-Pro。

本文于 2026 年 9 月 15 日核实。这次公告说明的是 API 的变动,DeepSeek App 与网页版目前使用哪个模型,官方这几页没有交代,本文不做推断。本站没有实际调用或评测这个模型,文中的能力与评测说法都是 DeepSeek 自己的表述;生活与工作场景则是编辑设计的例子。

V4.1-Flash 的公告写了什么

DeepSeek 表示,V4.1-Flash 是参数规模 552B 的混合专家(MoE)模型,采用新的 Causal Encoder-Decoder 架构,读取输入时激活 8B 参数、生成输出时激活 16B,官方称之为输入与输出不对称。公告还说,新的预训练方式加上更大规模的强化学习后训练,让它在基准测试上超过包括 DeepSeek-V4-Pro 在内的旗舰模型。这是厂商的说法,模型卡的对照表里也有它落后于其他厂商模型的项目,本站没有重新测试。

另一个重点是缓存。模型处理长对话时会暂存中间计算数据,称为 KV 缓存(KV cache)。公告说与上一代相比,V4.1-Flash 的 KV 缓存对 HBM 的需求降到四分之一、对 SSD 的需求降到八分之一,并表示架构更高效,因此下调了 API 价格。

权重方面,公告附上了官方 Hugging Face 页面。模型卡写明仓库与模型权重采用 MIT 许可证,支持最长一百万 token 的上下文,能直接处理图片与文字并输出文字。开放下载不代表普通电脑跑得动:模型卡链接的推理示例以 8 路模型并行的设置运行。发布公告另外邀请计划以两千张 GPU 加存储集群大规模部署的机构联系 DeepSeek。

旧模型名改为指向新模型、V4-Pro 去留:两种说法的先后

第一种说法来自 9 月 10 日的发布公告。它说多方测试显示 V4.1-Flash 在性能、费用、速度与总用时上都胜过 V4-Pro,因此计划让 V4-Pro 退场:自 2026 年 9 月 14 日 UTC 04:00(台湾时间中午 12 点)起,所有 deepseek-v4-pro 的请求改由 V4.1-Flash 处理并按 V4.1-Flash 的价格计费,直到 V4.1-Pro 推出。

第二种说法在更新日志与价格页。核实当天,更新日志 9 月 10 日那一条与价格页的注释写着:根据用户需求,DeepSeek 决定在 2026 年 9 月 14 日之后继续提供 V4-Pro 的 API 服务,计费方式不变,如有变动会另行通知。价格页上 deepseek-v4-pro 对应的版本是 DeepSeek-V4-Pro-0813。从“决定继续提供”的措辞看,这是改为指向新模型的计划之后作出的决定,但页面未标注日期,API 文档的新闻列表也没有另发公告。

9 月 15 日核实时,英文与简体中文的发布公告页仍保留原本“9 月 14 日起改为指向 V4.1-Flash”的文字。只读公告的人,可能以为 V4-Pro 已被取代;根据更新日志与价格页的说明,deepseek-v4-pro 在 9 月 14 日之后继续提供,V4-Flash 的两个旧名则由 V4.1-Flash 提供服务并按 Flash 价格计费。

2026 年 9 月 15 日核实;根据 DeepSeek 更新日志与模型价格页整理,仅限官方 API
模型名称实际提供服务的模型计价
deepseek-flashDeepSeek-V4.1-FlashFlash 价格
deepseek-v4-flashV4.1-Flash(原模型已退役)Flash 价格
deepseek-v4-flash-vision-expV4.1-Flash(原模型已退役)Flash 价格
deepseek-v4-proDeepSeek-V4-Pro-0813计费方式不变

没有直接调用 API 的人,为什么也会受影响

多数台湾读者不会自己调用 DeepSeek API,但可能间接用到它。有些翻译插件、写作 App 或公司内部的问答工具,会在设置里填入某个 DeepSeek 模型名,再把用户的输入转发过去;DeepSeek 公告也点名 WorkBuddy(含 CodeBuddy)与 OpenCode 已全面支持 V4.1-Flash。服务商把旧名指向新模型时,工具设置不必修改,背后回答的模型却已经换了。

这次的例子很清楚:deepseek-v4-flash 名称里写着 V4,实际提供服务的却是 V4.1-Flash。更新日志也记载,4 月 24 日推出 V4 时,deepseek-chat 与 deepseek-reasoner 两个旧名在过渡期间分别指向 deepseek-v4-flash 的非思考与思考模式,并预告 2026 年 7 月 24 日停用。

以编辑设计的场景为例:一位上班族每天用公司内部的摘要工具整理会议纪要,9 月 10 日之后发现摘要变长、分段方式也不同。可以先查看工具的更新说明或询问管理员,确认后端是否接入 DeepSeek、填的是哪个模型名。回答风格、长度、输出格式或看图能力突然改变,都是值得问一句的信号;不一定代表变差,但输出如果要贴进正式文件,最好重新抽样检查。

模型换手时的四个检查:看工具更新说明、比对回答、确认模型名称与版本、阅读隐私政策
模型换手时的四个检查:看工具更新说明、比对回答长度与格式、确认模型名称与实际版本、阅读官方隐私政策。 · 图片:Mokaair (© Mokaair)

价格、高峰时段与固定版本的意义

API 价格只简单带过。根据定价页,deepseek-flash 在高峰时段每百万 token 的输入(未命中缓存)为 0.3 美元、输出为 1.2 美元;deepseek-v4-pro 分别是 1.32 与 3.96 美元。非高峰价格是高峰的一半,高峰时段为周一到周五 UTC 01:00 至 04:00 与 06:00 至 10:00,即台湾时间上午 9 点到 12 点、下午 2 点到 6 点。公告写新价格自 9 月 10 日 UTC 04:00 生效。

旧名指向新模型时,账单也会跟着变。价格页说 V4-Flash 旧名的请求改按 Flash 价格计费;如果 V4-Pro 当初按原计划改为指向新模型,根据定价页的数字,原本使用 V4-Pro 的人费用会下降,回答却会换成另一个模型。功能也不同:价格页标注 deepseek-flash 支持图像理解、deepseek-v4-pro 不支持。付月费使用第三方工具的人,套餐价格是否跟着变,要看各工具自己的说明。

所谓固定版本,是指工具指定一个不会悄悄更换的模型版本,让行为更可预期。DeepSeek 价格页把模型名称与实际版本分开列出,但没有说明能否用带日期的版本名调用;8 月 13 日的更新日志也写道,沿用 deepseek-v4-pro 这个名称就会用到最新版本。自己管理工具的人,可以记下模型名、版本与核实日期,并定期查看更新日志。

使用中国厂商服务前,自己要读的条款

通过 DeepSeek 官方 API 或 App 使用时,输入的内容会发送到 DeepSeek 的服务处理。数据如何保存、存放在哪里、是否用于改进服务,请阅读 DeepSeek 官方隐私政策与服务条款,本文不代为解读。公司如果要把内部数据发送到任何外部 AI 服务,无论厂商来自哪个国家,都应先确认内部的数据规范是否允许。

间接使用时要多问一层。第三方工具可能直接接入 DeepSeek 官方 API,也可能使用其他云平台托管的模型,两者适用的条款不同。可以在工具的说明页或隐私政策里找“模型供应商”“数据传输”之类的段落;找到答案之前,不要先把身份证号码、客户名单或未公开的合同粘贴进去。

开放权重提供了另一种选择:模型卡采用 MIT 许可证,机构可以在自己的环境中部署,数据不必发送到 DeepSeek 的 API。不过自行部署要承担硬件、运维与数据管理,这些取舍在本站 Qwen3.5 开放权重那篇已有说明。

最新旅游情报攻略

资料来源

生活分享