生活分享

DeepSeek-V4.1-Flash 上線、V4-Pro 去留有兩種說法:模型換手時該注意什麼

DeepSeek 在 2026 年 9 月 10 日推出 V4.1-Flash,V4-Flash 舊模型名暫時導向新模型;發布公告寫 V4-Pro 自 9 月 14 日起改導向,更新日誌與價格頁則寫 9 月 14 日之後繼續提供。本文依官方頁面整理兩種說法的先後與查核時的現況,並說明透過第三方工具間接使用的人,如何察覺模型換手、看懂價格與隱私條款。

更新日期: 閱讀時間約 7 分鐘

模型名稱不變、背後模型已經換手的原創插圖
圖片:Mokaair (© Mokaair)

2026 年 9 月 10 日,DeepSeek 在官方 API 文件發布 DeepSeek-V4.1-Flash,說明它是新架構系列中最小的模型,具備原生的圖像理解能力,呼叫時的模型名稱是 deepseek-flash。前一代 V4-Flash 與 V4-Flash-Vision-Exp 同時退役,舊名暫時導向新模型。公告也寫 V4-Pro 的請求將自 9 月 14 日起改導向 V4.1-Flash,但查核時官方更新日誌與價格頁寫的是 9 月 14 日之後繼續提供 V4-Pro。

本文於 2026 年 9 月 15 日查核。這次公告說明的是 API 的變動,DeepSeek App 與網頁版目前用哪個模型,官方這幾頁沒有交代,本文不做推定。本站沒有實際呼叫或這個模型,文中的能力與評測說法都是 DeepSeek 自己的表述;生活與工作情境則是編輯設計的例子。

V4.1-Flash 的公告寫了什麼

DeepSeek 表示,V4.1-Flash 是規模 552B 的混合專家()模型,採用新的 Causal Encoder-Decoder 架構,讀取輸入時啟用 8B 參數、產生輸出時啟用 16B,官方稱之為輸入與輸出不對稱。公告也說,新的方式加上更大規模的強化學習後訓練,讓它在上超過包括 DeepSeek-V4-Pro 在內的旗艦模型。這是廠商說法,模型卡對照表也有它落後其他廠商模型的項目,本站沒有重測。

另一個重點是快取。模型處理長對話時會暫存中間計算資料,稱為 KV 快取。公告說與上一代相比,V4.1-Flash 的 KV 快取對 HBM 的需求降到四分之一、對 SSD 的需求降到八分之一,並表示架構更有效率,因此調降 API 價格。

權重方面,公告附上官方 Hugging Face 頁面。模型卡寫明儲存庫與模型權重採用 MIT 授權,支援最長一百萬 token 的上下文,能直接處理圖片與文字並輸出文字。開放下載不代表一般電腦跑得動:模型卡連結的推論範例以 8 路模型平行的設定執行。發布公告另外邀請規劃以兩千張 GPU 加儲存叢集大規模部署的單位聯絡 DeepSeek。

舊模型名改導向、V4-Pro 去留:兩種說法的先後

第一種說法來自 9 月 10 日的發布公告。它說多方測試顯示 V4.1-Flash 在效能、費用、速度與總用時上都勝過 V4-Pro,因此計畫讓 V4-Pro 退場:自 2026 年 9 月 14 日 UTC 04:00(台灣時間中午 12 點)起,所有 deepseek-v4-pro 的請求改由 V4.1-Flash 處理並按 V4.1-Flash 的價格計費,直到 V4.1-Pro 推出。

第二種說法在更新日誌與價格頁。查核當天,更新日誌 9 月 10 日那一條與價格頁的註解寫著:因應使用者需求,DeepSeek 決定在 2026 年 9 月 14 日之後繼續提供 V4-Pro 的 API 服務,計費方式不變,若有變動會另行通知。價格頁上 deepseek-v4-pro 對應的版本是 DeepSeek-V4-Pro-0813。從「決定繼續提供」的措辭看是導向計畫之後的決定,但頁面未標示日期,API 文件新聞列表也沒有另發公告。

9 月 15 日查核時,英文與簡體中文的發布公告頁仍保留原本「9 月 14 日起改導向」的文字。只讀公告的人,可能以為 V4-Pro 已被取代;依更新日誌與價格頁的說明,deepseek-v4-pro 在 9 月 14 日之後繼續提供,V4-Flash 的兩個舊名則由 V4.1-Flash 服務並以 Flash 價格計費。

2026 年 9 月 15 日查核;依 DeepSeek 更新日誌與模型價格頁整理,僅限官方 API
模型名稱實際服務的模型計價
deepseek-flashDeepSeek-V4.1-FlashFlash 價格
deepseek-v4-flashV4.1-Flash(原模型已退役)Flash 價格
deepseek-v4-flash-vision-expV4.1-Flash(原模型已退役)Flash 價格
deepseek-v4-proDeepSeek-V4-Pro-0813計費方式不變

沒有直接呼叫 API 的人,為什麼也會受影響

多數台灣讀者不會自己呼叫 DeepSeek API,但可能間接用到它。有些翻譯外掛、寫作 App 或公司內部的問答工具,會在設定裡填入某個 DeepSeek 模型名,再把使用者的輸入轉送過去;DeepSeek 公告也點名 WorkBuddy(含 CodeBuddy)與 OpenCode 已全面支援 V4.1-Flash。服務商把舊名導向新模型時,工具設定不必改,背後回答的模型卻已經換了。

這次的例子很清楚:deepseek-v4-flash 名稱裡寫著 V4,實際服務的卻是 V4.1-Flash。更新日誌也記載,4 月 24 日推出 V4 時,deepseek-chat 與 deepseek-reasoner 兩個舊名在過渡期間分別指向 deepseek-v4-flash 的非思考與思考模式,並預告 2026 年 7 月 24 日停用。

以編輯設計的情境為例:一位上班族每天用公司內部的摘要工具整理會議紀錄,9 月 10 日之後發現摘要變長、分段方式也不同。可以先查工具的更新說明或詢問管理者,確認後端是否串接 DeepSeek、填的是哪個模型名。回答風格、長度、輸出格式或看圖能力突然改變,都是值得問一句的訊號;不一定代表變差,但輸出若要貼進正式文件,最好重新抽樣檢查。

模型換手時的四個檢查:看工具更新說明、比對回答、確認模型名稱與版本、閱讀隱私政策
模型換手時的四個檢查:看工具更新說明、比對回答長度與格式、確認模型名稱與實際版本、閱讀官方隱私政策。 · 圖片:Mokaair (© Mokaair)

價格、尖峰時段與固定版本的意義

API 價格只簡單帶過。依定價頁,deepseek-flash 在尖峰時段每百萬 token 的輸入(未命中快取)為 0.3 美元、輸出為 1.2 美元;deepseek-v4-pro 分別是 1.32 與 3.96 美元。離峰價格是尖峰的一半,尖峰時段為週一到週五 UTC 01:00 至 04:00 與 06:00 至 10:00,即台灣時間上午 9 點到 12 點、下午 2 點到 6 點。公告寫新價格自 9 月 10 日 UTC 04:00 生效。

舊名導向新模型時,帳單也會跟著變。價格頁說 V4-Flash 舊名的請求改按 Flash 價格計費;若 V4-Pro 當初照原計畫導向,依定價頁數字,原本用 V4-Pro 的人費用會下降,回答卻會換成另一個模型。功能也不同:價格頁標示 deepseek-flash 支援圖像理解、deepseek-v4-pro 不支援。付月費使用第三方工具的人,方案價格是否跟著變,要看各工具自己的說明。

所謂固定版本,是指工具指定一個不會悄悄更換的模型版本,讓行為比較可預期。DeepSeek 價格頁把模型名稱與實際版本分開列出,但沒有說明能否用帶日期的版本名呼叫;8 月 13 日的更新日誌也寫,沿用 deepseek-v4-pro 這個名稱就會用到最新版本。自己管理工具的人,可以記下模型名、版本與查核日期,並定期查看更新日誌。

使用中國廠商服務前,自己要讀的條款

透過 DeepSeek 官方 API 或 App 使用時,輸入的內容會送到 DeepSeek 的服務處理。資料如何保存、存放在哪裡、是否用於改善服務,請閱讀 DeepSeek 官方隱私政策與服務條款,本文不代為解讀。公司若要把內部資料送進任何外部 服務,不論廠商來自哪個國家,都應先確認內部的資料規範是否允許。

間接使用時要多問一層。第三方工具可能直接串接 DeepSeek 官方 API,也可能使用其他雲端平台代管的模型,兩者適用的條款不同。可以在工具的說明頁或隱私政策裡找「模型供應商」「資料傳輸」之類的段落;找不到答案之前,不要先把身分證字號、客戶名單或未公開的合約貼進去。

提供另一種選擇:模型卡採 MIT 授權,機構可以在自己的環境部署,資料不必送往 DeepSeek 的 API。不過自行部署要承擔硬體、維運與資料管理,這些取捨在本站 Qwen3.5 開放權重那篇已有說明。

最新旅遊情報攻略

資料來源

生活分享