生活分享
DeepSeek-V4.1-Flash 上線、V4-Pro 去留有兩種說法:模型換手時該注意什麼
DeepSeek 在 2026 年 9 月 10 日推出 V4.1-Flash,V4-Flash 舊模型名暫時導向新模型;發布公告寫 V4-Pro 自 9 月 14 日起改導向,更新日誌與價格頁則寫 9 月 14 日之後繼續提供。本文依官方頁面整理兩種說法的先後與查核時的現況,並說明透過第三方工具間接使用的人,如何察覺模型換手、看懂價格與隱私條款。
更新日期: 閱讀時間約 7 分鐘

2026 年 9 月 10 日,DeepSeek 在官方 API 文件發布 DeepSeek-V4.1-Flash,說明它是新架構系列中最小的模型,具備原生的圖像理解能力,呼叫時的模型名稱是 deepseek-flash。前一代 V4-Flash 與 V4-Flash-Vision-Exp 同時退役,舊名暫時導向新模型。公告也寫 V4-Pro 的請求將自 9 月 14 日起改導向 V4.1-Flash,但查核時官方更新日誌與價格頁寫的是 9 月 14 日之後繼續提供 V4-Pro。
本文於 2026 年 9 月 15 日查核。這次公告說明的是 API 的變動,DeepSeek App 與網頁版目前用哪個模型,官方這幾頁沒有交代,本文不做推定。本站沒有實際呼叫或評測模型與代理評測(Evals)是什麼模型與代理評測把任務、輸入、執行條件和成功標準固定下來,觀察 AI 是否真的符合需求。本文用志工排班助理為例,說明案例、重複嘗試、評分器與外部結果的差別,比較程式、人類與模型評分,解釋為何單次答對和平均高分都不足以證明可靠。讀完能建立一組小而實用的評測,讓提示詞或模型更新有可比較的證據,也能保留尚未驗證的限制。閱讀全文這個模型,文中的能力與評測說法都是 DeepSeek 自己的表述;生活與工作情境則是編輯設計的例子。
V4.1-Flash 的公告寫了什麼
DeepSeek 表示,V4.1-Flash 是參數模型參數(Model Parameters)是什麼模型參數是訓練時調整、用來把輸入轉成輸出的數值,例如權重與偏差。本文用簡單算式示例說明參數如何影響預測,區分模型參數、訓練超參數、提示詞與生成設定,並解釋參數量、數值精度和啟用參數為何是不同指標。讀完能更準確閱讀模型規格,理解參數增加不等於知識逐條增加,也不代表每次聊天都在重新訓練模型。閱讀全文規模 552B 的混合專家(MoE混合專家模型(Mixture of Experts)是什麼混合專家模型透過路由器,讓輸入在某些層只使用部分專家網路,以不同方式安排模型容量與運算。本文以檔案分類的小型路由示意,說明總參數、啟用參數、專家與路由的角色,解釋它為何不是多個聊天代理開會,也不能只用啟用參數推算記憶體或品質。讀完能更準確閱讀 MoE 模型規格,理解速度、部署、訓練穩定性與負載分配的取捨。閱讀全文)模型,採用新的 Causal Encoder-Decoder 架構,讀取輸入時啟用 8B 參數、產生輸出時啟用 16B,官方稱之為輸入與輸出不對稱。公告也說,新的預訓練預訓練(Pretraining):模型的基礎能力從哪裡來預訓練是在特定任務調整之前,讓模型從大量資料學得可重用表示與規律的階段。本文用下一個 token 預測和遮住內容再還原的例子說明資料、目標與參數更新,區分預訓練、微調和使用時提供上下文,也解釋為什麼學過文字不等於記得來源或保證事實正確。讀完能理解基礎模型的能力來源,以及訓練資料品質和評估汙染的影響。閱讀全文方式加上更大規模的強化學習後訓練,讓它在基準測試基準測試(Benchmark)是什麼基準測試用共同題目、執行設定與評分方法比較系統,是理解 AI 能力的一種參考,不能直接當成所有用途的排名。本文以圖書館資料整理需求為例,說明題型、指標、提示詞、工具與測試汙染如何影響分數,解釋平均值與排名變動的限制。讀完能閱讀基準的適用範圍,判斷不同報告是否真的可比,並把公開成績接到自己的實際任務驗證。閱讀全文上超過包括 DeepSeek-V4-Pro 在內的旗艦模型。這是廠商說法,模型卡對照表也有它落後其他廠商模型的項目,本站沒有重測。
另一個重點是快取。模型處理長對話時會暫存中間計算資料,稱為 KV 快取。公告說與上一代相比,V4.1-Flash 的 KV 快取對 HBM 的需求降到四分之一、對 SSD 的需求降到八分之一,並表示架構更有效率,因此調降 API 價格。
權重方面,公告附上官方 Hugging Face 頁面。模型卡寫明儲存庫與模型權重採用 MIT 授權,支援最長一百萬 token 的上下文,能直接處理圖片與文字並輸出文字。開放下載不代表一般電腦跑得動:模型卡連結的推論範例以 8 路模型平行的設定執行。發布公告另外邀請規劃以兩千張 GPU 加儲存叢集大規模部署的單位聯絡 DeepSeek。
舊模型名改導向、V4-Pro 去留:兩種說法的先後
第一種說法來自 9 月 10 日的發布公告。它說多方測試顯示 V4.1-Flash 在效能、費用、速度與總用時上都勝過 V4-Pro,因此計畫讓 V4-Pro 退場:自 2026 年 9 月 14 日 UTC 04:00(台灣時間中午 12 點)起,所有 deepseek-v4-pro 的請求改由 V4.1-Flash 處理並按 V4.1-Flash 的價格計費,直到 V4.1-Pro 推出。
第二種說法在更新日誌與價格頁。查核當天,更新日誌 9 月 10 日那一條與價格頁的註解寫著:因應使用者需求,DeepSeek 決定在 2026 年 9 月 14 日之後繼續提供 V4-Pro 的 API 服務,計費方式不變,若有變動會另行通知。價格頁上 deepseek-v4-pro 對應的版本是 DeepSeek-V4-Pro-0813。從「決定繼續提供」的措辭看是導向計畫之後的決定,但頁面未標示日期,API 文件新聞列表也沒有另發公告。
9 月 15 日查核時,英文與簡體中文的發布公告頁仍保留原本「9 月 14 日起改導向」的文字。只讀公告的人,可能以為 V4-Pro 已被取代;依更新日誌與價格頁的說明,deepseek-v4-pro 在 9 月 14 日之後繼續提供,V4-Flash 的兩個舊名則由 V4.1-Flash 服務並以 Flash 價格計費。
| 模型名稱 | 實際服務的模型 | 計價 |
|---|---|---|
| deepseek-flash | DeepSeek-V4.1-Flash | Flash 價格 |
| deepseek-v4-flash | V4.1-Flash(原模型已退役) | Flash 價格 |
| deepseek-v4-flash-vision-exp | V4.1-Flash(原模型已退役) | Flash 價格 |
| deepseek-v4-pro | DeepSeek-V4-Pro-0813 | 計費方式不變 |
沒有直接呼叫 API 的人,為什麼也會受影響
多數台灣讀者不會自己呼叫 DeepSeek API,但可能間接用到它。有些翻譯外掛、寫作 App 或公司內部的問答工具,會在設定裡填入某個 DeepSeek 模型名,再把使用者的輸入轉送過去;DeepSeek 公告也點名 WorkBuddy(含 CodeBuddy)與 OpenCode 已全面支援 V4.1-Flash。服務商把舊名導向新模型時,工具設定不必改,背後回答的模型卻已經換了。
這次的例子很清楚:deepseek-v4-flash 名稱裡寫著 V4,實際服務的卻是 V4.1-Flash。更新日誌也記載,4 月 24 日推出 V4 時,deepseek-chat 與 deepseek-reasoner 兩個舊名在過渡期間分別指向 deepseek-v4-flash 的非思考與思考模式,並預告 2026 年 7 月 24 日停用。
以編輯設計的情境為例:一位上班族每天用公司內部的摘要工具整理會議紀錄,9 月 10 日之後發現摘要變長、分段方式也不同。可以先查工具的更新說明或詢問管理者,確認後端是否串接 DeepSeek、填的是哪個模型名。回答風格、長度、輸出格式或看圖能力突然改變,都是值得問一句的訊號;不一定代表變差,但輸出若要貼進正式文件,最好重新抽樣檢查。
價格、尖峰時段與固定版本的意義
API 價格只簡單帶過。依定價頁,deepseek-flash 在尖峰時段每百萬 token 的輸入(未命中快取)為 0.3 美元、輸出為 1.2 美元;deepseek-v4-pro 分別是 1.32 與 3.96 美元。離峰價格是尖峰的一半,尖峰時段為週一到週五 UTC 01:00 至 04:00 與 06:00 至 10:00,即台灣時間上午 9 點到 12 點、下午 2 點到 6 點。公告寫新價格自 9 月 10 日 UTC 04:00 生效。
舊名導向新模型時,帳單也會跟著變。價格頁說 V4-Flash 舊名的請求改按 Flash 價格計費;若 V4-Pro 當初照原計畫導向,依定價頁數字,原本用 V4-Pro 的人費用會下降,回答卻會換成另一個模型。功能也不同:價格頁標示 deepseek-flash 支援圖像理解、deepseek-v4-pro 不支援。付月費使用第三方工具的人,方案價格是否跟著變,要看各工具自己的說明。
所謂固定版本,是指工具指定一個不會悄悄更換的模型版本,讓行為比較可預期。DeepSeek 價格頁把模型名稱與實際版本分開列出,但沒有說明能否用帶日期的版本名呼叫;8 月 13 日的更新日誌也寫,沿用 deepseek-v4-pro 這個名稱就會用到最新版本。自己管理工具的人,可以記下模型名、版本與查核日期,並定期查看更新日誌。
使用中國廠商服務前,自己要讀的條款
透過 DeepSeek 官方 API 或 App 使用時,輸入的內容會送到 DeepSeek 的服務處理。資料如何保存、存放在哪裡、是否用於改善服務,請閱讀 DeepSeek 官方隱私政策與服務條款,本文不代為解讀。公司若要把內部資料送進任何外部 AI人工智慧(Artificial Intelligence)是什麼人工智慧是涵蓋多種技術與應用的總稱,不等於聊天機器人,也不必一定會產生文字。本文從 OECD 的系統定義出發,以照片分類和社區資源推薦為例,說明輸入、推導、輸出與人的目標如何連結,整理它與機器學習、深度學習和生成式 AI 的關係。讀完能用具體問題判斷一項 AI 功能在做什麼,並分辨能力、自治程度與可信度。閱讀全文 服務,不論廠商來自哪個國家,都應先確認內部的資料規範是否允許。
間接使用時要多問一層。第三方工具可能直接串接 DeepSeek 官方 API,也可能使用其他雲端平台代管的模型,兩者適用的條款不同。可以在工具的說明頁或隱私政策裡找「模型供應商」「資料傳輸」之類的段落;找不到答案之前,不要先把身分證字號、客戶名單或未公開的合約貼進去。
開放權重開放權重(Open Weights):能下載模型,還要確認什麼開放權重通常表示模型的已訓練參數可取得,讓使用者有機會自行部署或調整,但不等於訓練資料與程式都公開。本文用本機筆記摘要示範權重、架構、tokenizer 和推論程式的分工,區分下載、可修改、商業使用與完整開源,也解釋為什麼本機執行不自動保證隱私。讀完能檢查模型版本、授權文件、硬體需求和來源完整性。閱讀全文提供另一種選擇:模型卡採 MIT 授權,機構可以在自己的環境部署,資料不必送往 DeepSeek 的 API。不過自行部署要承擔硬體、維運與資料管理,這些取捨在本站 Qwen3.5 開放權重那篇已有說明。
2026 年 AI 新聞總整理:1 月至 9 月的重點與生活應用2026 年 AI 新聞總整理:1 月至 9 月的重點與生活應用從 2026 年 1 月至 9 月,依月份整理 AI 重要新聞,連到完整解析,多數另有簡體中文、英文、日文與韓文版。涵蓋模型、工作工具、創作、費用與透明度,說明事件背景、生活用途與開放限制。閱讀全文
Qwen3.5 開放權重:可下載模型,與能在自己電腦運作差在哪?Qwen3.5 開放權重:可下載模型,與能在自己電腦運作差在哪?回顧 2026-02-16 發布的 Qwen3.5-397B-A17B 開放權重模型,釐清開放權重、硬體負擔與雲端託管差異,提供中小企業務實評估指引。閱讀全文
同主題延伸閱讀
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起價 4,999 美元,兩台可串接成 128GB
NVIDIA 於 2026 年 10 月 2 日宣布,個人 AI 電腦 DGX Spark 新增較平價的 64GB 記憶體版本,10 月 23 日起由 Acer、ASUS 等六家廠商供應,主要對象是想在自己機器上執行 AI 模型的開發者與研究人員。以下整理 NVIDIA 公布的規格、雙機串接說法,以及對一般讀者的意義。
生活分享
Google Cloud 宣布 Spanner queues 正式推出:把訊息佇列放進資料庫交易,瞄準 AI 代理可靠性
Google Cloud 宣布 Spanner queues 正式推出,讓訊息建立成為資料庫交易的一部分,目標是解決 AI 代理「狀態」與「動作」不同步的問題。本文整理官方說法、主要功能與對一般讀者的意義。
生活分享
GPT-6.1 Sol 推出:新一版 Sol 上 API、Codex 與 ChatGPT Work,Chat 裡沒有
OpenAI 在 2026 年 9 月 29 日推出 GPT-6.1 Sol,API 名稱是 gpt-6.1-sol:Plus、Pro、Business、Enterprise、Edu 方案的 Codex 與 ChatGPT Work 在首發推出範圍內,Enterprise 與 Edu 要管理員啟用,Free 與 Go 首發不含,Chat 裡沒有(2026 年 9 月查證)。
生活分享
Claude Sonnet 5.5 推出:牌價與 Sonnet 5 相同,API、雲端平台與 Claude.ai 都能用
Anthropic 在 2026 年 9 月 28 日推出 Claude Sonnet 5.5,API 牌價與 Sonnet 5 相同(每百萬 tokens 輸入 2 美元、輸出 10 美元);Claude.ai、API 與多個雲端平台可用,較高風險的資安請求會退回 Sonnet 5 處理(2026 年 9 月查證)。
引用本文的文章
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算
資料來源
- DeepSeek:DeepSeek-V4.1-Flash 發布公告 · 查證日期:
- DeepSeek:API 更新日誌(Change Log) · 查證日期:
- DeepSeek:模型與價格 · 查證日期:
- DeepSeek:DeepSeek-V4.1-Flash 官方模型卡(Hugging Face) · 查證日期: