DeepSeek(深度求索)新模型上線後,原本用 Pro 的工作也準備換引擎。官方 9 月 10 日推出 V4.1 Flash,支援原生圖片理解;台灣時間 9 月 14 日中午 12 點起,透過 API(應用程式介面)呼叫舊 V4 Pro 的請求,將自動改由 V4.1 Flash 處理並按新費率計價,直到未來 V4.1 Pro 推出。

新模型名稱是「deepseek-flash」。舊 V4 Flash 與 V4 Flash Vision Exp 已退場,原有名稱暫時保留轉接功能。開發者沿用舊名稱仍能呼叫服務,但實際處理工作的模型已經改變,固定格式輸出、工具操作與既有提示詞,都值得在新模型上跑過一次。

離峰半價,先看自己的工作何時執行

以每百萬 token(模型的計價單位)計算,新 Flash 尖峰輸入未命中快取為 0.30 美元、命中快取為 0.006 美元,輸出為 1.20 美元;離峰分別為 0.15、0.003 與 0.60 美元。重複使用的前文若命中快取,會採較低的輸入費率。

官方尖峰時段換算台灣時間,是週一至週五的 09:00–12:00 與 14:00–18:00,其餘時段依費率頁列為離峰。能晚點處理的批次摘要、資料整理,排在離峰就有直接的單價差;當下必須回覆的服務,則按尖峰成本估算較實際。

DeepSeek V4.1 Flash 尖峰與離峰 API 費率
圖中時段採 UTC;台灣尖峰為平日 09:00–12:00、14:00–18:00。

這次也換了模型架構。V4.1 Flash 共有 5,520 億參數,採 MoE(混合專家)設計,輸入與輸出分別啟用約 80 億及 160 億參數。官方表示,新快取設計相較前代只需四分之一的高頻寬記憶體、八分之一的固態硬碟空間,並宣稱多項評測超越 V4 Pro。

對使用者來說,眼前最直接的改變是模型轉接與帳單。費率下降後仍要看一件工作用了多少輸出、重試幾次;把相同任務的完成品質與總費用一起比較,才知道這次換模型究竟省了多少。

資料來源:DeepSeek V4.1 Flash 正式公告官方模型與費率模型名稱與轉接安排

← 返回研製所首頁