DeepSeek 現在最快的模型,同時也是最短命的。DeepSeek V4.1 Flash 在 2026 年 9 月 8 日以 deepseek-v4.1-flash-expires-on-0910 這個 ID 悄悄出現在 DeepSeek 的 API 裡——一個把到期日期直接寫進名字的內測版本。如果你已經在 Glarity 裡用著 DeepSeek 的金鑰,接上它只需改一個欄位:金鑰和 API 主機原封不動,在 Custom Model 填入內測 ID 即可。不需要新端點、沒有候補名單、也不用開新控制台,費率與 deepseek-v4-flash 完全相同。內測預計 9 月 10 日左右下線,想試的話,今天就是那一天。
DeepSeek 公開了什麼(以及沒公開什麼)
9 月 8 日,DeepSeek 團隊把這條內測訊息發到官方社群群組,當天上午被轉貼到 Hacker News 的這段公告,就是目前全部的官方紀錄:
DeepSeek V4.1 Flash is now available for internal beta testing. It uses a new model architecture, with native multimodal support, stronger capabilities, faster speed, and lower cost. Keep thebase_urlunchanged and set the model name todeepseek-v4.1-flash-expires-on-0910to use it. Pricing is currently the same asdeepseek-v4-flash, with an account-level rate limit of 20 concurrent requests.
模型卡、技術報告、更新日誌都還沒有。截至今天,DeepSeek 官方模型與定價頁上列著的仍然只有 deepseek-v4-flash、deepseek-v4-pro 和 deepseek-v4-flash-vision-exp 三個模型。所以下面的內容也請用 DeepSeek 自己的姿態來讀:官方說法來自那段公告,速度數字來自首日開發者的實測,而這一切,都要靠你自己這兩天的測試來驗證。
事實速覽
項目 | 值 |
|---|---|
模型 ID |
|
狀態 | 內測——正式版之前的「中間版本」檢查點 |
公開時間 | 2026 年 9 月 8 日,經 DeepSeek 官方社群群組 |
到期 | 2026 年 9 月 10 日——ID 裡寫著,預計屆時下線 |
架構 | 全新模型結構(官方表述),讀起來是重新預訓練而非訓練後微調 |
多模態 | 基礎模型原生支援圖像+文字輸入(8 月 21 日的 vision 模型是在文字模型上外掛視覺編碼器) |
脈絡視窗 | 未公布。沒有任何數字,Glarity 的設定先保守填 |
費率 | 與 |
速率限制 | 每帳戶並發 20 個請求( |
執行位置 | DeepSeek 自家 API——base URL 與金鑰都不變 |
四步接上
你需要的只是一個 DeepSeek 帳戶:在 platform.deepseek.com(DeepSeek 官方平台)新建或重用一組 API 金鑰,用量直接計入該帳戶。
- 開啟 Glarity → 設定 → 一般,捲動到 Connect to AI for quick Glarity summaries and translations,選擇 「OpenAI API key」——也就是「支援任何 AI 供應商的自訂金鑰」的那一項。
- 把 DeepSeek 的 API 金鑰貼進 API Key 欄位。
- Model——在下拉選單選 Custom Model,一字不差地輸入
deepseek-v4.1-flash-expires-on-0910,包括其中的兩個點。這個 ID 不會出現在下拉選單裡:它是隱藏內測,Hacker News 上的首日測試者也都得手動鍵入。 - 核對三個不用動的欄位——API Host
https://api.deepseek.com、API Path/v1/chat/completions、Model Context Window204800tokens——Temperature 設為 0.5(要逐字直譯就降到 0.2),按 Test 驗證,再按 Save。
DeepSeek 明說「base_url 保持不變」,所以這個內測有意重用了 deepseek-v4-flash 的全部接線。如果你已經照我們之前的 DeepSeek V4 Flash 設定指南設定過,現在只需改第 3 步;之後想換回 deepseek-v4-flash,也還是同一個欄位的事。
費用:直接套用 V4 Flash 費率表
內測按 DeepSeek 官方定價頁上 deepseek-v4-flash 的現行費率計費。DeepSeek 自 2026 年 8 月 16 日起實施尖離峰分時計價,其餘時段按半價的離峰計(尖峰:週一至週五 UTC 01:00–04:00 和 06:00–10:00)。
每 1M tokens | 離峰 | 尖峰 |
|---|---|---|
輸入(快取命中) | $0.007 | $0.014 |
輸入(快取未命中) | $0.22 | $0.44 |
輸出 | $0.66 | $1.32 |
換成 Glarity 的真實情境,按離峰估算:
任務 | 輸入 tokens | 輸出 tokens | V4.1 Flash(V4 Flash 費率) | 同樣任務用 V4 Pro |
|---|---|---|---|---|
1 小時 YouTube 影片 → 總結+追問 | 約 12,000 | 約 1,000 | 約 $0.003 | 約 $0.010 |
30 頁報告 → 全文總結 | 約 40,000 | 約 1,500 | 約 $0.010 | 約 $0.029 |
整本書的文件 → 分章筆記 | 約 200,000 | 約 3,000 | 約 $0.046 | 約 $0.138 |
儲值之前先給你一個誠實的提醒:「更低成本」說的是效率,不是降價。token 單價沒變,變的是模型生成快得多。首日就有測試者眼睜睜看著餘額比在 V4 Flash 上同樣幾分鐘掉得明顯更快,因為這個內測燒 token 的速度更快。每個任務的真實成本是否真的下降,取決於它能否用更少的 token、更少的重試完成任務——而這正是你該親手測量的東西。
今天值得測什麼(以及首日傳出的數字)
速度是主角,但目前流傳的所有速度數據都來自社群實測。隨內測一起被轉發的那位研究者的 X 貼文測得平均解碼速度約 350 token/秒;首日開發者回報長文字生成約 420 token/秒,峰值超過 500,其中被廣泛轉發的一次測試在不到三分鐘內生成了超過 71,000 個 token。作為對照,Artificial Analysis 測得公開的 DeepSeek V4 Flash 0731 端點約為 128 token/秒——照首日回報看,吞吐量的躍升至少 3 倍起跳。與 8 月 21 日 vision 模型的同任務比較差距更大:SVG 程式碼生成任務約快 6 倍,49K token 長脈絡檢索約 5.2 倍,大型 SQL 生成優化任務約 5 倍。但這些都不是官方數字:它們是條件不受控的個人測量,DeepSeek 自己沒發布任何速度基準,而且早期測試中最快的候選版本,未必就是最終發佈的那一個。
品質方面沒有任何公開基準。只有一個耐人尋味的細節:DeepSeek 附在內測裡的回饋問卷直接問測試者,V4.1 Flash「能否完全取代線上的 DeepSeek V4 Pro」。這是 DeepSeek 自己向用戶拋出的問題,不是對模型能力的官方斷言——它是個懸而未決的問題,不是規格。
用你自己的 48 小時來測。在 Glarity 裡,這個內測是低風險實驗:總結一份一小時長的課程字幕,翻譯一篇長文,追問幾輪,然後用 deepseek-v4-flash 把同樣的任務重跑一遍做比較。Glarity 的自訂連結送給模型的是網頁和字幕的文字;V4.1 原生的圖像輸入要在直接呼叫 API 並附帶檔案時才用得到,擴充功能的網頁處理流程不走這條線。
依賴它之前,先記住這些
- 它會到期。ID 寫著
expires-on-0910;從 9 月 8 日上線算起大約只有兩天窗口,9 月 10 日左右預計下線。 - 每帳戶並發 20 個請求。一個人瀏覽足夠;團隊共用的工作流別指望它。
- 規格未公布。參數量、脈絡長度、完整輸入模態清單,一個都還沒發布。
- 別接生產環境。誰都不該把固定工作流指向一個「排定停止回應」的模型 ID。內測歸內測,日常仍用
deepseek-v4-flash。 - 正式版「很快」會來——知情者的預期和兩天制的內測窗口都指向這一點,但尚未確認。正式版發佈後,這套設定照舊適用:換個模型 ID(或下拉選單裡出現就直接選)。
連不上時
症狀 | 可能原因 | 解法 |
|---|---|---|
Test 回傳 401 | 金鑰錯誤,或貼上時帶了尾端空格 | 到 platform.deepseek.com 重新產生金鑰,覆蓋貼上 |
「Model not found」/模型不存在 | ID 打錯了——或者內測已到期 | 一字不差輸入 |
9 月 10 日前仍報同樣錯誤 | 下拉選單裡本來就不會有它——只能手輸 | 按第 3 步,Custom Model + 手動鍵入 |
429 / 觸發限流 | 每帳戶並發上限 20 | 等幾秒;避免同時跑總結和翻譯 |
Test 回報連線錯誤 | 其他供應商的設定殘留在主機或路徑裡 | API Host |
餘額掉得比平時快得多 | 高 token 吞吐——只是快了 3 倍以上,單價沒降 | 在離峰時段測試,並用「每個完成任務消耗的 token」對比 V4 Flash |
FAQ
DeepSeek V4.1 Flash 免費嗎?不免費。內測按 deepseek-v4-flash 費率計費:離峰輸入(快取未命中)每 1M $0.22、輸出每 1M $0.66,尖峰翻倍。沒有免費窗口期。
9 月 10 日之後內測還能用嗎?按公告和 ID 本身的資訊:不能——測試版預計屆時自動到期下線。把模型欄位改回 deepseek-v4-flash,等正式版發佈。
需要新的 DeepSeek 帳戶或新金鑰嗎?不需要。它跑在同一個 API、同一組金鑰、同一個平台帳戶上,變的只有模型名稱。
為什麼 Glarity 的模型下拉選單裡找不到它?它是隱藏的內部測試,從未進入任何公開模型清單。Custom Model 加手動鍵入完整 ID,是唯一的入口。
日常的 Glarity 使用應該切到它嗎?不適合當日常主力。用這兩天窗口去比較品質與每個任務的真實成本就夠了;有 20 並發限制,又自帶到期時間,它是測試用,不是日用款。
V4.1 Flash 能在 Glarity 擴充功能裡讀圖嗎? DeepSeek 稱其原生支援圖像+文字輸入,所以直接呼叫 API 並附帶檔案時可以。但 Glarity 的自訂模型連結總結和翻譯的是網頁與字幕的文字;想試視覺能力,請直接呼叫 API 並附上圖片檔案。
怎麼換回穩定的 DeepSeek 模型?只改一個欄位:把 Model 改回 deepseek-v4-flash,金鑰、主機、路徑全部不動。端點、溫度、脈絡視窗照常有效。
Glarity 編輯部。Glarity 編輯部專注於 AI 搜尋、影片摘要與瀏覽器效率技巧。
Glarity 是免費的瀏覽器擴充功能,支援 AI 搜尋與 YouTube 影片摘要,可在 glarity.app 取得。



