如何在 Glarity 使用 DeepSeek V4.1 Flash:9 月 10 日到期的內測模型,4 步接好

把 DeepSeek 目前最快的模型 deepseek-v4.1-flash-expires-on-0910 接上 Glarity:只改一個模型 ID,費率同 V4 Flash,9 月 10 日到期,想試要趁今天。

DeepSeek 現在最快的模型,同時也是最短命的。DeepSeek V4.1 Flash 在 2026 年 9 月 8 日以 deepseek-v4.1-flash-expires-on-0910 這個 ID 悄悄出現在 DeepSeek 的 API 裡——一個把到期日期直接寫進名字的內測版本。如果你已經在 Glarity 裡用著 DeepSeek 的金鑰,接上它只需改一個欄位:金鑰和 API 主機原封不動,在 Custom Model 填入內測 ID 即可。不需要新端點、沒有候補名單、也不用開新控制台,費率與 deepseek-v4-flash 完全相同。內測預計 9 月 10 日左右下線,想試的話,今天就是那一天。

DeepSeek 公開了什麼(以及沒公開什麼)

9 月 8 日,DeepSeek 團隊把這條內測訊息發到官方社群群組,當天上午被轉貼到 Hacker News 的這段公告,就是目前全部的官方紀錄:

DeepSeek V4.1 Flash is now available for internal beta testing. It uses a new model architecture, with native multimodal support, stronger capabilities, faster speed, and lower cost. Keep the base_url unchanged and set the model name to deepseek-v4.1-flash-expires-on-0910 to use it. Pricing is currently the same as deepseek-v4-flash, with an account-level rate limit of 20 concurrent requests.

模型卡、技術報告、更新日誌都還沒有。截至今天,DeepSeek 官方模型與定價頁上列著的仍然只有 deepseek-v4-flashdeepseek-v4-prodeepseek-v4-flash-vision-exp 三個模型。所以下面的內容也請用 DeepSeek 自己的姿態來讀:官方說法來自那段公告,速度數字來自首日開發者的實測,而這一切,都要靠你自己這兩天的測試來驗證。

事實速覽

項目

模型 ID

deepseek-v4.1-flash-expires-on-0910

狀態

內測——正式版之前的「中間版本」檢查點

公開時間

2026 年 9 月 8 日,經 DeepSeek 官方社群群組

到期

2026 年 9 月 10 日——ID 裡寫著,預計屆時下線

架構

全新模型結構(官方表述),讀起來是重新預訓練而非訓練後微調

多模態

基礎模型原生支援圖像+文字輸入(8 月 21 日的 vision 模型是在文字模型上外掛視覺編碼器)

脈絡視窗

未公布。沒有任何數字,Glarity 的設定先保守填

費率

deepseek-v4-flash 同一費率表(見下)

速率限制

每帳戶並發 20 個請求(deepseek-v4-flash 為 2,500)

執行位置

DeepSeek 自家 API——base URL 與金鑰都不變

四步接上

你需要的只是一個 DeepSeek 帳戶:在 platform.deepseek.com(DeepSeek 官方平台)新建或重用一組 API 金鑰,用量直接計入該帳戶。

  1. 開啟 Glarity → 設定 → 一般,捲動到 Connect to AI for quick Glarity summaries and translations,選擇 「OpenAI API key」——也就是「支援任何 AI 供應商的自訂金鑰」的那一項。
  2. 把 DeepSeek 的 API 金鑰貼進 API Key 欄位。
  3. Model——在下拉選單選 Custom Model,一字不差地輸入 deepseek-v4.1-flash-expires-on-0910,包括其中的兩個點。這個 ID 不會出現在下拉選單裡:它是隱藏內測,Hacker News 上的首日測試者也都得手動鍵入。
  4. 核對三個不用動的欄位——API Host https://api.deepseek.comAPI Path /v1/chat/completionsModel Context Window 204800 tokens——Temperature 設為 0.5(要逐字直譯就降到 0.2),按 Test 驗證,再按 Save

DeepSeek 明說「base_url 保持不變」,所以這個內測有意重用了 deepseek-v4-flash 的全部接線。如果你已經照我們之前的 DeepSeek V4 Flash 設定指南設定過,現在只需改第 3 步;之後想換回 deepseek-v4-flash,也還是同一個欄位的事。

費用:直接套用 V4 Flash 費率表

內測按 DeepSeek 官方定價頁deepseek-v4-flash 的現行費率計費。DeepSeek 自 2026 年 8 月 16 日起實施尖離峰分時計價,其餘時段按半價的離峰計(尖峰:週一至週五 UTC 01:00–04:00 和 06:00–10:00)。

每 1M tokens

離峰

尖峰

輸入(快取命中)

$0.007

$0.014

輸入(快取未命中)

$0.22

$0.44

輸出

$0.66

$1.32

換成 Glarity 的真實情境,按離峰估算:

任務

輸入 tokens

輸出 tokens

V4.1 Flash(V4 Flash 費率)

同樣任務用 V4 Pro

1 小時 YouTube 影片 → 總結+追問

約 12,000

約 1,000

約 $0.003

約 $0.010

30 頁報告 → 全文總結

約 40,000

約 1,500

約 $0.010

約 $0.029

整本書的文件 → 分章筆記

約 200,000

約 3,000

約 $0.046

約 $0.138

儲值之前先給你一個誠實的提醒:「更低成本」說的是效率,不是降價。token 單價沒變,變的是模型生成快得多。首日就有測試者眼睜睜看著餘額比在 V4 Flash 上同樣幾分鐘掉得明顯更快,因為這個內測燒 token 的速度更快。每個任務的真實成本是否真的下降,取決於它能否用更少的 token、更少的重試完成任務——而這正是你該親手測量的東西。

今天值得測什麼(以及首日傳出的數字)

速度是主角,但目前流傳的所有速度數據都來自社群實測。隨內測一起被轉發的那位研究者的 X 貼文測得平均解碼速度約 350 token/秒;首日開發者回報長文字生成約 420 token/秒,峰值超過 500,其中被廣泛轉發的一次測試在不到三分鐘內生成了超過 71,000 個 token。作為對照,Artificial Analysis 測得公開的 DeepSeek V4 Flash 0731 端點約為 128 token/秒——照首日回報看,吞吐量的躍升至少 3 倍起跳。與 8 月 21 日 vision 模型的同任務比較差距更大:SVG 程式碼生成任務約快 6 倍,49K token 長脈絡檢索約 5.2 倍,大型 SQL 生成優化任務約 5 倍。但這些都不是官方數字:它們是條件不受控的個人測量,DeepSeek 自己沒發布任何速度基準,而且早期測試中最快的候選版本,未必就是最終發佈的那一個。

品質方面沒有任何公開基準。只有一個耐人尋味的細節:DeepSeek 附在內測裡的回饋問卷直接問測試者,V4.1 Flash「能否完全取代線上的 DeepSeek V4 Pro」。這是 DeepSeek 自己向用戶拋出的問題,不是對模型能力的官方斷言——它是個懸而未決的問題,不是規格。

用你自己的 48 小時來測。在 Glarity 裡,這個內測是低風險實驗:總結一份一小時長的課程字幕,翻譯一篇長文,追問幾輪,然後用 deepseek-v4-flash 把同樣的任務重跑一遍做比較。Glarity 的自訂連結送給模型的是網頁和字幕的文字;V4.1 原生的圖像輸入要在直接呼叫 API 並附帶檔案時才用得到,擴充功能的網頁處理流程不走這條線。

依賴它之前,先記住這些

  • 它會到期。ID 寫著 expires-on-0910;從 9 月 8 日上線算起大約只有兩天窗口,9 月 10 日左右預計下線。
  • 每帳戶並發 20 個請求。一個人瀏覽足夠;團隊共用的工作流別指望它。
  • 規格未公布。參數量、脈絡長度、完整輸入模態清單,一個都還沒發布。
  • 別接生產環境。誰都不該把固定工作流指向一個「排定停止回應」的模型 ID。內測歸內測,日常仍用 deepseek-v4-flash
  • 正式版「很快」會來——知情者的預期和兩天制的內測窗口都指向這一點,但尚未確認。正式版發佈後,這套設定照舊適用:換個模型 ID(或下拉選單裡出現就直接選)。

連不上時

症狀

可能原因

解法

Test 回傳 401

金鑰錯誤,或貼上時帶了尾端空格

到 platform.deepseek.com 重新產生金鑰,覆蓋貼上

「Model not found」/模型不存在

ID 打錯了——或者內測已到期

一字不差輸入 deepseek-v4.1-flash-expires-on-0910,包括兩個點;9 月 10 日之後先切回 deepseek-v4-flash 等正式版

9 月 10 日前仍報同樣錯誤

下拉選單裡本來就不會有它——只能手輸

按第 3 步,Custom Model + 手動鍵入

429 / 觸發限流

每帳戶並發上限 20

等幾秒;避免同時跑總結和翻譯

Test 回報連線錯誤

其他供應商的設定殘留在主機或路徑裡

API Host https://api.deepseek.comAPI Path /v1/chat/completions

餘額掉得比平時快得多

高 token 吞吐——只是快了 3 倍以上,單價沒降

在離峰時段測試,並用「每個完成任務消耗的 token」對比 V4 Flash

FAQ

DeepSeek V4.1 Flash 免費嗎?不免費。內測按 deepseek-v4-flash 費率計費:離峰輸入(快取未命中)每 1M $0.22、輸出每 1M $0.66,尖峰翻倍。沒有免費窗口期。

9 月 10 日之後內測還能用嗎?按公告和 ID 本身的資訊:不能——測試版預計屆時自動到期下線。把模型欄位改回 deepseek-v4-flash,等正式版發佈。

需要新的 DeepSeek 帳戶或新金鑰嗎?不需要。它跑在同一個 API、同一組金鑰、同一個平台帳戶上,變的只有模型名稱。

為什麼 Glarity 的模型下拉選單裡找不到它?它是隱藏的內部測試,從未進入任何公開模型清單。Custom Model 加手動鍵入完整 ID,是唯一的入口。

日常的 Glarity 使用應該切到它嗎?不適合當日常主力。用這兩天窗口去比較品質與每個任務的真實成本就夠了;有 20 並發限制,又自帶到期時間,它是測試用,不是日用款。

V4.1 Flash 能在 Glarity 擴充功能裡讀圖嗎? DeepSeek 稱其原生支援圖像+文字輸入,所以直接呼叫 API 並附帶檔案時可以。但 Glarity 的自訂模型連結總結和翻譯的是網頁與字幕的文字;想試視覺能力,請直接呼叫 API 並附上圖片檔案。

怎麼換回穩定的 DeepSeek 模型?只改一個欄位:把 Model 改回 deepseek-v4-flash,金鑰、主機、路徑全部不動。端點、溫度、脈絡視窗照常有效。

Glarity 編輯部。Glarity 編輯部專注於 AI 搜尋、影片摘要與瀏覽器效率技巧。

Glarity 是免費的瀏覽器擴充功能,支援 AI 搜尋與 YouTube 影片摘要,可在 glarity.app 取得。