如何在 Glarity 中使用 MiMo-V2.6-Pro-UltraSpeed:網頁翻譯、頁面摘要與 YouTube 影片摘要

透過 Glarity 的自訂模型設定接入小米 MiMo-V2.6-Pro-UltraSpeed,用於近乎即時的摘要與翻譯。

MiMo-V2.6-Pro-UltraSpeed 是 MiMo-V2.6-Pro 的高速推理模式:同樣的全模態輸入、100 萬 token 上下文與最大 12.8 萬 token 輸出,但專為輸出速度調校,小米官方表示相比標準版 Pro 最高可快 20 倍生成速度。Glarity 沒有把 MiMo 做成內建選項,不過設定面板的「自訂模型」欄位支援任何 OpenAI 相容的 /chat/completions 端點,小米的 API 正好符合這個形態。整個設定大約五分鐘,從設定 → 一般 → 連接 AI 開始。

為什麼選 MiMo-V2.6-Pro-UltraSpeed

UltraSpeed 是為那些等待回應時每一秒都很重要的場景而生的——例如你正在閱讀頁面時同步生成摘要,或需要接近即時地生成字幕。小米表示它比標準版 Pro 最高快 20 倍(這是官方給出的上限,不是每次請求都能保證的速度,實際提速取決於具體請求)。它保留了 Pro 的全部功能——深度思考、工具呼叫、串流輸出、網頁搜尋、結構化輸出、上下文快取——但代價是成本:UltraSpeed 的單價大約是標準 Pro 的 10 倍,速率限制也是依帳戶單獨設定,而非公開的統一數值。

開始前需要準備

  • 一個從小米 MiMo 控制台取得的 API 金鑰
  • 下面這些連接參數

Glarity 逐步設定

  1. 開啟 Glarity 擴充功能,前往設定 → 一般,捲動到「連接 AI 以取得快速的 Glarity 摘要與翻譯」區域。
  2. 將連接類型設為OpenAI API 金鑰。
  3. 把你的小米金鑰貼到API 金鑰欄位。
  4. 將模型設為自訂模型,輸入 mimo-v2.6-pro-ultraspeed。
  5. 將模型上下文視窗設為最接近100 萬的檔位。
  6. 將API 主機設為 https://api.xiaomimimo.com/v1。
  7. 將API 路徑設為 /chat/completions。
  8. 溫度日常使用設為 0.5(想要更忠實的摘要可降到 0.2),點擊測試確認收到快速回覆,再點擊儲存。

設定一覽

欄位

值

意義

連接類型

OpenAI API 金鑰

MiMo 的 API 採用 OpenAI 對話補全格式

API 金鑰

你的 MiMo 金鑰

從 MiMo 控制台產生

模型

自訂模型 → mimo-v2.6-pro-ultraspeed

官方模型 ID(注意 UltraSpeed 中的 S 是大寫)

模型上下文視窗

約 100 萬

與標準 Pro 相同的輸入上限

API 主機

https://api.xiaomimimo.com/v1

來自小米官方 API 文件的基礎位址

API 路徑

/chat/completions

標準 OpenAI 相容路由

溫度

0.5(或 0.2)

在自然表達與忠實輸出之間取得平衡

計價

根據小米官方定價頁面(2026 年 9 月 22 日更新),海外費率為每百萬 token:快取輸入 $0.036、非快取輸入 $4.35、輸出 $8.70——大約是標準 Pro 的 10 倍。中國大陸費率為每百萬 token ¥0.25 / ¥30 / ¥60。UltraSpeed 不提供批量計價檔位。這是速度比成本更重要時才該用的模型,日常大量摘要更適合用 MiMo-V2.6-Flash。

接入 UltraSpeed 後 Glarity 能做什麼

能力

目前的表現

翻譯

近乎即時地翻譯網頁文字或選取內容

頁面摘要

在時間敏感的閱讀場景中快速生成摘要

YouTube 摘要

快速生成影片逐字稿摘要

影片字幕

更快地生成並翻譯字幕,適合類即時的工作流程

快速郵件回覆

近乎即時地根據選取文字生成回覆

一鍵提示詞

用 UltraSpeed 而非預設模型執行你儲存的自訂提示詞

疑難排解

  • 401 / 未授權錯誤 —— API 金鑰無效或未儲存,重新貼上後點擊測試再儲存。
  • 「找不到模型」 —— 檢查是否精確輸入 mimo-v2.6-pro-ultraspeed(注意大寫 S)。
  • 費用高於預期 —— UltraSpeed 單價大約是標準 Pro 的 10 倍,時間不敏感的大量任務建議改用 Flash 或 Pro。
  • 超長輸入請求失敗 —— 上限是輸入 100 萬 token / 輸出 12.8 萬 token。
  • Glarity 仍在用舊模型 —— 只有測試成功並點擊儲存後設定才會生效。

常見問題

MiMo-V2.6-Pro-UltraSpeed 是 Glarity 官方支援的模型嗎?不是。本教學是透過 Glarity 通用的「自訂模型」設定接入的。

它到底能快多少?小米官方表示相比標準 Pro 最高可快 20 倍生成速度。這是官方給出的上限,不是每次請求都保證的數值,實際提速會因提示詞和負載不同而變化。

為什麼比 Flash 或 Pro 貴這麼多? UltraSpeed 用成本換取延遲:非快取輸入每百萬 token $4.35、輸出每百萬 token $8.70,大約是標準 Pro 的 10 倍,比 Flash 高得多。只在速度真正重要時使用它,而非日常批量摘要。

相比 Pro 會不會損失功能?不會。它保留了同樣的 100 萬 token 上下文、多模態輸入、深度思考、工具呼叫等功能。差異只在生成速度和價格,不在能力上。

什麼時候該用 Flash 代替?如果你每天要摘要很多頁面,而延遲不是關鍵因素,MiMo-V2.6-Flash 能以 UltraSpeed 一小部分的成本提供同樣的上下文視窗。

Glarity 編輯部專注於 AI 搜尋、影片摘要與瀏覽器效率技巧。

Glarity 是免費的瀏覽器擴充功能,支援 AI 搜尋與 YouTube 影片摘要,可在 glarity.app 取得。