如何在 Glarity 中使用 MiMo-V2.6-Flash:網頁翻譯、頁面摘要與 YouTube 影片摘要

透過 Glarity 的自訂模型設定接入小米 MiMo-V2.6-Flash,用更低成本實現快速全模態摘要與翻譯。

MiMo-V2.6-Flash 是 MiMo-V2.6-Pro 的低成本、高吞吐版本:同樣支援文字、圖像、影片、音訊的全模態輸入,同樣是 100 萬 token 上下文與最大 12.8 萬 token 輸出,但定價面向日常大量呼叫,而非最重的推理任務。Glarity 沒有把 MiMo 做成內建選項,不過設定面板裡的「自訂模型」欄位支援任何 OpenAI 相容的 /chat/completions 端點,小米的 API 正好符合這個形態。整個設定大約五分鐘,從設定 → 一般 → 連接 AI 開始。

為什麼選 MiMo-V2.6-Flash

如果 MiMo-V2.6-Pro 是旗艦,Flash 就是你每天要摘要幾十個頁面、又不想每次都按旗艦價格付費時的選擇。它保留了同樣的 100 萬 token 上下文和多模態輸入,也支援深度思考、工具呼叫、串流輸出、網頁搜尋、結構化輸出和上下文快取,只是小米把它調校成了更高吞吐、單價只有 Pro 一小部分的版本——對於會在每個頁面上被呼叫的擴充功能來說,這一點很關鍵。

開始前需要準備

  • 一個從小米 MiMo 控制台取得的 API 金鑰
  • 下面這些連接參數

Glarity 逐步設定

  1. 開啟 Glarity 擴充功能,前往設定 → 一般,捲動到「連接 AI 以取得快速的 Glarity 摘要與翻譯」區域。
  2. 將連接類型設為OpenAI API 金鑰。
  3. 把你的小米金鑰貼到API 金鑰欄位。
  4. 將模型設為自訂模型,輸入 mimo-v2.6-flash。
  5. 將模型上下文視窗設為最接近100 萬的檔位。
  6. 將API 主機設為 https://api.xiaomimimo.com/v1。
  7. 將API 路徑設為 /chat/completions。
  8. 溫度日常使用設為 0.5(想要更忠實的摘要可降到 0.2),點擊測試確認收到回覆,再點擊儲存。

設定一覽

欄位

值

意義

連接類型

OpenAI API 金鑰

MiMo 的 API 採用 OpenAI 對話補全格式

API 金鑰

你的 MiMo 金鑰

從 MiMo 控制台產生

模型

自訂模型 → mimo-v2.6-flash

官方模型 ID

模型上下文視窗

約 100 萬

MiMo-V2.6-Flash 官方輸入上限

API 主機

https://api.xiaomimimo.com/v1

來自小米官方 API 文件的基礎位址

API 路徑

/chat/completions

標準 OpenAI 相容路由

溫度

0.5(或 0.2)

在自然表達與忠實輸出之間取得平衡

計價

根據小米官方定價頁面(2026 年 9 月 22 日更新),海外費率為每百萬 token:快取輸入 $0.0028、非快取輸入 $0.14、輸出 $0.28——大約是 Pro 非快取費率的三分之一。中國大陸費率為每百萬 token ¥0.02 / ¥1 / ¥2。這讓 Flash 更適合作為日常頁面和影片摘要的預設選擇,把 Pro 留給真正需要深度推理的任務。新模型費率可能會調整,使用前建議核對官方定價頁面。

接入 MiMo-Flash 後 Glarity 能做什麼

能力

目前的表現

翻譯

以更低的單次成本翻譯網頁文字或選取內容

頁面摘要

壓縮長文章要點,需要時借助 100 萬 token 視窗

YouTube 摘要

摘要影片逐字稿,包括較長的影片

影片字幕

根據逐字稿生成並翻譯字幕文字

快速郵件回覆

根據選取文字生成簡短回覆

一鍵提示詞

用 Flash 而非預設模型執行你儲存的自訂提示詞

疑難排解

  • 401 / 未授權錯誤 —— API 金鑰無效或未儲存,重新貼上後點擊測試再儲存。
  • 「找不到模型」 —— 檢查模型 ID 是否精確為 mimo-v2.6-flash。
  • 超長輸入請求失敗 —— Flash 上限是輸入 100 萬 token / 輸出 12.8 萬 token。
  • 回答難題時感覺不夠深入 —— Flash 用推理深度換取速度和成本,若需更深入分析請切換到 MiMo-V2.6-Pro。
  • Glarity 仍在用舊模型 —— 只有測試成功並點擊儲存後設定才會生效。

常見問題

MiMo-V2.6-Flash 是 Glarity 官方支援的模型嗎?不是。本教學是透過 Glarity 通用的「自訂模型」設定接入的。

Flash 和 MiMo-V2.6-Pro 有什麼區別?兩者共享同樣的 100 萬 token 上下文和多模態輸入,但 Flash 針對更高吞吐量調校,單價大約是 Pro 非快取輸入和輸出費率的三分之一。

日常摘要用 Flash 夠用嗎?夠用。頁面和影片摘要、翻譯、字幕這些場景,Flash 的速度和成本更實用;需要更深推理時再用 Pro。

長期使用成本大概是多少?按非快取輸入每百萬 token $0.14、輸出每百萬 token $0.28 計算,同樣用量下成本只是 Pro 的一小部分。

之後能切換到 Pro 或 UltraSpeed 嗎?可以,只需把模型欄位改成 mimo-v2.6-pro 或 mimo-v2.6-pro-ultraspeed,並依需求調整上下文視窗,主機和路徑保持不變。

Glarity 編輯部專注於 AI 搜尋、影片摘要與瀏覽器效率技巧。

Glarity 是免費的瀏覽器擴充功能,支援 AI 搜尋與 YouTube 影片摘要,可在 glarity.app 取得。