MiMo-V2.6-Pro 是小米的旗艦推理模型:一款萬億參數級的全模態模型,支援文字、圖像、影片、音訊輸入,並以文字形式輸出,上下文視窗達 100 萬 token,最大輸出 12.8 萬 token。Glarity 目前尚未把 MiMo 做成內建選項,但它的設定面板裡有一個通用的「自訂模型」欄位,專為任何提供 OpenAI 風格 /chat/completions 端點的廠商而設。把這個欄位指向小米的 API,大約五分鐘就能完成,從設定 → 一般 → 連接 AI 開始。
為什麼選 MiMo-V2.6-Pro
大多數能接入瀏覽器擴充功能的模型只能讀取文字和靜態圖片。MiMo-V2.6-Pro 的輸入端還涵蓋影片和音訊,再加上 100 萬 token 的上下文,適合處理長逐字稿、多頁文件,或需要開啟深度思考模式來進行更複雜推理的場景(小米文件裡也支援依請求關閉思考模式,換取更快、更省的回覆)。它同時支援工具呼叫、串流輸出、網頁搜尋、結構化輸出與上下文快取,對 Glarity 中重複使用同一套系統提示詞的工作流程也很有幫助。
開始前需要準備
- 一個從小米 MiMo 控制台取得的 API 金鑰
- 下面這些連接參數
Glarity 逐步設定
- 開啟 Glarity 擴充功能,前往設定 → 一般,捲動到「連接 AI 以取得快速的 Glarity 摘要與翻譯」區域。
- 將連接類型設為OpenAI API 金鑰。
- 把你的小米金鑰貼到API 金鑰欄位。
- 將模型設為自訂模型,輸入
mimo-v2.6-pro。 - 將模型上下文視窗設為最接近100 萬的檔位——這是 MiMo 官方給出的上下文上限。
- 將API 主機設為
https://api.xiaomimimo.com/v1。 - 將API 路徑設為
/chat/completions。 - 溫度日常使用設為 0.5(若想要更忠實、變化較少的摘要可降到 0.2),點擊測試確認能收到回覆,再點擊儲存。
設定一覽
欄位 | 值 | 意義 |
|---|---|---|
連接類型 | OpenAI API 金鑰 | MiMo 的 API 採用 OpenAI 對話補全格式 |
API 金鑰 | 你的 MiMo 金鑰 | 從 MiMo 控制台產生 |
模型 | 自訂模型 → | 官方模型 ID |
模型上下文視窗 | 約 100 萬 | MiMo-V2.6-Pro 官方輸入上限 |
API 主機 |
| 來自小米官方 API 文件的基礎位址 |
API 路徑 |
| 標準 OpenAI 相容路由 |
溫度 | 0.5(或 0.2) | 在自然表達與忠實輸出之間取得平衡 |
計價
根據小米官方定價頁面(2026 年 9 月 22 日更新),海外費率為每百萬 token:快取輸入 $0.0036、非快取輸入 $0.435、輸出 $0.87。中國大陸費率對應同三檔為每百萬 token ¥0.025 / ¥3 / ¥6。日常用 Glarity 摘要一篇文章或一段影片逐字稿,通常只消耗幾千 token,單次成本幾乎可以忽略。新模型的費率可能會調整,使用前建議核對官方定價頁面。
接入 MiMo 後 Glarity 能做什麼
能力 | 目前的表現 |
|---|---|
翻譯 | 利用 MiMo 的多語言推理翻譯網頁文字或選取內容 |
頁面摘要 | 把長文章壓縮成要點,藉助 100 萬 token 視窗應對長頁面 |
YouTube 摘要 | 摘要影片逐字稿,包括超出小型模型上限的長影片 |
影片字幕 | 根據逐字稿生成並翻譯字幕文字 |
快速郵件回覆 | 根據選取文字生成簡短回覆 |
一鍵提示詞 | 用 MiMo 而非預設模型執行你儲存的自訂提示詞 |
疑難排解
- 401 / 未授權錯誤 —— API 金鑰無效或未儲存,重新貼上後點擊測試再儲存。
- 「找不到模型」 —— 檢查模型是否設為自訂模型,且 ID 精確為
mimo-v2.6-pro,不是縮寫或猜測的名稱。 - 超長輸入請求失敗 —— MiMo 上限是輸入 100 萬 token / 輸出 12.8 萬 token,超出時請精簡輸入或拆分頁面。
- 回應比預期慢 —— 深度思考模式會增加延遲,若需要更快的簡短回答,請在請求設定中關閉它。
- Glarity 仍在用舊模型 —— 設定只有在測試成功並點擊儲存後才會生效,只測試不儲存不會持久化。
常見問題
MiMo-V2.6-Pro 是 Glarity 官方支援的模型嗎?不是。Glarity 並未把 MiMo 列為內建選項。本教學是透過 Glarity 的通用「自訂模型」設定接入,任何提供 OpenAI 相容介面的廠商都能以同樣方式接入。
它能處理影片和音訊,還是只能處理文字? MiMo-V2.6-Pro 的輸入支援文字、圖像、影片和音訊,但只以文字形式回覆。這在摘要影片畫面配合逐字稿這類任務上,比純文字模型更具優勢。
日常使用成本大概是多少?按每百萬非快取輸入 token $0.435、每百萬輸出 token $0.87 計算,一次幾千 token 的頁面或影片摘要,成本幾乎可以忽略不計。
如果想要更快的回應而非更深的推理,該怎麼辦?小米的 API 支援依請求關閉「思考」模式;若 Glarity 的設定裡沒有直接提供這個開關,可以考慮改用更偏速度的 MiMo-V2.6-Flash 或 MiMo-V2.6-Pro-UltraSpeed。
每次都要點擊測試嗎?只有修改設定時才需要。測試是為了在儲存前確認連接是否正常;儲存後,Glarity 會持續使用這套設定,直到你再次修改。
Glarity 編輯部專注於 AI 搜尋、影片摘要與瀏覽器效率技巧。
Glarity 是免費的瀏覽器擴充功能,支援 AI 搜尋與 YouTube 影片摘要,可在 glarity.app 取得。



