如何在 Glarity 中使用 MiMo-V2.6-Pro:网页翻译、页面总结与 YouTube 视频总结

通过 Glarity 的自定义模型设置接入小米 MiMo-V2.6-Pro,用于全模态总结与翻译,实测配置步骤与定价。

MiMo-V2.6-Pro 是小米的旗舰推理模型:一款万亿参数级的全模态模型,支持文本、图像、视频、音频输入,以文本形式输出,上下文窗口达 100 万 token,最大输出 12.8 万 token。Glarity 目前还没有把 MiMo 做成内置选项,但它的设置面板里有一个通用的"自定义模型"入口,专为任何暴露 OpenAI 风格 /chat/completions 接口的厂商而设。把这个入口指向小米的 API,大约五分钟就能搞定,从设置 → 通用 → 连接 AI 开始。

为什么选 MiMo-V2.6-Pro

大多数能接入浏览器扩展的模型只能读文本和静态图片。MiMo-V2.6-Pro 的输入端还覆盖视频和音频,再加上 100 万 token 的上下文,适合处理长文字稿、多页文档,或者需要开启深度思考模式来做更复杂推理的场景(小米文档里也支持按请求关闭思考模式,换取更快、更省的回复)。它同时支持工具调用、流式输出、网页搜索、结构化输出和上下文缓存,对于 Glarity 里反复使用同一套系统提示词的工作流也很有意义。

开始前需要准备

  • 一个从小米 MiMo 控制台获取的 API 密钥
  • 下面这些连接参数

Glarity 逐步配置

  1. 打开 Glarity 扩展,进入设置 → 通用,滚动到"连接 AI 以获得快捷的 Glarity 总结与翻译"区域。
  2. 将连接类型设为OpenAI API 密钥。
  3. 把你的小米密钥粘贴到API 密钥字段。
  4. 将模型设为自定义模型,填入 mimo-v2.6-pro。
  5. 将模型上下文窗口设为最接近100 万的档位——这是 MiMo 官方给出的上下文上限。
  6. 将API 主机设为 https://api.xiaomimimo.com/v1。
  7. 将API 路径设为 /chat/completions。
  8. 温度日常使用设为 0.5(如果想要更忠实、变化更少的总结可以降到 0.2),点击测试确认能收到回复,再点击保存。

设置一览

字段

值

含义

连接类型

OpenAI API 密钥

MiMo 的 API 采用 OpenAI 对话补全格式

API 密钥

你的 MiMo 密钥

从 MiMo 控制台生成

模型

自定义模型 → mimo-v2.6-pro

官方模型 ID

模型上下文窗口

约 100 万

MiMo-V2.6-Pro 官方输入上限

API 主机

https://api.xiaomimimo.com/v1

来自小米官方 API 文档的基础地址

API 路径

/chat/completions

标准 OpenAI 兼容路由

温度

0.5(或 0.2)

在自然表达与忠实输出之间取平衡

定价

根据小米官方定价页面(2026 年 9 月 22 日更新),海外费率为每百万 token:缓存输入 $0.0036、非缓存输入 $0.435、输出 $0.87。国内费率对应同三档为每百万 token ¥0.025 / ¥3 / ¥6。日常用 Glarity 总结一篇文章或一段视频文字稿,通常只消耗几千 token,单次成本几乎可以忽略。新模型的费率可能会调整,使用前建议核对官方定价页面。

接入 MiMo 后 Glarity 能做什么

能力

目前的表现

翻译

利用 MiMo 的多语言推理翻译网页文本或选中内容

页面总结

把长文章压缩成要点,借助 100 万 token 窗口应对长页面

YouTube 总结

总结视频文字稿,包括超出小模型上限的长视频

视频字幕

根据文字稿生成并翻译字幕文本

快捷邮件回复

根据选中文本生成简短回复

一键提示词

用 MiMo 而不是默认模型运行你保存的自定义提示词

故障排查

  • 401 / 未授权错误 —— API 密钥无效或未保存,重新粘贴后点击测试再保存。
  • "未找到模型" —— 检查模型是否设为自定义模型,且 ID 精确为 mimo-v2.6-pro,不是缩写或猜测的名称。
  • 超长输入请求失败 —— MiMo 上限是输入 100 万 token / 输出 12.8 万 token,超出时请精简输入或拆分页面。
  • 响应比预期慢 —— 深度思考模式会增加延迟,如果需要更快的简短回答,请在请求设置中关闭它。
  • Glarity 仍在用旧模型 —— 设置只有在测试成功并点击保存后才会生效,只测试不保存不会持久化。

常见问题

MiMo-V2.6-Pro 是 Glarity 官方支持的模型吗?不是。Glarity 并未把 MiMo 列为内置选项。本教程是通过 Glarity 的通用"自定义模型"设置接入,任何提供 OpenAI 兼容接口的厂商都可以用同样的方式接入。

它能处理视频和音频,还是只能处理文本? MiMo-V2.6-Pro 的输入支持文本、图像、视频和音频,但只以文本形式回复。这在总结视频画面配合文字稿这类任务上,比纯文本模型更有优势。

日常使用成本大概是多少?按每百万非缓存输入 token $0.435、每百万输出 token $0.87 计算,一次几千 token 的页面或视频总结,成本几乎可以忽略不计。

如果想要更快的响应而不是更深的推理,该怎么办?小米的 API 支持按请求关闭"思考"模式;如果 Glarity 的设置里没有直接暴露这个开关,可以考虑改用更偏速度的 MiMo-V2.6-Flash 或 MiMo-V2.6-Pro-UltraSpeed。

每次都要点击测试吗?只有修改设置时才需要。测试是为了在保存前确认连接是否正常;保存后,Glarity 会一直使用这套配置,直到你再次修改。

Glarity 编辑部专注于 AI 搜索、视频总结与浏览器效率技巧。

Glarity 是一款免费的浏览器扩展,支持 AI 搜索与 YouTube 视频总结,可在 glarity.app 获取。