Google 最新的 Flash 模型 Gemini 3.8 Flash 于 2026 年 9 月 2 日上线,和 Glarity 是天作之合:1,048,576 token 上下文窗口、65,536 token 输出上限、文字/图片/视频/音频/PDF 多模态输入、还有免费档,价格则与 3.7 Flash 同档促销价。接入 Glarity 五分钟:打开设置 → 常规,选 OpenAI API key,粘贴 Google AI Studio 的密钥,填好模型名、上下文窗口、主机与路径,保存即可。之后网页翻译、总结、YouTube 视频总结全部由 Gemini 3.8 Flash 完成。
Gemini 3.8 Flash 有什么新
Gemini 3.8 Flash 是 Google 口中"最智能的 Flash 模型",主打长程软件工程、自主智能体与复杂企业工作流——但对 Glarity 用户来说,它同样是阅读与写作的主力模型。它是 Gemini 3 系列最新的 stable 版本,支持文字、图片、视频、音频、PDF 输入,输出文本。Google 发布公告给出的亮点:HLE-Verified 54.9%(横跨 STEM、人文、专业领域的多步推理),以及长程软件工程(DeepSWE v1.1)中"超越多数更大尺寸的旗舰模型"。同时发布的还有安全特化的 3.8 Flash Cyber(仅通过 Fairwind Program 面向可信防御者开放)——接入 Glarity 的是普通版 3.8 Flash。
日常使用需要注意一个设计:Google 说 3.8 Flash 会"更卖力"——它会执行额外推理步骤、迭代调用工具,在更高 effort 档位消耗更多 token 以换取性能。effort 只有低/中/高三档,"minimal" 档不受支持。效率优先的负载仍可继续使用 Gemini 3.7 Flash(见下文)。
开始前需要的准备
- 在 Google AI Studio 生成的 API 密钥。
- 本文连接值:模型名、上下文窗口、主机、路径。
Glarity 配置步骤
进入设置 → 常规,滚动到 Connect to AI for quick Glarity summaries and translations。
- 选择 "OpenAI API key"。
- 把 Google 密钥粘贴到 API Key 输入框。
- 模型 —— 选 Custom Model,输入
gemini-3.8-flash。 - 模型上下文窗口 —— 选最接近 1,048,576 tokens(官方窗口)的预设。
- API 主机 ——
https://generativelanguage.googleapis.com/v1beta/openai(Google 官方 OpenAI 兼容端点;与 3.7 Flash 的配置相同,整个 Gemini 家族通用)。 - API 路径 ——
/chat/completions。 - 温度 —— 0.5;翻译要更严格可降到 0.2。
- Test,然后 Save。
设置一览
字段 | 值 | 含义 |
|---|---|---|
连接方式 | OpenAI API key | 经 Google 官方兼容 API |
模型 | Custom Model — | Stable 版 Gemini 3.8 Flash |
模型上下文窗口 | 1,048,576 tokens(就近选预设) | 官方上下文窗口 |
API 主机 |
| 官方 OpenAI 兼容基地址 |
API 路径 |
| Chat Completions 路由 |
温度 | 0.5 | 稳定输出;0.2 更严格 |
价格与免费档
按 Google 官方定价页(2026 年 9 月):Gemini 3.8 Flash Standard 档输入 $0.75/百万 token、输出 $3.75/百万 token,促销至 2026 年 12 月 31 日——与 3.7 Flash 相同,之后恢复标准价($1.50/$7.50)。Standard 与 Priority 有免费档(Batch/Flex 免费档不可用)。缓存输入 2026 年内 $0.075/百万 token(2027 年起 $0.15),对 Glarity 反复读同一文档的用法很划算。摘要与翻译的输出相对输入短得多,费用通常很小;预算前请以官方页面现价为准。
长文经济账
一小时以上的视频转录、整本书级的长文都能完整放进 1M 窗口——无需拆分、不会截断。Glarity 一次性交给模型,模型可以同时看到文档的头尾,长文摘要更忠实。65,536 token 的输出上限对摘要、字幕、问答绰绰有余;只有你要一次性生成接近一本书长度的改写时才需要考虑这个上限。
选 3.8 还是 3.7?
诚实的建议:质量优先选 3.8,效率优先留在 3.7。"更卖力"的设计意味着高 effort 下有更深的推理和更多 token 消耗。Glarity 的默认负载(摘要、翻译、字幕生成、问答)在两者上都快而便宜;当错误难以接受的复杂内容最看重准确率时用 3.8,当你一天处理几十页、token 成本是首要约束时用 3.7(或把 effort 降到 low)。切换只需改 Glarity Model 栏一个字段——主机、路径、密钥都不变。3.7 Flash 的具体配置见 Gemini 3.7 Flash 接入指南。
Gemini 3.8 Flash 版 Glarity 能做什么
功能 | 表现 |
|---|---|
翻译 | 全页沉浸式翻译和左右对照字幕——参见双语字幕教程 |
网页总结 | 超长页面无需拆分的总结 |
YouTube 总结 | 一小时以上长转录一次搞定 |
视频字幕 | 字幕生成与翻译 |
快捷邮件回复 | 按语气和语言起草 |
一键提示词 | 保存的任务在自己模型上重跑 |
排障
- Test 返回 401 / 密钥无效 —— 密钥写错或混入空格,到 aistudio.google.com 新建一个。
- 频繁 429 / 配额不足 —— 免费档限额或高峰期,等待片刻,或在 AI Studio 控制台升级。
- "Model not found" —— 模型名必须是
gemini-3.8-flash。 - 2027 年成本会跳 —— 是的:促销价 2026 年 12 月 31 日结束,到时在 Glarity 的 Model 栏切换模型即可。
- 保存后没变化 —— 确认先 Test 再 Save。
FAQ
Gemini 3.8 Flash 是翻译还是总结?两者都是——一个接入的模型覆盖 Glarity 的网页翻译、划词翻译、字幕翻译与总结。
免费档够用吗?偶尔用够。每天阅读的工作流,付费档促销价也非常便宜。
为什么非要 1M 上下文窗口?长页面、一小时以上的转录可以整段放进,不拆分、不丢上下文;只处理短内容的话任何模型都行,大窗口正是选 Flash 的理由。
以后能换 Pro 模型吗?能——改 Model 字段,主机与路径保持不变;兼容端点服务于整个 Gemini 家族。
OpenAI 兼容端点够稳定吗? Google 标明为 beta,但它是 Glarity 这类第三方客户端的标准路径;先用真实页面测一下最稳妥。
3.8 和 3.7 怎么选?见上方"选 3.8 还是 3.7?"——简单说:质量优先选 3.8,省钱优先选 3.7。
Glarity 编辑部专注 AI 搜索、视频总结与浏览器提效技巧。
Glarity 是一款免费浏览器扩展,支持 AI 搜索与 YouTube 视频总结,可在 glarity.app 获取。



