如何在 Glarity 中使用 Gemini 3.8 Flash:翻译网页、总结网页与 YouTube 视频

把 Google 新上线的 Gemini 3.8 Flash 接入 Glarity:1,048,576 token 窗口 + 65,536 输出,免费档,促销价与 3.7 Flash 相同($0.75/$3.75,截至 2026-12-31),整本书和长转录一次请求完成。

Google 最新的 Flash 模型 Gemini 3.8 Flash 于 2026 年 9 月 2 日上线,和 Glarity 是天作之合:1,048,576 token 上下文窗口、65,536 token 输出上限、文字/图片/视频/音频/PDF 多模态输入、还有免费档,价格则与 3.7 Flash 同档促销价。接入 Glarity 五分钟:打开设置 → 常规,选 OpenAI API key,粘贴 Google AI Studio 的密钥,填好模型名、上下文窗口、主机与路径,保存即可。之后网页翻译、总结、YouTube 视频总结全部由 Gemini 3.8 Flash 完成。

Gemini 3.8 Flash 有什么新

Gemini 3.8 Flash 是 Google 口中"最智能的 Flash 模型",主打长程软件工程、自主智能体与复杂企业工作流——但对 Glarity 用户来说,它同样是阅读与写作的主力模型。它是 Gemini 3 系列最新的 stable 版本,支持文字、图片、视频、音频、PDF 输入,输出文本。Google 发布公告给出的亮点:HLE-Verified 54.9%(横跨 STEM、人文、专业领域的多步推理),以及长程软件工程(DeepSWE v1.1)中"超越多数更大尺寸的旗舰模型"。同时发布的还有安全特化的 3.8 Flash Cyber(仅通过 Fairwind Program 面向可信防御者开放)——接入 Glarity 的是普通版 3.8 Flash。

日常使用需要注意一个设计:Google 说 3.8 Flash 会"更卖力"——它会执行额外推理步骤、迭代调用工具,在更高 effort 档位消耗更多 token 以换取性能。effort 只有低/中/高三档,"minimal" 档不受支持。效率优先的负载仍可继续使用 Gemini 3.7 Flash(见下文)。

开始前需要的准备

  1. Google AI Studio 生成的 API 密钥。
  2. 本文连接值:模型名、上下文窗口、主机、路径。

Glarity 配置步骤

进入设置 → 常规,滚动到 Connect to AI for quick Glarity summaries and translations

  1. 选择 "OpenAI API key"。
  2. 把 Google 密钥粘贴到 API Key 输入框。
  3. 模型 —— 选 Custom Model,输入 gemini-3.8-flash
  4. 模型上下文窗口 —— 选最接近 1,048,576 tokens(官方窗口)的预设。
  5. API 主机 —— https://generativelanguage.googleapis.com/v1beta/openai(Google 官方 OpenAI 兼容端点;与 3.7 Flash 的配置相同,整个 Gemini 家族通用)。
  6. API 路径 —— /chat/completions
  7. 温度 —— 0.5;翻译要更严格可降到 0.2。
  8. Test,然后 Save

设置一览

字段

含义

连接方式

OpenAI API key

经 Google 官方兼容 API

模型

Custom Model — gemini-3.8-flash

Stable 版 Gemini 3.8 Flash

模型上下文窗口

1,048,576 tokens(就近选预设)

官方上下文窗口

API 主机

https://generativelanguage.googleapis.com/v1beta/openai

官方 OpenAI 兼容基地址

API 路径

/chat/completions

Chat Completions 路由

温度

0.5

稳定输出;0.2 更严格

价格与免费档

按 Google 官方定价页(2026 年 9 月):Gemini 3.8 Flash Standard 档输入 $0.75/百万 token、输出 $3.75/百万 token,促销至 2026 年 12 月 31 日——与 3.7 Flash 相同,之后恢复标准价($1.50/$7.50)。Standard 与 Priority 有免费档(Batch/Flex 免费档不可用)。缓存输入 2026 年内 $0.075/百万 token(2027 年起 $0.15),对 Glarity 反复读同一文档的用法很划算。摘要与翻译的输出相对输入短得多,费用通常很小;预算前请以官方页面现价为准。

长文经济账

一小时以上的视频转录、整本书级的长文都能完整放进 1M 窗口——无需拆分、不会截断。Glarity 一次性交给模型,模型可以同时看到文档的头尾,长文摘要更忠实。65,536 token 的输出上限对摘要、字幕、问答绰绰有余;只有你要一次性生成接近一本书长度的改写时才需要考虑这个上限。

选 3.8 还是 3.7?

诚实的建议:质量优先选 3.8,效率优先留在 3.7。"更卖力"的设计意味着高 effort 下有更深的推理和更多 token 消耗。Glarity 的默认负载(摘要、翻译、字幕生成、问答)在两者上都快而便宜;当错误难以接受的复杂内容最看重准确率时用 3.8,当你一天处理几十页、token 成本是首要约束时用 3.7(或把 effort 降到 low)。切换只需改 Glarity Model 栏一个字段——主机、路径、密钥都不变。3.7 Flash 的具体配置见 Gemini 3.7 Flash 接入指南

Gemini 3.8 Flash 版 Glarity 能做什么

功能

表现

翻译

全页沉浸式翻译和左右对照字幕——参见双语字幕教程

网页总结

超长页面无需拆分的总结

YouTube 总结

一小时以上长转录一次搞定

视频字幕

字幕生成与翻译

快捷邮件回复

按语气和语言起草

一键提示词

保存的任务在自己模型上重跑

排障

  • Test 返回 401 / 密钥无效 —— 密钥写错或混入空格,到 aistudio.google.com 新建一个。
  • 频繁 429 / 配额不足 —— 免费档限额或高峰期,等待片刻,或在 AI Studio 控制台升级。
  • "Model not found" —— 模型名必须是 gemini-3.8-flash
  • 2027 年成本会跳 —— 是的:促销价 2026 年 12 月 31 日结束,到时在 Glarity 的 Model 栏切换模型即可。
  • 保存后没变化 —— 确认先 TestSave

FAQ

Gemini 3.8 Flash 是翻译还是总结?两者都是——一个接入的模型覆盖 Glarity 的网页翻译、划词翻译、字幕翻译与总结。

免费档够用吗?偶尔用够。每天阅读的工作流,付费档促销价也非常便宜。

为什么非要 1M 上下文窗口?长页面、一小时以上的转录可以整段放进,不拆分、不丢上下文;只处理短内容的话任何模型都行,大窗口正是选 Flash 的理由。

以后能换 Pro 模型吗?能——改 Model 字段,主机与路径保持不变;兼容端点服务于整个 Gemini 家族。

OpenAI 兼容端点够稳定吗? Google 标明为 beta,但它是 Glarity 这类第三方客户端的标准路径;先用真实页面测一下最稳妥。

3.8 和 3.7 怎么选?见上方"选 3.8 还是 3.7?"——简单说:质量优先选 3.8,省钱优先选 3.7。

Glarity 编辑部专注 AI 搜索、视频总结与浏览器提效技巧。

Glarity 是一款免费浏览器扩展,支持 AI 搜索与 YouTube 视频总结,可在 glarity.app 获取。