Google 最新的 Flash 模型 Gemini 3.8 Flash 於 2026 年 9 月 2 日上線,和 Glarity 是天作之合:1,048,576 token 脈絡視窗、65,536 token 輸出上限、文字/圖片/影片/音訊/PDF 多模態輸入、還有免費額度,價格則與 3.7 Flash 同檔促銷價。接入 Glarity 五分鐘:開啟設定 → 一般,選 OpenAI API key,貼上 Google AI Studio 的金鑰,填好模型名稱、脈絡視窗、主機與路徑,儲存即可。之後網頁翻譯、總結、YouTube 影片總結全部由 Gemini 3.8 Flash 完成。
Gemini 3.8 Flash 有什麼新
Gemini 3.8 Flash 是 Google 口中「最智能的 Flash 模型」,主打長程軟體工程、自主智慧代理與複雜企業工作流——但對 Glarity 使用者來說,它同樣是閱讀與寫作的主力模型。它是 Gemini 3 系列最新的 stable 版本,支援文字、圖片、影片、音訊、PDF 輸入,輸出文字。Google 發布公告的亮點:HLE-Verified 54.9%(橫跨 STEM、人文、專業領域的多步推理),以及長程軟體工程(DeepSWE v1.1)中「超越多數更大尺寸的旗艦模型」。同步發布的還有安全特化的 3.8 Flash Cyber(僅透過 Fairwind Program 面向可信防禦者開放)——接入 Glarity 的是一般版 3.8 Flash。
日常使用需要注意一個設計:Google 說 3.8 Flash 會「更賣力」——它會執行額外推理步驟、迭代呼叫工具,在更高 effort 檔消耗更多 token 以換取效能。effort 只有低/中/高三檔,「minimal」檔不受支援。效率優先的負載仍可繼續使用 Gemini 3.7 Flash(見下文)。
開始前需要的準備
- 在 Google AI Studio 產生的 API 金鑰。
- 本文連接值:模型名稱、脈絡視窗、主機、路徑。
Glarity 設定步驟
進入設定 → 一般,捲動到 Connect to AI for quick Glarity summaries and translations。
- 選擇 "OpenAI API key"。
- 把 Google 金鑰貼到 API Key 輸入框。
- 模型 —— 選 Custom Model,輸入
gemini-3.8-flash。 - 模型脈絡視窗 —— 選最接近 1,048,576 tokens(官方視窗)的預設。
- API 主機 ——
https://generativelanguage.googleapis.com/v1beta/openai(Google 官方 OpenAI 相容端點;與 3.7 Flash 的設定相同,整個 Gemini 家族通用)。 - API 路徑 ——
/chat/completions。 - 溫度 —— 0.5;翻譯要更嚴格可降到 0.2。
- Test,然後 Save。
設定一覽
欄位 | 值 | 含義 |
|---|---|---|
連接方式 | OpenAI API key | 經 Google 官方相容 API |
模型 | Custom Model — | Stable 版 Gemini 3.8 Flash |
模型脈絡視窗 | 1,048,576 tokens(就鄰選預設) | 官方脈絡視窗 |
API 主機 |
| 官方 OpenAI 相容基底位置 |
API 路徑 |
| Chat Completions 路由 |
溫度 | 0.5 | 穩定輸出;0.2 更嚴格 |
價格與免費額度
依 Google 官方定價頁(2026 年 9 月):Gemini 3.8 Flash Standard 檔輸入 $0.75/百萬 token、輸出 $3.75/百萬 token,促銷至 2026 年 12 月 31 日——與 3.7 Flash 相同,之後恢復標準價($1.50/$7.50)。Standard 與 Priority 有免費額度(Batch/Flex 免費額度不可用)。快取輸入 2026 年內 $0.075/百萬 token(2027 年起 $0.15),對 Glarity 反覆讀同一份文件的用法很划算。摘要與翻譯的輸出相對輸入短得多,費用通常很小;預算前請以官方頁面現價為準。
長文經濟帳
一小時以上的影片逐字稿、整本書級的長文都能完整放進 1M 視窗——無需拆分、不會截斷。Glarity 一次交給模型,模型能同時看到文件的頭尾,長文摘要更忠實。65,536 token 的輸出上限對摘要、字幕、問答綽綽有餘;只有你要一次產生接近一本書長度的改寫時才需要考慮這個上限。
選 3.8 還是 3.7?
誠實的建議:品質優先選 3.8,效率優先留在 3.7。「更賣力」的設計意味著高 effort 下有更深的推理和更多 token 消耗。Glarity 的預設負載(摘要、翻譯、字幕生成、問答)在兩者上都快而便宜;當錯誤難以接受的複雜內容最看重準確率時用 3.8,當你一天處理幾十頁、token 成本是首要約束時用 3.7(或把 effort 降到 low)。切換只需改 Glarity Model 欄一個欄位——主機、路徑、金鑰都不變。3.7 Flash 的具體設定見 Gemini 3.7 Flash 接入指南。
Gemini 3.8 Flash 版 Glarity 能做什麼
功能 | 表現 |
|---|---|
翻譯 | 全頁沉浸式翻譯與左右對照字幕——參見雙語字幕教學 |
網頁總結 | 超長頁面無需拆分的總結 |
YouTube 總結 | 一小時以上長逐字稿一次搞定 |
影片字幕 | 字幕產生與翻譯 |
快捷郵件回覆 | 依語氣和語言草擬 |
一鍵提示詞 | 儲存的任務在自己模型上重跑 |
排障
- Test 回傳 401 / 金鑰無效 —— 金鑰寫錯或混入空格,到 aistudio.google.com 新建一個。
- 頻繁 429 / 額度不足 —— 免費額度上限或尖峰時段,稍候片刻,或到 AI Studio 主控台升級。
- "Model not found" —— 模型名稱必須是
gemini-3.8-flash。 - 2027 年成本會跳 —— 是的:促銷價 2026 年 12 月 31 日結束,屆時在 Glarity 的 Model 欄切換即可。
- 儲存後沒變化 —— 確認先 Test 再 Save。
FAQ
Gemini 3.8 Flash 是翻譯還是總結?兩者都是——一個接入的模型涵蓋 Glarity 的網頁翻譯、劃詞翻譯、字幕翻譯與總結。
免費額度夠用嗎?偶爾用足夠。每天閱讀的工作流,付費檔促銷價也非常便宜。
為什麼非要 1M 脈絡視窗?長頁面、一小時以上的逐字稿可以整段放進,不拆分、不丟脈絡;只處理短內容的話任何模型都行,大視窗正是選 Flash 的理由。
以後能換 Pro 模型嗎?能——改 Model 欄位,主機與路徑不變;相容端點服務整個 Gemini 家族。
OpenAI 相容端點夠穩定嗎? Google 標明為 beta,但它是 Glarity 這類第三方客戶端的標準路徑;先用真實頁面測一下最穩妥。
3.8 和 3.7 怎麼選?見上方「選 3.8 還是 3.7?」——簡單說:品質優先選 3.8,省錢優先選 3.7。
Glarity 編輯團隊專注 AI 搜尋、影片總結與瀏覽器提效技巧。
Glarity 是一款免費瀏覽器擴充功能,支援 AI 搜尋與 YouTube 影片總結,可在 glarity.app 取得。



