Google の最新 Flash モデル Gemini 3.8 Flash は 2026 年 9 月 2 日に公開されました。Glarity との相性は抜群です:1,048,576 トークンのコンテキストウィンドウ、65,536 トークンの出力上限、テキスト・画像・動画・音声・PDF の入力対応、無料枠まで付き、価格は 3.7 Flash と同じプロモ料金です。接続は 5 分:設定 → 一般 で OpenAI API key を選び、Google AI Studio のキーを貼り、モデル名・コンテキストウィンドウ・ホスト・パスを入力して保存します。これでページ翻訳・要約・YouTube 動画要約が全部 Gemini 3.8 Flash で動きます。
Gemini 3.8 Flash の新しさ
Gemini 3.8 Flash は Google の「最もインテリジェントな Flash モデル」で、長期にわたるソフトウェアエンジニアリング、自律エージェント、複雑なエンタープライズワークフロー向けに設計されています — しかし Glarity ユーザーにとっては読み書きの主力モデルでもあります。stable の地位を正式に得た Gemini 3 シリーズの最新モデルで、テキスト・画像・動画・音声・PDF を入力に受け、テキストを返します。Google の発表記事では HLE-Verified 54.9%(STEM・人文・専門分野を横断する多段推論)と、長期ソフトウェアエンジニアリング(DeepSWE v1.1)での強さが強調されています。同時にセキュリティ特化の 3.8 Flash Cyber(指定された防衛関係者のための Fairwind Program 経由でのみ提供)も発表されました — Glarity に接続するのは通常版の 3.8 Flash です。
もう一点、日常使いで重要な設計:Google は 3.8 Flash が「より粘り強く働く」と説明しています — 追加の推論ステップを実行し、ツールを反復的に呼び出し、高い effort 設定ではより多くのトークンを使うことで性能を最大化します。effort は low / medium / high の 3 段階で、「minimal」はサポートされません。効率優先の場合は Gemini 3.7 Flash が引き続き使えます(後述)。
事前に必要なもの
- Google AI Studio で発行した API キー。
- 本記事の接続値:モデル名・コンテキストウィンドウ・ホスト・パス。
Glarity の設定手順
設定 → 一般 に進み、Connect to AI for quick Glarity summaries and translations までスクロールします。
- "OpenAI API key" を選びます。
- API Key 欄に Google のキーを貼り付けます。
- Model — Custom Model を選び
gemini-3.8-flashと入力。 - Model Context Window — 1,048,576 tokens(公式ウィンドウ)に最も近いプリセットを選びます。
- API Host —
https://generativelanguage.googleapis.com/v1beta/openai(Google の公式 OpenAI 互換エンドポイント。3.7 Flash の設定と同じく、Gemini ファミリー全体に効きます)。 - API Path —
/chat/completions。 - Temperature — 0.5。翻訳を厳密に固定したい場合は 0.2 まで下げてください。
- Test → Save。
設定値一覧
項目 | 値 | 意味 |
|---|---|---|
Connection | OpenAI API key | Google の公式互換 API 経由 |
Model | Custom Model — | Stable 版 Gemini 3.8 Flash |
Model Context Window | 1,048,576 tokens(プリセットで選択) | 公式コンテキストウィンドウ |
API Host |
| 公式 OpenAI 互換ベース |
API Path |
| Chat Completions ルート |
Temperature | 0.5 | 安定した出力。0.2 でより厳密 |
料金と無料枠
Google の公式料金ページ(2026 年 9 月時点)によると、Gemini 3.8 Flash の Standard 料金は 入力 $0.75 / 100万トークン、出力 $3.75 / 100万トークンで 2026 年 12 月 31 日まで — 3.7 Flash と同じ導入プロモ料金です。プロモ終了後は倍額($1.50/$7.50)になります。Standard と Priority には無料枠もあります(Batch・Flex は無料枠では使えません)。キャッシュ入力は 2026 年中 $0.075 / 100万トークン(2027 年から $0.15)で、Glarity が同じドキュメントを何度も読む用途に効きます。要約・翻訳の出力は入力に比べて短いので、費用は小さく済むのが普通です。事前に必ず公式ページで現行の数字をご確認ください。
長文の経済
1 時間超の動画文字起こしも本 1 冊レベルの長文も 1M ウィンドウに収まります — 分割も切り捨て也不要です。Glarity が丸ごと一度に渡し、モデルは文書の冒頭と末尾を同時に見るため、長文の要約はより忠実になります。出力上限 65,536 トークンは要約・字幕・Q&A には十分な広さで、いちどに長文リライトを生成する場合の上限としてだけ頭に入れておけばよいでしょう。
3.8 か 3.7 Flash か?
正直な推奨:品質優先なら 3.8、効率優先なら 3.7。この「粘り強く働く」設計は、高い effort でより深い推論とトークン消費を伴います。Glarity のデフォルトの仕事(要約・翻訳・字幕生成・Q&A)はどちらも高速で安価です。手間のかかる多段ステップのコンテンツでの正確さが最も大事なシーンは 3.8 に、1 日 何十ページも処理していてトークンコストが主な制約のときは 3.7(または effort を low に)を選んでください。切り替えは Glarity の Model 欄を 1 語書き換えるだけです — ホストもパスもキーも同じ。3.7 Flash の具体的な設定値はGemini 3.7 Flash セットアップガイドをご覧ください。
Gemini 3.8 Flash を使う Glarity でできること
機能 | 動作 |
|---|---|
翻訳 | ページ全体の没入翻訳と左右の対訳字幕 — バイリンガル字幕チュートリアルも参照 |
ページ要約 | 分割不要の長文ページ要約 |
YouTube 要約 | 1 時間超の長い字幕も 1 回で要約 |
動画字幕 | 字幕生成と翻訳 |
メール返信 | トーンと対象言語に合わせた下書き |
ワンクリックプロンプト | 保存したタスクを自分のモデルで再実行 |
トラブルシューティング
- Test が 401 / キーが無効 — キーが不正確か空白が混入。aistudio.google.com で新しいキーを作成してください。
- 頻繁な 429 / クォータエラー — 無料枠の上限か混雑時間帯。時間を置くか、AI Studio コンソールからのアップグレードを検討してください。
- "Model not found" — スペルは正確に
gemini-3.8-flashを入力してください。 - 2027 年にコストが跳ね上がる — そうです。プロモ料金は 2026 年 12 月 31 日まで。後で Glarity の Model 欄を切り替えれば対応できます。
- 保存しても変わらない — Test の後に Save を押したか確認してください。
FAQ
Gemini 3.8 Flash は翻訳のため?それとも要約のため?両方です — 1 つの接続されたモデルで、Glarity のページ翻訳・選択翻訳・字幕翻訳・要約をすべてカバーします。
無料枠で足りますか?たまに使うなら十分。毎日の読書ワークフローなら、有料枠のプロモ料金でもまだ安価です。
なぜ 1M コンテキストのウィンドウにこだわるのですか?長いページや 1 時間超の文字起こしが丸ごと入り、分割も文脈の切り捨ても起きないからです。長文を処理しないならどんなモデルでも構いません。大きいウィンドウは Flash を選ぶ理由です。
後で Pro モデルに変更できますか?はい — Model 欄を編集し、ホストとパスは同じで OK。互換エンドポイントが Gemini ファミリーのモデルを提供しています。
OpenAI 互換エンドポイントは常用の安定性が足りますか? Google はベータ扱いと明記していますが、Glarity のようなクライアントには標準的な経路です。まず実ページでテストするのが一番確実です。
3.8 と 3.7 はどちらを選べばいいですか?詳細は上記「3.8 か 3.7 Flash か?」へ — シンプルに言えば、品質優先なら 3.8、トークン節約優先なら 3.7 です。
Glarity 編集部は AI 検索、動画要約、ブラウザ活用のヒントを扱っています。
Glarity は AI 検索と YouTube 要約のための無料ブラウザ拡張機能です(glarity.app で入手可能)。



