OpenAI対応モデルの料金は移り変わりが早く、ベンダーごとに価格体系もバラバラです。プロモ期間、キャッシュティア、ピーク・オフピーク料金……。本記事は 2026 年 8 月時点のメニューです:Glarity のようなブラウザ拡張にそのまま差し込める、OpenAI 互換エンドポイントを持つ 6 モデル(キー、API ホスト、パスの 3 つで接続)。要点を先に:Claude Opus 5(100万トークンあたり $5/$25)と GPT-5.6 Sol($4/$20)はプレミアム層。Gemini 3.7 Flash、GLM-5.3-Flash、DeepSeek V4 Flash はフラッシュ層。Qwen3.6-Plus($0.50/$3.00)はその中間で、100万トークンの入力窓を持ちます。
6モデルを並べて価格比較
価格は 2026年8月28日時点の各ベンダー公式料金ページのレートです:Anthropic、OpenAI、Google、智譜/Zhipu、Alibaba Cloud、DeepSeek:
モデル | 入力 / 出力(100万トークン) | コンテキスト / 最大出力 | 備考 |
|---|---|---|---|
Claude Opus 5 | $5.00 / $25.00 | 1M / 128K | Opus 4.8 と同額。思考(thinking)は既定でオン |
GPT-5.6 Sol | $4.00 / $20.00(短コンテキスト)· $8.00 / $30.00(長コンテキスト) | — | キャッシュ入力 $0.40。プロモ価格は少なくとも2026年11月21日まで |
Gemini 3.7 Flash | $0.75 / $3.75(プロモ) | — | プロモは2026年12月31日まで。その後 $1.50 / $7.50。キャッシュ $0.075。無料枠あり |
GLM-5.3-Flash | GLM-5.3 の 1/10(プロモ中は 1/20) | 1M / 128K | Zhipu 公式:同知能で Claude Opus 4.8 の約1/40。MIT オープンウェイト |
Qwen3.6-Plus | $0.50 / $3.00(入力256K以下)· $2.00 / $6.00(256K–1M) | 1M / — | インターナショナル(Singapore)レート |
DeepSeek V4 Flash | $0.22 / $0.66(オフピーク)· $0.44 / $1.32(ピーク) | 1M / 384K | キャッシュヒット入力は $0.007 から。ピーク時は UTC 月〜金 01:00–04:00 と 06:00–10:00 |
月100万トークン?いや、1億トークンならいくら?
現実的な要約ワークロード:入力 1億トークン(ページ、書き起こし、文書)+ 出力 1000万トークン(要約、回答):
モデル | 1億入力 + 1000万出力 |
|---|---|
Claude Opus 5 | $750 |
GPT-5.6 Sol | $600(短コンテキスト標準) |
Gemini 3.7 Flash | $112.50(プロモ。2026年12月31日以降は $225) |
Qwen3.6-Plus | $80(入力256K以下。大半が超えると $260) |
DeepSeek V4 Flash | $28.60(オフピーク。ピーク時 $57.20、キャッシュヒット入力なら一桁台まで下がる) |
GLM-5.3-Flash | 公式価格は相対のみ — Zhipu は GLM-5.3 の 1/10(プロモ 1/20)、同知能で Opus 4.8 の約1/40と公表 |
入力が重い用途(翻訳、同じページの読み直し)は「入力が安い、またはキャッシュが効く」モデルが有利。出力が重い用途(リライト、長い要約)は出力単価が安いモデルが有利です。
用途別の選び方
用途 | おすすめ | 理由 |
|---|---|---|
長文ドキュメントの調査・厳密な検証 | Claude Opus 5 | 1M コンテキスト、思考オン。正しさが最優先なら $5/$25 を払う価値あり |
巨大ファイルからの抽出 | GPT-5.6 Sol | 長コンテキスト層が強い。プロモ期間中は短コンテキスト $4/$20 |
ページ・文書全体の翻訳 | DeepSeek V4 Flash | オフピーク $0.22、キャッシュヒット入力 $0.007 — 同じ原文の再読はほぼ無料 |
日常のページ・YouTube要約 | Gemini 3.7 Flash か GLM-5.3-Flash | プロモで入力 $1 以下。GLM-5.3-Flash は MIT オープンウェイトで 1/10 |
高頻度の軽い Q&A と下書き | Qwen3.6-Plus | 入力256K以下なら $0.50 / $3.00 |
書き起こしの常用ワークロード | DeepSeek V4 Flash(オフピーク) | 出力 $0.66 — 6 モデル中で公式最安の出力単価 |
なぜ OpenAI 互換がブラウザ拡張で効くのか
Glarity の 設定 → 一般 → Connect to AI のダイアログは、OpenAI API キー、モデル名、コンテキスト窓プリセット、API ホスト、API パスを受け取る設計です。つまり OpenAI 形式の /chat/completions エンドポイントを提供するベンダーなら何でも入れられます。上の 6 モデルはすべて対応します:Anthropic は OpenAI SDK 互換レイヤーを公開しており https://api.anthropic.com/v1/ で接続可能(テスト・比較用途と明記 — 拡張のモデル切り替えにはまさに十分です)。Google の Gemini API は OpenAI 互換、智譜(Zhipu)は GLM 系に OpenAI 互換ベースを公開、Alibaba Cloud Model Studio と DeepSeek は設計自体が OpenAI 互換、OpenAI は言うまでもなく OpenAI です。
モデルを切り替えても Glarity のタスク(要約、翻訳、Q&A)はそのまま。変わるのはホストとキーとトークン単価だけです。設定手順は Glarity で Qwen3.6-Plus を使うと Glarity で GLM-5.3-Flash を使うを参照してください。
FAQ
6モデルの中で一番安いのはどれ?トラフィックの形によります。入力が重い用途なら DeepSeek V4 Flash が公式レート最安(オフピーク $0.22、キャッシュヒット $0.007)。日常の要約が中心なら Gemini 3.7 Flash のプロモ($0.75/$3.75)と Qwen3.6-Plus($0.50/$3.00、入力256K以下)が時間制限なしで最安級です。
価格は変わる?はい、いくつかはプロモ価格です。GPT-5.6 Sol は少なくとも2026年11月21日まで。Gemini 3.7 Flash は2027年1月1日に 2 倍。DeepSeek V4 Flash はピーク時間外が安い。確定前には各社の公式ページを確認してください。
オープンソースのものは? GLM-5.3-Flash です。Zhipu が MIT ライセンスでウェイトを公開しているので、API の外(自社ホスティング)でも動かせます。他は公式ページ上 API のみです。
Glarity で使えますか?使えます。設定 → 一般 → Connect to AI を OpenAI API key にし、各社のキーを貼り、Custom Model を選んでモデルコードを入力。コンテキスト窓プリセットをそのモデルの入力上限に合わせ、API ホストとパスを互換ドキュメントの値に。Test → Save で完了です。
入力と出力、どちらを見るべき?両方ですが、仕事の形で決まります。YouTube 動画の要約は長い書き起こしを読んで短い要約を書くので入力が効きます。全文の翻訳・書き直しは出力トークンが増えるので出力単価が効きます。
Glarity 編集部は、AI 検索・動画要約・ブラウザ生産性のヒントを発信しています。
Glarity は AI 検索と YouTube 要約に対応した無料ブラウザ拡張です(glarity.app)。



