2026 年 AI 模型價格總覽:6 個 OpenAI 相容模型比較

Claude Opus 5、GPT-5.6 Sol、Gemini 3.7 Flash、GLM-5.3-Flash、Qwen3.6-Plus、DeepSeek V4 Flash 官方定價橫向對比 + 場景選型 + 每月 1 億 token 預算試算。

OpenAI 相容模型的定價變化很快,而且每家算法都不一樣——促銷窗口、快取檔位、尖峰/離峰時段。這是截至 2026 年 8 月的菜單:6 個具備 OpenAI 相容端點的模型,可直接接入 Glarity 這類瀏覽器擴充功能(一組 Key、一個 API 主機、一個路徑)。先講結論:Claude Opus 5($5/$25 每百萬 token)與 GPT-5.6 Sol($4/$20)是旗艦層;Gemini 3.7 Flash、GLM-5.3-Flash、DeepSeek V4 Flash 是性價比層;Qwen3.6-Plus($0.50/$3.00)居中,帶 100 萬 token 輸入視窗。

六個模型,價格橫排比較

價格均為 2026 年 8 月 28 日時點的官方費率(每 100 萬 token,即 MTok)。來源:AnthropicOpenAIGoogle智譜阿里雲DeepSeek:

模型

輸入 / 輸出(每 MTok)

脈絡 / 最大輸出

備註

Claude Opus 5

$5.00 / $25.00

1M / 128K

與 Opus 4.8 同價;思考預設開啟

GPT-5.6 Sol

$4.00 / $20.00(短脈絡)· $8.00 / $30.00(長脈絡)

快取輸入 $0.40;促銷價至少到 2026-11-21

Gemini 3.7 Flash

$0.75 / $3.75(促銷)

促銷至 2026-12-31,之後 $1.50 / $7.50;快取 $0.075;有免費額度

GLM-5.3-Flash

GLM-5.3 的 1/10(促銷期 1/20)

1M / 128K

智譜官方口徑:同等智力約為 Claude Opus 4.8 的 1/40;MIT 開源權重

Qwen3.6-Plus

$0.50 / $3.00(輸入 ≤256K)· $2.00 / $6.00(256K–1M)

1M / —

國際站(Singapore)費率

DeepSeek V4 Flash

$0.22 / $0.66(離峰)· $0.44 / $1.32(尖峰)

1M / 384K

快取命中輸入低至 $0.007;尖峰時段為 UTC 週一至五 01:00–04:00 與 06:00–10:00

每月 1 億 token 要花多少錢?

一個貼近現實的摘要工作負載:1 億 token 輸入(網頁、逐字稿、文件)+ 1000 萬 token 輸出(摘要、回答):

模型

1 億輸入 + 1000 萬輸出

Claude Opus 5

$750

GPT-5.6 Sol

$600(短脈絡標準價)

Gemini 3.7 Flash

$112.50(促銷;2026-12-31 後為 $225)

Qwen3.6-Plus

$80(請求 ≤256K 輸入;多數超出則為 $260)

DeepSeek V4 Flash

$28.60(離峰;尖峰 $57.20,快取命中輸入可降到數十美元以下)

GLM-5.3-Flash

官方僅公布相對價 — 智譜口徑:GLM-5.3 的 1/10,促銷 1/20,同等智力約 Opus 4.8 的 1/40

輸入密集的用法(翻譯、反覆讀同一篇原文)適合「輸入便宜或快取便宜」的模型;輸出密集的用法(改寫、長摘要)適合輸出單價低的模型。

場景選型:什麼任務配什麼模型

任務

選它

理由

長文件研究、嚴謹查證

Claude Opus 5

100 萬脈絡、思考預設開;正確性優先時這 $5/$25 花得有值

超大檔案內容抽取

GPT-5.6 Sol

長脈絡檔強;促銷期內短脈絡標準價 $4/$20

整頁 / 整篇翻譯

DeepSeek V4 Flash

離峰 $0.22 輸入,快取命中 $0.007 — 反覆重讀同一原文幾乎免費

日常頁面與 YouTube 摘要

Gemini 3.7 Flash 或 GLM-5.3-Flash

促銷期輸入低於 $1;GLM-5.3-Flash 另有 MIT 開源權重、1/10 價格

高頻輕量問答、草稿

Qwen3.6-Plus

輸入 ≤256K 時 $0.50 / $3.00

常駐逐字稿類負載

DeepSeek V4 Flash(離峰)

輸出 $0.66 — 六家官方表中最低的輸出單價

為什麼 OpenAI 相容對瀏覽器擴充這麼關鍵

Glarity 的 設定 → 一般 → Connect to AI 只收:OpenAI API Key、模型名稱、脈絡視窗預設、API 主機、API 路徑——所以任何提供 OpenAI 風格 /chat/completions 端點的廠商都能接。上面 6 家全部支援:Anthropic 公開了 OpenAI SDK 相容層,https://api.anthropic.com/v1/ 即可接上(官方說明用於測試與比較,而擴充的模型切換正是這個場景);Google Gemini API 提供 OpenAI 相容模式;智譜為 GLM 系列提供 OpenAI 相容基底;阿里雲 Model Studio 與 DeepSeek 天生 OpenAI 相容;OpenAI 本身就是。

切換模型時,Glarity 裡的任務(摘要、翻譯、問答)不動,變的只有主機、Key 與每 token 單價。逐步設定見在 Glarity 使用 Qwen3.6-Plus在 Glarity 使用 GLM-5.3-Flash

FAQ

6 個裡哪個最便宜?取決於流量形態。輸入密集的活,DeepSeek V4 Flash 是官方最低(離峰 $0.22,快取命中 $0.007)。日常混合摘要,則是 Gemini 3.7 Flash 促銷價($0.75/$3.75)與 Qwen3.6-Plus($0.50/$3.00,輸入 ≤256K)最划算,且不受時段限制。

價格會變嗎?會,好幾個是促銷價。GPT-5.6 Sol 促銷至少到 2026-11-21;Gemini 3.7 Flash 2027-01-01 起翻倍;DeepSeek V4 Flash 離峰更便宜。下單前先查各家官方定價頁。

哪個是開源的? GLM-5.3-Flash。智譜以 MIT 授權公開權重,也可不走 API 自行架設。其餘各家依官方頁面僅提供 API。

這些模型能用在 Glarity 裡嗎?可以。把 設定 → 一般 → Connect to AI 選成 OpenAI API key,貼上對應廠商的 Key,選 Custom Model 填模型代碼,脈絡視窗預設設為該模型輸入上限,API 主機與路徑照相容文件填寫。先 TestSave

該盯輸入價還是輸出價?都盯,但看任務形態:YouTube 摘要讀長篇逐字稿、寫短摘要——輸入主導;整篇翻譯/改寫會產生大量輸出 token——輸出單價主導。

Glarity 編輯團隊專注 AI 搜尋、影片總結與瀏覽器提效技巧。

Glarity 是支援 AI 搜尋與 YouTube 總結的免費瀏覽器擴充功能,可在 glarity.app 取得。