OpenAI 相容模型的定價變化很快,而且每家算法都不一樣——促銷窗口、快取檔位、尖峰/離峰時段。這是截至 2026 年 8 月的菜單:6 個具備 OpenAI 相容端點的模型,可直接接入 Glarity 這類瀏覽器擴充功能(一組 Key、一個 API 主機、一個路徑)。先講結論:Claude Opus 5($5/$25 每百萬 token)與 GPT-5.6 Sol($4/$20)是旗艦層;Gemini 3.7 Flash、GLM-5.3-Flash、DeepSeek V4 Flash 是性價比層;Qwen3.6-Plus($0.50/$3.00)居中,帶 100 萬 token 輸入視窗。
六個模型,價格橫排比較
價格均為 2026 年 8 月 28 日時點的官方費率(每 100 萬 token,即 MTok)。來源:Anthropic、OpenAI、Google、智譜、阿里雲、DeepSeek:
模型 | 輸入 / 輸出(每 MTok) | 脈絡 / 最大輸出 | 備註 |
|---|---|---|---|
Claude Opus 5 | $5.00 / $25.00 | 1M / 128K | 與 Opus 4.8 同價;思考預設開啟 |
GPT-5.6 Sol | $4.00 / $20.00(短脈絡)· $8.00 / $30.00(長脈絡) | — | 快取輸入 $0.40;促銷價至少到 2026-11-21 |
Gemini 3.7 Flash | $0.75 / $3.75(促銷) | — | 促銷至 2026-12-31,之後 $1.50 / $7.50;快取 $0.075;有免費額度 |
GLM-5.3-Flash | GLM-5.3 的 1/10(促銷期 1/20) | 1M / 128K | 智譜官方口徑:同等智力約為 Claude Opus 4.8 的 1/40;MIT 開源權重 |
Qwen3.6-Plus | $0.50 / $3.00(輸入 ≤256K)· $2.00 / $6.00(256K–1M) | 1M / — | 國際站(Singapore)費率 |
DeepSeek V4 Flash | $0.22 / $0.66(離峰)· $0.44 / $1.32(尖峰) | 1M / 384K | 快取命中輸入低至 $0.007;尖峰時段為 UTC 週一至五 01:00–04:00 與 06:00–10:00 |
每月 1 億 token 要花多少錢?
一個貼近現實的摘要工作負載:1 億 token 輸入(網頁、逐字稿、文件)+ 1000 萬 token 輸出(摘要、回答):
模型 | 1 億輸入 + 1000 萬輸出 |
|---|---|
Claude Opus 5 | $750 |
GPT-5.6 Sol | $600(短脈絡標準價) |
Gemini 3.7 Flash | $112.50(促銷;2026-12-31 後為 $225) |
Qwen3.6-Plus | $80(請求 ≤256K 輸入;多數超出則為 $260) |
DeepSeek V4 Flash | $28.60(離峰;尖峰 $57.20,快取命中輸入可降到數十美元以下) |
GLM-5.3-Flash | 官方僅公布相對價 — 智譜口徑:GLM-5.3 的 1/10,促銷 1/20,同等智力約 Opus 4.8 的 1/40 |
輸入密集的用法(翻譯、反覆讀同一篇原文)適合「輸入便宜或快取便宜」的模型;輸出密集的用法(改寫、長摘要)適合輸出單價低的模型。
場景選型:什麼任務配什麼模型
任務 | 選它 | 理由 |
|---|---|---|
長文件研究、嚴謹查證 | Claude Opus 5 | 100 萬脈絡、思考預設開;正確性優先時這 $5/$25 花得有值 |
超大檔案內容抽取 | GPT-5.6 Sol | 長脈絡檔強;促銷期內短脈絡標準價 $4/$20 |
整頁 / 整篇翻譯 | DeepSeek V4 Flash | 離峰 $0.22 輸入,快取命中 $0.007 — 反覆重讀同一原文幾乎免費 |
日常頁面與 YouTube 摘要 | Gemini 3.7 Flash 或 GLM-5.3-Flash | 促銷期輸入低於 $1;GLM-5.3-Flash 另有 MIT 開源權重、1/10 價格 |
高頻輕量問答、草稿 | Qwen3.6-Plus | 輸入 ≤256K 時 $0.50 / $3.00 |
常駐逐字稿類負載 | DeepSeek V4 Flash(離峰) | 輸出 $0.66 — 六家官方表中最低的輸出單價 |
為什麼 OpenAI 相容對瀏覽器擴充這麼關鍵
Glarity 的 設定 → 一般 → Connect to AI 只收:OpenAI API Key、模型名稱、脈絡視窗預設、API 主機、API 路徑——所以任何提供 OpenAI 風格 /chat/completions 端點的廠商都能接。上面 6 家全部支援:Anthropic 公開了 OpenAI SDK 相容層,https://api.anthropic.com/v1/ 即可接上(官方說明用於測試與比較,而擴充的模型切換正是這個場景);Google Gemini API 提供 OpenAI 相容模式;智譜為 GLM 系列提供 OpenAI 相容基底;阿里雲 Model Studio 與 DeepSeek 天生 OpenAI 相容;OpenAI 本身就是。
切換模型時,Glarity 裡的任務(摘要、翻譯、問答)不動,變的只有主機、Key 與每 token 單價。逐步設定見在 Glarity 使用 Qwen3.6-Plus與在 Glarity 使用 GLM-5.3-Flash。
FAQ
6 個裡哪個最便宜?取決於流量形態。輸入密集的活,DeepSeek V4 Flash 是官方最低(離峰 $0.22,快取命中 $0.007)。日常混合摘要,則是 Gemini 3.7 Flash 促銷價($0.75/$3.75)與 Qwen3.6-Plus($0.50/$3.00,輸入 ≤256K)最划算,且不受時段限制。
價格會變嗎?會,好幾個是促銷價。GPT-5.6 Sol 促銷至少到 2026-11-21;Gemini 3.7 Flash 2027-01-01 起翻倍;DeepSeek V4 Flash 離峰更便宜。下單前先查各家官方定價頁。
哪個是開源的? GLM-5.3-Flash。智譜以 MIT 授權公開權重,也可不走 API 自行架設。其餘各家依官方頁面僅提供 API。
這些模型能用在 Glarity 裡嗎?可以。把 設定 → 一般 → Connect to AI 選成 OpenAI API key,貼上對應廠商的 Key,選 Custom Model 填模型代碼,脈絡視窗預設設為該模型輸入上限,API 主機與路徑照相容文件填寫。先 Test 再 Save。
該盯輸入價還是輸出價?都盯,但看任務形態:YouTube 摘要讀長篇逐字稿、寫短摘要——輸入主導;整篇翻譯/改寫會產生大量輸出 token——輸出單價主導。
Glarity 編輯團隊專注 AI 搜尋、影片總結與瀏覽器提效技巧。
Glarity 是支援 AI 搜尋與 YouTube 總結的免費瀏覽器擴充功能,可在 glarity.app 取得。



