GLM-5.3-Flash 是智譜 AI GLM-5 系列首個原生多模態模型,和 Glarity 是絕配:智譜 BigModel 平台提供的 OpenAI 相容端點、1M token 脈絡視窗、128K 輸出上限,官方快閃價僅為 GLM-5.3 的 1/10(上線促銷期 1/20)。接入 Glarity 只要五分鐘:開啟設定 → 一般,選 OpenAI API key,貼上 BigModel 金鑰,填好模型名稱、脈絡視窗、主機與路徑,儲存即可。
為什麼選智譜 GLM-5.3-Flash
GLM 是智譜 AI 的旗艦模型家族,以中文為軸心的多語系工作表現出色,而本次發布起已完全開源(MIT 授權)——權重掛在 Hugging Face 上,不是只能租用的模型。GLM-5.3-Flash 是該家族的快閃價檔次:總參數 320B,啟用 18B;採用混合稀疏注意力 + 線性注意力架構,並引入 Manifold-Constrained Hyper-Connections(mHC)。據智譜,相比 GLM-5.3,注意力計算量降至 1/3.01、KV 快取降至 1/4.44——同樣的智慧,更低的成本。它經 SGLang 跑在國產加速晶片上(encode–prefill–decode 分離架構),是不依賴單一 GPU 廠商的開源前沿模型。它支援文字、影像、影片與檔案輸入,招牌是「永遠思考」:推理可以加強,但無法關閉。
開始前需要的準備
- 在 BigModel 開放平台建立的智譜 AI API 金鑰。
- 本文連接值。
Glarity 設定步驟
進入設定 → 一般,捲動到 Connect to AI for quick Glarity summaries and translations。
- 選擇 "OpenAI API key"。
- 把 BigModel 金鑰貼到 API Key 輸入框。
- 模型 —— 選 Custom Model,輸入
glm-5.3-flash。 - 模型脈絡視窗 —— 選最接近 1,000,000 tokens(官方輸入上限;輸出 128K)的預設。整本書、一小時長的轉錄都裝得下。
- API 主機 ——
https://open.bigmodel.cn/api/paas/v4(智譜官方 OpenAI 相容基地址;官方文件明示介面與 OpenAI SDK 相容,只需替換金鑰與基地址)。 - API 路徑 ——
/chat/completions。 - 溫度 —— 1,智譜推薦預設值(搭配
top_p 0.95);要更嚴格可重現的翻譯可降到 0.5。 - Test,然後 Save。
設定一覽
欄位 | 值 | 含義 |
|---|---|---|
連接方式 | OpenAI API key | 經 BigModel 相容模式 |
模型 | Custom Model — | GLM-5 系列首個原生多模態 |
模型脈絡視窗 | 1,000,000 tokens(就近選預設) | 官方輸入上限;輸出 128K |
API 主機 |
| 官方 OpenAI 相容基地址 |
API 路徑 |
| Chat Completions 路由 |
溫度 | 1(嚴格翻譯用 0.5) | 智譜推薦設定 |
價格:同樣的智慧,快閃價
按智譜官方模型文件:GLM-5.3-Flash 定價為 GLM-5.3 的 1/10,上線限時促銷再減半(1/20)——官方頁面將其表述為「同樣智力,約 1/40 Claude Opus 4.8 的價格」。同一頁面引用的人工分析智慧指數為 57,與 Claude Opus 4.8 持平——而且是在快閃價上持平。若使用 GLM Coding Plan,該模型額度是 GLM-5.3 的 3 倍,離峰時段(含週末)僅消耗 50% 標準積分。以官方頁當前數字為準。
GLM-5.3-Flash 版 Glarity 能做什麼
功能 | 表現 |
|---|---|
翻譯 | 全頁沉浸式翻譯和左右對照字幕——參見雙語字幕教學 |
網頁總結 | 以中文為軸的自然多語言總結 |
YouTube 總結 | 基於轉錄的時間戳重點與 FAQ |
影片字幕 | 字幕生成與翻譯 |
快捷郵件回覆 | 各語言合適的語域草稿 |
一鍵提示詞 | 儲存的任務在自己模型上重跑 |
排障
- Test 回傳 401 —— 金鑰與主機需同平台:改用 open.bigmodel.cn 建立的金鑰,並確認基地址精確為
https://open.bigmodel.cn/api/paas/v4。 - "Model not found" —— 精確輸入
glm-5.3-flash;這是模型代碼,不是顯示名稱。 - 回答總是帶推理 —— GLM-5.3-Flash 的思考無法關閉,這是設計而非缺陷;想要快速隨口總結可換輕量模型。
- 長輸入被拒 —— 保持在 1M token 輸入上限內,並注意輸出上限 128K。
- 儲存後沒變化 —— 確認先 Test 再 Save。
FAQ
GLM-5.3-Flash 開源嗎?開源。智譜以 MIT 授權發布權重,官方倉庫在 Hugging Face(zai-org/GLM-5.3-Flash)。走 BigModel API 使用則是零部署的方式。
為什麼特別擅長多語言? GLM-5.3-Flash 以中文實力為底座、保留完整多語言能力,常開的思考讓術語與長文跨語言保持準確。
支援圖片和影片嗎? API 支援文字之外的圖片、影片與檔案輸入,圖片以同款 chat-completions 格式的 image_url 區塊傳入——截圖和文件可以跟問題一起帶上。
必須用中國平台嗎? open.bigmodel.cn 上的 BigModel API 是智譜官方端點;該模型在第三方託管商也有提供,開放權重還可自架。
長文更貴嗎?不貴。GLM-5.3-Flash 在 0–1M 輸入 token 內是單一快閃價,這正是 Flash 檔的意義。
Glarity 編輯團隊專注 AI 搜尋、影片總結與瀏覽器提效技巧。
Glarity 是一款免費瀏覽器擴充功能,支援 AI 搜尋與 YouTube 影片總結,可在 glarity.app 取得。



