如何在 Glarity 中使用 Claude Sonnet 5.5:四步設定、真實成本與相較 Sonnet 5 的變化

把 Anthropic 的 Claude Sonnet 5.5 接入 Glarity:一組 API 金鑰、一個模型 ID(claude-sonnet-5-5),以及相較 Sonnet 5 唯一改變的那項設定。

Anthropic 於 2026 年 9 月 28 日發布 Claude Sonnet 5.5,這是其 5.5 家族的第二個模型,價格與它所取代的 Sonnet 5 完全相同——每百萬輸入 token 2 美元、每百萬輸出 token 10 美元。價格不變換來的是輸出速度提升 30% 以上,而且因為達成同樣答案所需的 token 更少,每個任務的成本最多降低 30%。接入 Glarity 只需四步:選擇 OpenAI API 金鑰(Anthropic 透過 OpenAI SDK 相容層也能使用這個項目)、貼上 sk-ant- 金鑰、在自訂模型填入 claude-sonnet-5-5,並讓主機維持在 https://api.anthropic.com/v1。但有一點與本站先前的 Claude 教學已經不同,照搬舊步驟就會出錯:溫度這一欄請不要填。Anthropic 的 Sonnet 5.5 模型頁明確寫著,非預設的 temperature 會回傳錯誤。以下詳細說明。

Claude Sonnet 5.5 規格速覽

欄位

值

模型 ID

claude-sonnet-5-5

發布日期

2026 年 9 月 28 日——退役時間不早於 2027 年 9 月 28 日

上下文視窗

100 萬 token——依現行分詞器約合 55.5 萬英文單字

最大輸出

12.8 萬 token(批次 API 搭配 beta 標頭可達 30 萬)

知識截止

2026 年 6 月

輸入 → 輸出

文字與圖像 → 文字

思考

自適應思考預設開啟,由 effort 調節(Claude API 上預設 high)

定價

輸入 $2 / 輸出 $10(每百萬 token);快取寫入 $2.50(5 分鐘)與 $4(1 小時),快取讀取 $0.20

速度

輸出比 Claude Sonnet 5 快 30% 以上,單一 token 價格相同

以上規格來自 Anthropic 的模型頁與發布公告。真正讓升級成立的是公告裡的數字:在 Terminal-Bench 4.0 上,Sonnet 5.5 得分 70.6%,而 Sonnet 5 為 10.3%、Claude Opus 5.5 為 66.4%;在衡量 44 種職業真實工作產出的 GDPval-AA v2.1 上得分 1844,距 Opus 5.5 的 1846 僅約兩分,比 Sonnet 5 的 1449 高出約 400 分。此外還有 OSWorld 2.1 的 80.1%、Humanity's Last Exam(搭配工具)的 64.5%、CursorBench 4.0 的 55.5%,它也是首個僅憑截圖通關《寶可夢 紅》的 Sonnet 模型。必須說明的是,這些是 Anthropic 的內部評測而非第三方結論;而且 Anthropic 坦率指出,在需要持續判斷的複雜開放式工作上,Opus 5.5 依然明顯更強。Sonnet 5.5 用 Opus 五分之一的價格補上了大部分差距,但並沒有抹平它。

為什麼這個模型適合 Glarity

Glarity 每天做的事都是「閱讀」類工作:整理頁面、翻譯頁面、把一小時 YouTube 影片變成筆記、就正在看的文件提問。Sonnet 5.5 有三個特性直接對應這些情境。

  • 快。 摘要工具的體驗取決於面板空白的時間。生成速度提升 30% 以上,差別就是「你在等摘要」還是「摘要已經在那裡了」。
  • token 效率高。 Glarity 透過 OpenAI 相容層連接 Anthropic,而該相容層不支援提示快取,每一輪都會重新計費全部輸入。用更少的 token 得到同樣的答案,在這裡不是邊際節省,而是整個成本結構。
  • 視窗比文件大。 100 萬 token 可以一次裝下 300 頁的書,模型同時看到開頭與結尾,不必把各章筆記拼湊起來。

Sonnet 5.5 也支援圖像輸入,這對瀏覽器擴充功能很實用:圖表、掃描頁、截圖都能不離開目前分頁就完成翻譯或解讀。

相較 Sonnet 5 教學發生了什麼變化

如果你已經按本站的 Claude Sonnet 5 設定教學接好了,有三處變化值得知道,其中只有第一處直接影響 Glarity 使用者。

一、非預設的取樣參數現在會報錯。 Anthropic 的 Sonnet 5.5 模型頁在「Good to know」中寫明:把 temperature、top_p 或 top_k 設為非預設值會回傳錯誤。這推翻了本站先前所有 Claude 教學的建議——把溫度設為 0.5,嚴格直譯時設為 0.2。在 Sonnet 5.5 上,溫度一欄保持預設。如果你已有可用的 Sonnet 5 設定,只改模型 ID 才是正確做法;既改模型 ID 又重新填入 0.5,就會撞上一整片錯誤。

二、關閉思考的寫法變了。 Sonnet 5 可以送出 thinking: disabled,而 Sonnet 5.5 會報錯並指向 between_tools。透過 Glarity 你永遠不會送出這兩個參數——擴充功能沒有暴露思考設定——所以這只對自行維護 Claude 整合的人有意義。經由 Glarity,自適應思考以預設的 high effort 執行,無需任何設定。

三、Sonnet 首次導入安全層。 Sonnet 5.5 是首個搭載與 Opus 級別相當的網路安全防護與回退機制的 Sonnet,也是首個帶推理抽取防護分類器的 Sonnet。實際影響是:可能助長網路攻擊的請求會被拒絕,而 Anthropic 的伺服器端回退會把這類請求改用 Claude Sonnet 5 重試。對摘要用途而言這基本上無感,但如果你用 Glarity 處理資安研究或攻擊工具類材料,可能會在舊 Claude 模型會直接作答的地方遇到偏 Sonnet 5 的回答或直接拒絕。

四步完成接入

打開 Glarity,進入設定 → 一般,捲動到「連接 AI 以獲得快速的 Glarity 摘要與翻譯」。

  1. 選擇「OpenAI API 金鑰」。Anthropic 提供了接受 OpenAI 格式請求的 OpenAI SDK 相容層,因此這個項目對 Anthropic 同樣適用。
  2. 把 Anthropic API 金鑰貼到 API 金鑰欄位。金鑰以 sk-ant- 開頭,在 Claude Console 產生。OpenAI 的金鑰在這裡不管用。
  3. 模型選擇自訂模型,準確填入 claude-sonnet-5-5。如果下拉選單裡已經出現 Claude Sonnet 5.5,直接選它也行——無論哪一種,ID 才是準繩。
  4. 溫度保持預設,點擊測試,再點擊儲存。

有兩個欄位維持預設值,但請確認一次。API 主機為 https://api.anthropic.com/v1——Anthropic 相容層快速開始所給的基礎位址;API 路徑為 /chat/completions。如果先前的設定殘留了別家的主機,請改回來,這也是測試回報連線錯誤而非模型錯誤時的解決辦法。模型上下文視窗選擇最大的檔位,100 萬 token 的模型上限才是真實邊界,檔位只是安全閥。

一次工作階段的真實成本

每百萬輸入 token 2 美元,意味著單一 token 價格是 Claude Fable 5.1 的五分之一。下表沿用我們為 Fable 5.1 做過的工作階段表,按 Sonnet 5.5 的費率計算——均為估算,實際 token 數會隨語言與頁面複雜度變化。

你餵給它的內容

輸入 token

輸出 token

約合成本

1 小時 YouTube 影片 → 摘要

約 12,000

約 800

約 $0.03

30 頁報告 → 摘要 + 對話

約 40,000

約 1,500

約 $0.10

300 頁書籍 → 全書摘要

約 230,000

約 3,000

約 $0.49

大型調研資料(輸入約 50 萬)

約 500,000

約 8,000

約 $1.08

同樣資料改用 Claude Fable 5.1

約 500,000

約 8,000

約 $5.40

這張表有兩種讀法。第一,日常那幾行幾乎是零頭——一支影片摘要三分錢,用這個模型重度閱讀一週,花費還不如一個三明治。第二,Sonnet 5.5 與 Sonnet 5 的價差根本不在這張表裡:兩者公布的費率相同。差距在於 Sonnet 5.5 用更少的 token 完成同一任務(Anthropic 稱最多減少 30%),而既然相容層每一輪都重新計費全部輸入,這份效率就直接等於你的支出。

需要注意的地方與 Fable 5.1 教學相同:相容層不支援提示快取。宣傳中的 $0.20 快取讀取價只適用於使用 Anthropic 原生 API 的應用程式。經由 Glarity,圍繞一本 23 萬 token 的書展開的多輪對話,每一輪追問都會重新計費整本書。把想問的一次寫進一個完整請求,$0.49 才會停在一個「單次」的數字上。

什麼時候用,什麼時候跳過

把它當作你的預設 Claude 通道。這是一次罕見的、沒有取捨的升級:與 Sonnet 5 同價,更快,每任務 token 更少,而且 Anthropic 公布的所有評測都更好。如果你現在連接的是 claude-sonnet-5,把那個欄位改成 claude-sonnet-5-5,是這篇文章裡性價比最高的五秒鐘。

在以下情境積極使用:長文件、數小時的逐字稿、必須保住語氣與術語的翻譯,以及任何你原本會印出來閱讀的工作階段。

在兩種情況下跳過。如果只是短而隨意的使用——讀幾段、掃一眼頁面——Flash 級模型便宜得多,品質差異你也感覺不到。另外,把 Claude Fable 5.1 留給真正需要持續判斷的開放式工作:它每百萬 token 為 $10 / $50,價格是五倍,而 Anthropic 自身的建議是只有在更便宜模型的產出不足時才上一檔。對 Glarity 的絕大多數用途來說,這條線現在正落在 Sonnet 5.5 上。

在 Claude 模型之間切換只需改一個欄位——Glarity 的「連接 AI」同一時間只運行一組設定,所以從 Sonnet 5.5 換到 Fable 5.1,只需改模型名稱。

出錯時怎麼辦

現象

可能原因

處理

設定溫度後測試立刻回傳 400

Sonnet 5.5 拒絕非預設的取樣參數

把溫度欄位清回預設值,重新測試

測試回傳 401

金鑰錯誤,或填入了 OpenAI 金鑰

在 Claude Console 產生金鑰(以 sk-ant- 開頭)並重新貼上

提示「找不到模型」

輸入的 ID 不準確

填入 claude-sonnet-5-5,不是 5.5,也不帶日期後綴

529 或「Overloaded」

Anthropic 自身的過載錯誤

稍等後重試,相容層會原樣透傳 Anthropic 的狀態碼

測試回報連線錯誤

先前設定殘留了其他主機

把 API 主機設為 https://api.anthropic.com/v1,路徑設為 /chat/completions

429 或觸發速率限制

金鑰所屬層級的 RPM/TPM 上限

稍等,並在 Console 申請提高額度

長請求被拒絕

超出 100 萬 token 視窗

拆分文件;100 萬 token 依現行分詞器約合 55.5 萬英文單字

常見問題

Claude Sonnet 5.5 免費嗎?不免費,每次呼叫都按 token 計費。Anthropic 的定價 FAQ 提到新帳號會獲得少量用於測試的免費額度,最多夠跑幾次。請依你實際閱讀量做預算——在這個模型上,這筆預算很小。

為什麼有些模型列表把它寫成 `anthropic/claude-sonnet-5.5`?那是模型目錄使用的帶廠商前綴的顯示名稱。Claude API 本身接受的 ID 是 claude-sonnet-5-5,沒有斜線也沒有點號。請把它填進自訂模型。

我對 Claude Sonnet 5 已經滿意,還需要換嗎?需要。價格完全相同,輸出更快,而且 token 效率讓同樣的工作階段更便宜。沒有哪一種情況是留在 Sonnet 5 更省錢的——這並不是模型升級常見的樣態,值得用上。

資安相關的摘要會被拒絕嗎?有可能。Sonnet 5.5 是首個帶前沿級網路安全防護的 Sonnet,可能助長網路攻擊的請求會被拒絕,或經 Anthropic 的伺服器端回退改用 Claude Sonnet 5。常規的資安閱讀——公告、事件報告、政策文件——不受影響。

這會取代我的 Fable 5.1 設定嗎?大多數工作階段裡會。Fable 5.1 是更高一檔,請保留兩套憑證,在確實需要 Sonnet 5.5 給不出的持續判斷時改一下模型欄位即可切換。

翻譯時溫度應該設成多少?保持 Glarity 的預設值。先前 Claude 教學裡的 0.2 早於 Sonnet 5.5 的參數變更,很可能在測試這一步就失敗。

Glarity 編輯部專注於 AI 搜尋、影片摘要與瀏覽器效率技巧。

Glarity 是免費的瀏覽器擴充功能,支援 AI 搜尋與 YouTube 影片摘要,可在 glarity.app 取得。