Claude Sonnet 5.5 適合有明確完成條件的工作:修正錯誤、把來源整理成簡報,或按照模板產生文件。Anthropic 9 月 28 日的發布頁表示,它比 Sonnet 5 輸出更快、每項完成任務的成本更低,同時維持每百萬 token $2 的輸入價格和 $10 的輸出價格。10 月 7 日,Anthropic 將 Sonnet 5.5 的快取讀取價格降至每百萬 token $0.10。這些是 API 價格和供應商報告的任務結果,不代表 Tabbit 訂閱方案的承諾。
在 Tabbit 中開始
開啟 Tabbit,在你的帳號模型選擇器中查看是否有 Claude Sonnet 5.5。模型頁 (简体中文)介紹模型,但不代表每個帳號都能使用。
開啟要處理的頁面或檔案。交給模型一個具體任務、指定輸出格式,以及引用證據的規則。
對照來源頁面或檔案複核結果。程式碼修改要執行專案測試並檢查差異;文件則要核對每個數字、引文和缺漏章節。
只有在需要比較品質、延遲或成本時,才用不同模型重做相同任務。
用於來源整理的提示詞
開啟來源材料後,將方括號欄位替換成你的需求:
任務:[一項具體交付物]。
只使用我提供的頁面或檔案作為證據。如果其中沒有支持某項主張的內容,請標記為「未核實」,不要猜測。
輸出:[格式和長度]。
每個重要事實都附上來源標題,以及確切的章節或連結。
完成前,按照以下驗收條件檢查輸出:[三項檢查]。
只有缺少的輸入會阻止任務完成時才提問;否則寫明合理假設並繼續。這是 Tabbit 編輯用的任務模板,不是 Anthropic 發布的提示詞。它的目的在於讓輸出便於檢查。如果任務會用到私有材料,加入任何 AI 工具前,先決定哪些內容適合分享。
什麼時候選擇 Sonnet 5.5
| 任務 | 首輪做法 | 複核條件 |
|---|---|---|
| 有可重現失敗的錯誤修正 | 提供失敗行為、受影響檔案和測試命令 | 執行測試並檢查無關修改 |
| 從開啟的頁面製作研究簡報 | 說明讀者、篇幅和引用格式 | 開啟每個引用來源 |
| 投影片或試算表初稿 | 提供模板和必填欄位 | 核對公式、數字和版面 |
| 開放式架構決策 | 將 Sonnet 草稿與 Opus 5.5 或人工審查比較 | 記錄取捨和未解決風險 |
供應商公布 Sonnet 5.5 在 Terminal-Bench 4.0 的成績為 70.6%,在 CursorBench 4.0 為 55.5%,但這些分數與其測評設定綁定,不能代表你在 Tabbit 中的工作流程。Anthropic 表示,Opus 5.5 在需要持續判斷的複雜開放式工作上仍然更強。發布頁還提到,兩項外部知識工作基準使用的預發布部署曾有結構化輸出錯誤,之後已修正。詳情和限制見逐來源測評 (简体中文)。
想做更接近的比較,可以查看 Sonnet 5.5 提示詞集合 (简体中文)、Opus 5.5 模型頁 (简体中文)和 Haiku 5.5 模型頁 (简体中文)。上一代 Sonnet 指南介紹舊版模型;Opus 5.5 測評涵蓋適合更大模型的工作;Haiku 5.5 Tabbit 指南則介紹短而可重複的任務。
讓 effort 檔位與任務匹配
Anthropic 表示,Claude 應用程式和 Claude Code 預設使用 Medium effort,Claude Platform 預設使用 High。日常工作可以先比較較低 effort 的結果和耗時。如果 Tabbit 模型介面提供 effort 控制項,請在相同任務上比較不同設定並檢查完成結果。不要假定 Anthropic API 中的設定在每個客戶端都可用。
來源
Anthropic:Claude Sonnet 5.5:發布資訊、定位、基準、effort 預設值與 API 定價;2026 年 10 月 9 日核對。
Anthropic:Claude Haiku 5.5:10 月 7 日更新 Sonnet 5.5 快取讀取價格;2026 年 10 月 9 日核對。
常見問題
可以在 Tabbit 中使用 Claude Sonnet 5.5 嗎?
請查看你目前 Tabbit 帳號的模型選擇器。可用性可能因帳號和分批發布而異。如果看到 Sonnet 5.5,先選取它並用小型測試任務驗證,再用於較大的工作流程。
Claude Sonnet 5.5 最適合什麼?
Anthropic 將它定位為適合邊界清晰的日常任務、修正錯誤,以及製作文件、投影片和試算表。需要持續判斷的開放式工作,仍值得與 Opus 5.5 比較。
Sonnet 5.5 比 Sonnet 5 便宜嗎?
API 輸入和輸出 token 價格相同。Anthropic 表示 Sonnet 5.5 每項完成任務使用的 token 更少,而且 10 月 7 日將快取讀取價格降至每百萬 token $0.10。請以自己的完成任務成本衡量。
應該使用哪個 effort 檔位?
先使用客戶端提供的 effort 檔位,測試一個有代表性的任務。Anthropic 的 Claude 應用程式和 Claude Code 預設為 Medium,Platform 預設為 High;Tabbit 可能提供不同的控制項。
基準分數能保證我的結果嗎?
不能。公開分數使用特定任務、工具和 effort 設定。請先跑一個小任務,並對照來源材料或專案測試驗證輸出。