Claude Haiku 5.5 是 Anthropic 面向高頻、重視時效工作的輕量模型。Anthropic 10 月 7 日的發布頁提到摘要、上下文壓縮、資料庫查詢、分類、客服、瀏覽器操作和窄範圍編碼子代理任務。模型 ID 是 claude-haiku-5-5。規劃工作流程前,請先查看你的 Tabbit 帳號模型選擇器;本文不代表每個帳號都能使用。
在 Tabbit 中使用的四個步驟
如果模型選擇器中出現 Claude Haiku 5.5,先選取它。
一次交給它一個有明確邊界的任務,寫清楚輸入、輸出結構,以及什麼情況算是不確定答案。
先跑少量樣本,檢查輸出是否遵守結構,以及其中的事實是否符合來源材料。
需要更廣泛上下文、複雜編碼或跨衝突證據做判斷的例外,交給 Sonnet 5.5 或人工複核。
處理高吞吐工作時,保留幾個有代表性的範例,記錄準確率、延遲和返工量。API token 單價不能單獨衡量完成一項任務的成本。
可複製的任務模板
只處理我提供的材料。
任務:[摘要、分類或抽取一個明確項目]。
只返回這些欄位:[欄位名稱與允許值]。
如果來源不支持某個欄位,填寫「未知」。不要憑記憶補全。
每個非平凡答案都保留簡短的來源定位作為證據。
傳送前檢查每個欄位都已填寫,且沒有加入無來源支持的主張。這是 Tabbit 編輯為有明確邊界的工作流程提供的模板,不是 Anthropic 發布的 Haiku 提示詞。處理敏感資料前,請遵守組織的資料處理規則。
按工作選擇模型
| 工作 | Haiku 5.5 適合的原因 | 需要升級的情況 |
|---|---|---|
| 摘要大量短頁面 | 輸出一致和低延遲很重要 | 決策依賴長鏈的多來源推理 |
| 分類客服工單 | 固定標籤集讓錯誤可測量 | 誤判成本很高 |
| 從頁面抽取欄位 | 缺失欄位可以標為 unknown | 版面或上下文含糊 |
| 窄範圍檔案修改的編碼子代理 | 任務容易測試和複核 | 修改跨越多個系統或需要架構決策 |
Anthropic 報告 Haiku 5.5 在 Terminal-Bench 4.0 的成績為 39.2%,Sonnet 5.5 為 70.6%。Haiku 5.5 在 OSWorld 2.1 的成績為 72.4%,測試範圍是離線子集。這些是有特定任務設定的供應商基準,不是 Tabbit 的效能保證。模型測評集合 (简体中文)會在各來源旁記錄測試條件。
Haiku 5.5 提示詞集合 (简体中文)整理模型專屬配置;Sonnet 5.5 模型頁 (简体中文)和 Sonnet 5.5 Tabbit 指南介紹下一級模型。舊版本請參考 Haiku 4.5 模型頁 (简体中文)、Haiku 4.5 指南、Sonnet 5 指南和 Opus 5.5 模型頁 (简体中文)。
價格與 effort:先看適用條件
在 Anthropic API 上,提示詞不超過 100,000 token 時,每百萬輸入 token 的價格為 $0.10,每百萬輸出 token 為 $0.50;超過該門檻後,標示價格為 $0.50 和 $2.50。兩個檔位的快取讀取價格分別是每百萬 token $0.01 和 $0.05。這些數字不代表 Tabbit 方案計費。Haiku 5.5 是第一個支援可調 effort 的 Haiku 模型。如果你的客戶端提供該設定,請在相同任務上測試 effort,同時衡量完成任務的品質與速度。
來源
Anthropic:Claude Haiku 5.5:發布資訊、基準條件、價格和 effort;2026 年 10 月 9 日核對。
常見問題
可以在 Tabbit 中使用 Claude Haiku 5.5 嗎?
請查看你目前 Tabbit 帳號的模型選擇器。如果看得到 Haiku 5.5,先用一個小型、可驗證的任務開始。模型可用性可能因帳號和分批發布而異。
什麼時候該用 Haiku 5.5,而不是 Sonnet 5.5?
對許多重視延遲和處理量的簡短、可重複任務,可以先用 Haiku 5.5。任務需要更廣泛的推理、複雜編碼或持續判斷時,再升級到 Sonnet 5.5。
Haiku 5.5 的價格是多少?
Anthropic API 會按提示詞是否超過 100,000 token 分檔。未超過時,每百萬 token 的輸入和輸出價格分別為 $0.10 和 $0.50;超過後為 $0.50 和 $2.50。Tabbit 方案的計費可能不同。
應該從哪個 effort 檔位開始?
如果你的客戶端提供 effort 設定,先用預設檔位跑小樣本,再在相同任務上比較較低和較高檔位。Haiku 5.5 是第一個支援可調 effort 的 Haiku 模型。
Haiku 5.5 能取代 Sonnet 進行編碼嗎?
先讓它處理有明確測試的窄範圍修改。Anthropic 公布的 Terminal-Bench 4.0 成績明顯低於 Sonnet 5.5,因此複雜的多步驟編碼應另外比較並複核。