Claude Haiku 4.5 是 Anthropic 面向互動應用、高吞吐處理和有邊界智能體步驟的快速模型。最重要的事實是它的 200,000 token 上下文:它比更大的 Claude 檔位便宜、回應更快,但不像 Sonnet 5 和 Opus 5 列出 100 萬上下文。因此,它適合抽取、分類、短編碼循環和瀏覽器尺度的任務,不應自動承擔超長、多階段計畫。
我在 2026 年 9 月 21 日核對的 Claude Haiku 4.5 模型頁列出固定 ID claude-haiku-4-5-20251001、200K 上下文、64K 最大輸出和每百萬 token 輸入/輸出 1/5 美元。Anthropic 將它標為 Active(latest),退休時間不早於 2026 年 10 月 15 日。下文說明如何驗證瀏覽器工作流;本文沒有完成登入 Tabbit 實測。
關鍵結論
Haiku 4.5 是 Anthropic 目前比較表中最快、價格最低的模型,使用手動 extended thinking,不提供新模型的自適應 effort 控制。
200K 上下文和 64K 輸出是實際邊界,不等同於 Sonnet 5 或 Opus 5 的 1M 上下文。
API 價格是輸入 1、輸出 5 美元每百萬 token;快取和 Batch API 另有規則,Claude 訂閱、雲端平台和 Tabbit 不是同一帳單。
Anthropic 宣稱它以三分之一成本和兩倍以上速度達到接近 Sonnet 4 的編碼表現。獨立結果只支持具體任務,不能證明普遍領先。
先用 Haiku 處理輸入、輸出和驗收標準都清楚的任務;需要更深計畫、更大上下文或更強審查時再升級。
Claude Haiku 4.5 速查
Claude Haiku 4.5 模型資源 (简体中文)、提示詞集合 (简体中文)和測評集合 (简体中文)保留來源路徑,但不會授予 API 額度、Claude 方案或瀏覽器權限。
| 項目 | 目前資訊 | 邊界 |
|---|---|---|
| 定位 | 目前 Claude 陣容中最快、接近前沿能力的路線 | 「最快」是陣容定位,不是你的應用延遲保證。 |
| 發布 | 2025-10-15 | 發布日期不等於目前可用。 |
| API ID | claude-haiku-4-5-20251001;別名 claude-haiku-4-5 | Bedrock、Google Cloud 使用供應商 ID。 |
| 上下文 / 輸出 | 200K / 64K token | 工具和歷史會減少有效空間。 |
| 輸入 / 輸出 | 文字和圖片 → 文字 | 工具權限來自具體 API 或客戶端。 |
| 思考 | 手動 extended thinking,沒有預設 effort | thinking budget 會改變延遲、成本和快取行為。 |
| API 價格 | 輸入 1 / 輸出 5 美元每百萬 token | 快取、Batch、訂閱和雲端帳單分開。 |
| 生命週期 | Active(latest);不早於 2026-10-15 退休 | 「不早於」不是無限期支援承諾。 |
從 Haiku 3.5 到 4.5 改了什麼
Anthropic 將 Haiku 4.5 定位為效率升級:小模型以更快、更便宜的路線提供接近前沿的能力。官方發布稱它以三分之一成本和兩倍以上速度達到類似 Sonnet 4 的編碼表現,並改善電腦使用。這些是發布方結論,不是最新的統一獨立複測。
遷移指南中更值得注意的是工程變化:替換模型 ID,重新檢查獨立限額;從 Claude 3.x 遷移時只使用 temperature 或 top_p 其中一個;更新工具版本,移除 undo_edit;處理 refusal stop reason;並適應 Claude 4 更簡潔直接的表達。複雜推理可手動開啟 extended thinking 並設定預算,不能假定它有 Sonnet 5 的 adaptive 控制。
| 遷移問題 | Haiku 3.5 → 4.5 | 需要驗收 |
|---|---|---|
| 模型字串 | claude-3-5-haiku-20241022 → claude-haiku-4-5-20251001 | 固定快照、別名和供應商 ID。 |
| 參數 | 舊程式可能同時設定兩個取樣參數 | 只留 temperature 或 top_p,確認不會 400。 |
| 工具 | 可能依賴舊工具版本 | 更新 editor/code execution,移除 undo_edit。 |
| 停止原因 | 處理器可能只處理成功文字 | 明確處理 refusal 並測試回退。 |
價格、取得方式與 200K 邊界
目前價格頁列出輸入 1、輸出 5 美元每百萬 token。5 分鐘快取寫入為 1.25 美元,1 小時寫入為 2 美元,快取命中為 0.10 美元。Batch API 將輸入和輸出打五折,但非同步批次成本不能代表互動延遲。區域和市場平台也可能有自己的加價和計費單位。
| 渠道 | Anthropic 文件說明 | 仍需檢查 |
|---|---|---|
| Claude API | 固定 ID、別名、token 價格和手動思考 | 組織限額、快取、速率和狀態。 |
| Claude 產品 / Code | 發布時已進入 Anthropic 產品和 Code | 方案、即時選擇器、額度、工具和地區。 |
| Bedrock / Vertex / Foundry | 列出供應商 ID 和可用渠道 | 地區、端點、配額、資料條款和帳單。 |
| Tabbit Browser | 獨立的瀏覽器客戶端 | 即時模型、有效上下文、工具權限和帳號。 |
200K 不是腳註。90 頁文件、很長的瀏覽器工作階段或程式庫加工具歷史可能在模型得出結論前耗盡上下文。此時應分塊並保留引用、壓縮穩定上下文,或升級到 Claude Sonnet 4.6、Claude Sonnet 5或更大模型。不要把 API 單價當成 Claude 訂閱或 Tabbit 價格。
獨立測試說明了什麼
DataLLM Lab 在 2026 年 7 月 29 日用九個獨立 Python 函式測試,Haiku 4.5 得到 9/9,平均 3.7 秒,每千任務測得 0.94 美元,與 Sonnet 5 和 Opus 4.8 在該測試中持平。作者明確說這不涵蓋長上下文重構、智能體循環或模糊規格,所以它只能支持有邊界的函式任務。
ORCFLO 在 2026 年 5 月 10 日的 32 模型批次中測試分析、寫作、抽取、摘要和行為可靠性,由四名獨立評審打分。Haiku 4.5 品質排名 20/32,成本 13/32,回應時間 11/32。這支持「吞吐組合有價值」,不支持「所有任務品質領先」。一項 2026 年程式碼審查研究使用 150 個樣本,也只能代表其資料、評審和任務設計,不能替代 Tabbit 測試或人工複核。
社群回饋同樣指向邊界。ClaudeAI 討論中有人認為工具呼叫更快,但複雜計畫較弱;文件解析討論中有人認為結構化抽取優於更大模型;另有使用者描述無人看管的編譯流程刪除目錄。它們是工作負載訊號,不是受控統計。
按場景制定升級規則
| 工作負載 | 先用 | 何時升級 | 驗收 |
|---|---|---|---|
| 分類、抽取、短摘要 | Haiku 4.5 | 需要跨文件深度對齊 | schema 和抽樣來源一致。 |
| 小型編碼、lint 修復 | Haiku 4.5 + 測試 | 多檔案計畫或測試連續失敗 | diff、測試、複核和回滾。 |
| 長 PDF、研究合成 | 分塊 Haiku 4.5 | 接近 200K 或引用漂移 | 頁面覆蓋、引用和人工抽查。 |
| 複雜智能體計畫 | 對比 Sonnet / Opus | 計畫遺失或工具重複 | 步驟、停止條件和紀錄。 |
| 高吞吐互動介面 | Haiku 4.5 | 錯誤代價高於 token 節省 | p95、修正率和接受結果。 |
Reddit 的 Claude Code 成本討論給出了一種合理路由:日常任務先用 Haiku,變難後切到 Sonnet。這是個人策略,不是訂閱額度與 API 價格的換算。
Tabbit Browser 的實踐邊界
當任務從網頁、標籤組、截圖或本機檔案開始時,Tabbit Browser可以提供獨立的瀏覽器工作流。它不會增加 Anthropic 的 200K 上下文、改變退休日期或授予 Claude API 額度。本文沒有登入 Haiku 4.5 實測,因此不聲稱選擇器、有效上下文、延遲或工具行為。
如果即時選擇器顯示 Haiku 4.5,請從公開、可回滾的頁面任務開始,記錄模型名稱、來源 URL、工具權限和停止行為,用已知答案的抽取任務比較結果,再測試一次應當升級的任務。AI 瀏覽器指南、瀏覽器自動化指南和智能體瀏覽器說明解釋了客戶端邊界,但不會證明你的帳號可用。
未知風險與結論
200K 是上限,工具、歷史和輸出會進一步壓縮可用空間。
手動 thinking budget 會改變延遲、token 和快取效率,應單獨記錄。
API、Bedrock、Vertex、Foundry、Claude Code 和瀏覽器可能有不同 ID、限制和退休時間。
社群既有快速成功,也有破壞性錯誤;寫入操作需要測試、權限邊界和人工確認。
目前狀態是 Active(latest),但「不早於 2026-10-15」不是無限期承諾。
Claude Haiku 4.5 適合作為短任務、重複任務和高吞吐工作中的效率優先預設值。它的價值不是「小模型取代一切」,而是很多任務並不需要 1M 上下文和更貴檔位。先固定輸入、輸出和驗收標準,任務需要深度計畫、更長上下文或複雜審查時再升級。固定模型 ID、保留回滾路徑,並把 Tabbit 可用性視為獨立的即時帳號問題。
來源與 FAQ
主要來源是 Anthropic 的發布公告、模型頁、遷移指南、價格頁和生命週期頁。獨立來源包括 DataLLM Lab、ORCFLO和程式碼審查研究。社群連結隨論點給出。
Claude Haiku 4.5 還可用嗎?
Anthropic 模型頁將它列為 Active(latest),退休不早於 2026 年 10 月 15 日。具體供應商、帳號和產品仍需即時確認。
200K 足夠處理大文件嗎?
有邊界的文件可能足夠,但工具、歷史和輸出也會佔用上下文。接近上限時使用分塊、引用和人工抽查。
Haiku 4.5 支援 extended thinking 嗎?
支援手動 extended thinking,需要設定 budget_tokens;它沒有新 Claude 檔位的 adaptive/default-effort 控制。應分別比較開啟和關閉的結果。
Haiku 4.5 比 Sonnet 便宜嗎?
API 標價為輸入/輸出 1/5 美元每百萬 token,Sonnet 5 為 2/10,Sonnet 4.6 為 3/15。快取、批次、重試、輸出長度和產品渠道會改變實際成本。
Haiku 4.5 能取代 Opus 程式設計嗎?
它能處理有邊界的編碼和常規修復,窄任務基準也可能持平。複雜計畫、廣泛審查和模糊需求應透過固定回歸樣本決定,而不是一概取代。
Tabbit Browser 能用 Haiku 4.5 嗎?
本文沒有驗證登入後的 Tabbit 帳號。請檢查即時模型選擇器;這只能證明帳號層面的結果,不能證明 Anthropic API 權限或價格。
常見問題
Claude Haiku 4.5 是什麼?
Claude Haiku 4.5 是 Anthropic 於 2025 年 10 月 15 日發布的快速、低成本模型。固定 API ID 是 claude-haiku-4-5-20251001,便利別名是 claude-haiku-4-5。它適合互動式與高吞吐任務,但不是所有長流程的預設答案。
Claude Haiku 4.5 的上下文和輸出上限是多少?
目前 Claude Platform 頁面列出 200,000 token 上下文與 64,000 token 最大輸出。這些是模型上限;客戶端、供應商或瀏覽器扣除工具、歷史與安全控制後,可能暴露更少。
Claude Haiku 4.5 多少錢?
Anthropic 列出的價格是每百萬輸入 token 1 美元、輸出 5 美元。5 分鐘快取寫入為 1.25 美元,1 小時寫入為 2 美元,快取讀取為 0.10 美元,Batch API 的輸入和輸出有五折優惠。訂閱與供應商帳單另計。
Claude Haiku 4.5 適合程式設計嗎?
它適合有邊界的編碼、讀程式碼、修 lint 和高吞吐智能體步驟。公開結果取決於任務:一個九函式 Python 測試得到 9/9,但社群也記錄複雜或無人看管計畫中的錯誤。應搭配測試與升級規則。
在哪裡可以使用 Claude Haiku 4.5?
Anthropic 列出 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS。Claude 產品也提供此模型,但帳號、地區、額度、工具和即時選擇器可能與 API 不同。
可以在 Tabbit Browser 使用 Claude Haiku 4.5 嗎?
本文沒有登入 Tabbit 實測,因此不聲稱選擇器可見、有效上下文或延遲。請查看即時選擇器並執行一個小型可回滾任務;Tabbit 的可用性和價格不是 Anthropic API 權益。