Claude Opus 4.8 是 Anthropic 於 2026 年 5 月發布的模型,面向複雜編碼、瀏覽器代理、工具呼叫和長上下文知識工作。它仍適合受控試用,但截至 2026 年 9 月 20 日,Claude Platform 已把它標為 Legacy,並建議考慮 Opus 5。
這是今天的決策錨點。平台仍列出與 Opus 4.7 相同的標準價格——輸入每百萬 token 5 美元、輸出 25 美元——以及 1M 上下文、128K 輸出和 adaptive thinking。新整合需要同時問:4.8 能否解決任務,以及支援週期是否值得採用?先看 Claude Opus 4.8 模型資源 (简体中文),再確認實際入口。
關鍵結論
4.8 是 4.7 的後繼版本,加入 effort 控制、Fast Mode 和 Claude Code 的 Dynamic Workflows。
官方目錄列出
claude-opus-4-8、1M 上下文、128K 輸出、adaptive thinking、預設 high effort 和 2026 年 1 月知識截止。獨立早期評測在一個綜合指數中領先,但引用的 Terminal-Bench 2.1 中 GPT-5.5 更高;必須保留 harness。
更高 effort、思考、長上下文和重試會改變單任務費用;$5/$25 不是任務預算。
它仍可用,但新生產整合應先比較 Opus 5 並記錄遷移方案。
規格與取得
| 項目 | 2026-09-20 目錄快照 | 決策邊界 |
|---|---|---|
| API ID | claude-opus-4-8 | 在日誌固定完整 ID,提供商別名可能不同。 |
| 發布與狀態 | 2026-05-28;Active (legacy) | 可用不等於目前家族終點。 |
| 上下文 / 最大輸出 | 1M / 128K token | 目錄上限,用戶端或提供商可能更小。 |
| 輸入 / 輸出 | 文字、圖片 / 文字 | 工具和瀏覽器權限取決於入口。 |
| thinking / effort | adaptive;預設 high;支援 extra/xhigh、max | 應按任務比較 effort。 |
| 標準 API 價格 | 輸入 $5 / 輸出 $25 / MTok | 快取、Batch、Fast Mode、提供商和方案另計。 |
| 知識截止 | 2026 年 1 月 | 目前事實需要檢索或來源核對。 |
| 退役 | 不早於 2027-05-28 | 新專案應問是否直接選 Opus 5。 |
提示資源 (简体中文)和評測資源 (简体中文)適合查看原始條目,本文集中討論生命週期與工作負載選擇。
與 Opus 4.7 的變化
Anthropic 強調 4.8 在判斷、未完成工作自報、遵循指令和工具效率上的改進,並稱在其評估中,4.8 讓程式碼缺陷未經提示通過的機率約低四倍。這是官方評估,不代表你的儲存庫無需測試。
三個產品變化值得注意:預設 high,困難或非同步任務可用 extra/xhigh 和 max;Fast Mode 是同一模型約 2.5 倍速度的路線,價格為輸入 $10、輸出 $50 / 百萬 token;Dynamic Workflows 是 Claude Code Enterprise、Team 和 Max 的研究預覽,可規劃大型任務、並行數百個子代理並驗證結果。
獨立報告並非單向勝利。一位長期 Reddit 使用者稱 4.8 在 Playwright、Cloud CLI 和 Kubernetes CLI 上是明顯更新,但某些超大程式碼庫中 GPT-5.5 更自主;另一條早期討論則稱 4.8 在修復壞程式碼時給出快速而自信但有問題的答案(報告;討論)。這些只證明具體場景經驗。
基準與安全:先看 harness
獨立早期彙總給出混合結果:Artificial Analysis 綜合 Intelligence Index 為 61.4,GPT-5.5 為 60.2;但引用的 Terminal-Bench 2.1 中,4.8 為 74.6,GPT-5.5 為 78.2。同一彙總的 SWE-Bench Pro 為 69.2,Opus 4.7 為 64.3;Finance Agent v2 為 53.9,低於 Gemini 3.5 Flash 的 57.9。
這些數據來自不同任務、日期和 harness。另一篇獨立評測說 Anthropic 的 SWE-bench 數字沒有被獨立重現,而它引用 Artificial Analysis 在 2026-08-03 的獨立運行是 84.6% Terminal-Bench 2.1,不能把 74.6 和 84.6 合併成一個分數。
獨立紅隊研究在 7,826 個有害意圖和四類自動越獄攻擊中,報告最強的 tree-of-attacks 對 Opus 4.8 的 11.5% 意圖實現突破。這是受控對抗實驗,不是日常失敗率,但說明模型分數不能取代應用層控制。本文不重現有害提示。
生命週期、價格與入口
目前平台頁仍列出 4.8,但標為 legacy,並連結遷移 Opus 5;退役不早於 2027-05-28。Anthropic 列出 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS。Claude.ai 與 Claude Code 方案有自己的選擇器、額度與功能門檻,不能由 API 目錄反推。
| 入口或功能 | 已發布邊界 | 不代表 |
|---|---|---|
| Claude API | claude-opus-4-8,$5/$25 / MTok | 訂閱或瀏覽器暴露相同限制。 |
| AWS / Google Cloud / Microsoft Foundry | 提供商自己的 ID 和條款 | 地區、額度和工具與 Anthropic 相同。 |
| Claude.ai / Claude Code | effort 和產品訪問 | 訂閱包含 API 額度。 |
| Fast Mode | 研究預覽,約 2.5 倍速度,$10/$50 / MTok | 所有方案或提供商都有。 |
| Prompt caching | 快取寫入和讀取單獨計價 | 長任務自動便宜。 |
| Batch API | 目錄列出輸入和輸出 50% 折扣 | 互動式工具任務遵循 Batch 語義。 |
| Dynamic Workflows | Enterprise、Team、Max 的 Claude Code 研究預覽 | 所有使用者都能執行數百代理。 |
價格只是使用邊界,不是預測。高 effort 任務可能增加 thinking token、快取讀取、重試、工具和子代理呼叫。應測量每個已接受結果的成本,不要混淆 API、Claude.ai/Claude Code 方案、提供商加價、Fast Mode 與 Tabbit。
若要比較相鄰家族,請分別閱讀 Claude Sonnet 5 總覽和 Claude Fable 5.1 評測;它們的 effort、價格和生命週期證據不能直接套用到 Opus 4.8。
身分與場景自我檢查
記錄完整模型 ID、用戶端、提供商、地區、日期、effort 和工具。定義輸入檔案、期望輸出、驗收測試和停止條件。程式碼要執行現有測試並檢查 diff;瀏覽器或終端代理要記錄工具呼叫,並在不可逆操作前請求確認;研究任務要有引用和矛盾檢查。
社群也提示上下文風險:一位 Reddit 使用者稱啟用 4.8 thinking 時每輪最多可能產生 900,000 個快取 token,而 4.7 為 14,000–34,000;另一位大型程式碼庫使用者描述數十萬 token 的長期會話(來源)。這是使用者測量,不改寫官方 1M 目錄上限,只說明應在自己的 harness 測量 effort 和上下文。
本文沒有用已登入帳戶在 Tabbit Browser 實測 Opus 4.8,因此不宣稱選擇器、有效上下文、延遲、提供商路由、訂閱權限、工具或費用。代理瀏覽器指南、瀏覽器自動化指南和AI 瀏覽器指南解釋用戶端邊界;Tabbit Browser 總覽不是 API 或提供商測試。
結論
Claude Opus 4.8 仍值得用於複雜編碼、工具分析和瀏覽器代理的受控試用。4.7 改進有意義,但獨立證據受 harness 影響,且目前目錄已標為 legacy。用固定驗收測試比較 Opus 5,在不可逆操作周圍保留人工確認。
來源與常見問題
主要來源是 Anthropic 的發布說明、平台模型頁、價格文件和系統卡,以及 Digital Applied、ThePlanetTools、紅隊研究。社群連結與採集限制已記入內部研究稿。
Opus 4.8 仍可用嗎?
可以,但目錄已標為 active、legacy,並建議考慮 Opus 5;退役時間不早於 2027 年 5 月 28 日。
每個用戶端都提供 1M 上下文嗎?
不能。那是模型目錄上限,提供商、方案、介面或工具包裝層可能提供更小視窗。
應該使用 high、extra 還是 max?
從能通過驗收測試的最低檔開始。更高 effort 可能改善難題,也可能增加 token、等待時間和額度消耗。
Fast Mode 是另一個模型嗎?
不是。Anthropic 將它描述為同一模型的更快路線,價格為 $10/$50 / 百萬 token,是否可用取決於方案和提供商。
4.8 比 4.7 更安全嗎?
Anthropic 報告 misaligned behavior 低於 4.7,但獨立紅隊仍發現自適應攻擊面;應用層控制和人工確認不能省略。
能在 Tabbit 使用嗎?
本文沒有核驗已登入 Tabbit 會話。查看自己的選擇器,並把一次成功任務當作本地觀察,不要當作平台保證。
常見問題
Claude Opus 4.8 是什麼?
Claude Opus 4.8 是 Anthropic 於 2026 年 5 月發布的 Opus 模型,面向複雜編碼、工具呼叫、瀏覽器代理與長上下文知識工作。API ID 是 claude-opus-4-8,模型頁列出 1M 上下文與 128K 最大輸出。
Claude Opus 4.8 仍是目前模型嗎?
它仍可使用,但 2026 年 9 月 20 日檢查的 Claude Platform 頁面已標為 Legacy,並建議考慮 Claude Opus 5。頁面寫明退役時間不早於 2027 年 5 月 28 日。
Claude Opus 4.8 如何計費?
標準 API 輸入為每百萬 token 5 美元,輸出為 25 美元。Fast Mode 列為 10 和 50 美元;快取、Batch、提供商和消費者方案另計。
Opus 4.8 支援哪些 effort?
Anthropic 文件列出 adaptive thinking,預設 effort 為 high,並支援 extra 或 xhigh、max。較低 effort 更快且消耗速率限制較慢,較高 effort 可能使用更多 token。
Opus 4.8 與 4.7 有何變化?
Anthropic 強調判斷、遵循指令、工具效率與自我檢查改進,並增加 effort、Fast Mode 與 Dynamic Workflows。獨立早期評測依 harness 呈現混合結果,不是所有任務都勝出。
可以在 Tabbit 使用 Claude Opus 4.8 嗎?
本文沒有用已登入 Tabbit 帳戶實測 Opus 4.8,因此不宣稱選擇器、有效上下文、延遲、費用或工具權限。請查看即時選擇器並驗證一個可回滾的小任務。