Claude Opus 4.7 是一次有重點的 4.6 升級:編碼、工具呼叫、電腦操作和視覺能力更強,但公開 BrowseComp 結果下降。它不是每個任務都勝出的通用冠軍,也不再是新專案預設的 Opus 目標。
截至 2026 年 9 月 20 日,Anthropic 實時模型頁把 claude-opus-4-7 標為 Active(legacy),標準 API 價格仍是輸入 $5、輸出 $25 / MTok,並建議考慮 Opus 5。本文沒有登入後的 Tabbit 實測。
先看結論
公開證據最支持困難編碼、工具編排、桌面操作和圖表/介面理解。
目錄列出 1M 上下文、128K 最大輸出、自適應思考與預設
higheffort。SWE-bench Verified 從 80.8% 升到 87.6%,BrowseComp 則從 83.7% 降到 79.3%。
Anthropic 說 Claude 4.7 之後使用新版 tokenizer,同樣文字大約產生 30% 更多 token;單價不變,任務成本未必不變。
Claude Opus 4.7 規格
Claude Opus 4.7 模型資源 (简体中文)適合查看逐條提示與測評來源。
| 問題 | 2026-09-20 目錄資訊 | 選型邊界 |
|---|---|---|
| API ID | claude-opus-4-7 | 在日誌固定完整 ID。 |
| 發布/狀態 | 2026-04-16 / Active(legacy) | 能用不等於目前家族端點。 |
| 上下文/最大輸出 | 1M / 128K token | 客戶端和供應商可能更小。 |
| 思考/預設 effort | Adaptive / high | 一起比較 effort、token 和完成品質。 |
| 標準 API 價格 | 輸入 $5、輸出 $25 / MTok | 快取、Batch、雲端與訂閱另計。 |
| 目錄平台 | Claude API、Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS | 地區、額度和工具仍需確認。 |
4.6 到 4.7 的變化
Anthropic 將 4.7 定位為更能規劃、使用工具並檢查結果的工程模型,並把圖片長邊提高到 2,576 像素。公開資料與Vellum 解讀支持編碼、工具和視覺推理提升,但不支持「每方面都更好」。
| 基準 | Opus 4.6 | Opus 4.7 | 含義 |
|---|---|---|---|
| SWE-bench Verified | 80.8% | 87.6% | issue 修復訊號上升。 |
| SWE-bench Pro | 53.4% | 64.3% | 困難多語言版本提升。 |
| MCP-Atlas | 75.8% | 77.3% | 多輪工具呼叫小幅提升。 |
| OSWorld-Verified | 72.7% | 78.0% | 電腦操作結果提升。 |
| BrowseComp | 83.7% | 79.3% | 網頁研究訊號回落。 |
| CharXiv,無工具/有工具 | 69.1% / 84.7% | 82.1% / 91.0% | 視覺推理增益最明顯。 |
這些是官方或二次整理數字,不是 Tabbit 測試,也不是你的生產成功率。提示資源 (简体中文)與測評資源 (简体中文)保留來源細節。
取得、價格與成本邊界
Anthropic 定價文件列出輸入 $5、輸出 $25 / MTok,快取寫入、快取命中和 Batch 另有規則。新版 tokenizer 大約增加 30% token,長上下文和高 effort 可能讓完成任務成本上升。
| 路線 | 已公開邊界 | 仍需確認 |
|---|---|---|
| Claude API | claude-opus-4-7 與標準 token 價格 | 組織限額、快取、資料駐留。 |
| Bedrock / Google Cloud / Microsoft Foundry | 目錄列出模型 ID | 地區、端點溢價、額度、工具和雲端帳單。 |
| Claude 產品 / Claude Code | 與 API 分開 | 計畫、用量池、選擇器和 effort。 |
| Tabbit Browser | 可能提供瀏覽器工作流入口 | 選擇器、有效上下文、延遲、成本和工具權限,本文未核驗。 |
Claude Opus 4.8 總覽解釋下一版本;Claude Sonnet 5適合比較低成本路線。不要把 API 價格和訂閱席位或 Tabbit 可用性混在一起。
風險與社群分歧
高 effort 可能提高困難任務品質,也可能增加 token、等待和限額。Reddit 重度使用者一方面稱 4.7 更能遵循指令、程式碼更好,另一方面認為它比 4.6 不穩定、需要更詳細提示;另一個討論則認為計畫輸出太密,閱讀拖慢決策。這些是個人觀察,不能當作普遍回歸。
原始討論見重度使用對比、可讀性討論和程式碼審查對照。本文沒有合格社群截圖,保留草稿。
對於Agent 瀏覽器,模型工具能力與瀏覽器實際權限是兩件事;不可逆的終端或頁面操作仍應人工確認。瀏覽器自動化不等於 API 已獲得同樣權限。
生命週期與遷移
Opus 5 遷移指南說明從 4.7 迁移不能只換模型名稱。舊的 sampling、prefill、手動 thinking、新 tokenizer、回應區塊和工具迴圈都要檢查。固定模型 ID,記錄 effort、max_tokens、token、快取、工具呼叫、延遲和重試,分別跑編碼、工具、視覺和網頁研究任務。
| 工作負載 | 先評估 | 原因 |
|---|---|---|
| 困難倉庫修復和工具編排 | 4.7 與 Opus 5 並跑 | 4.7 的公開增益集中於此,但生命週期要求向前看。 |
| 密集截圖、圖表和 UI Agent | 視覺驗收集 | CharXiv、OSWorld 上升,但 UI 權限仍不同。 |
| 網頁研究 Agent | 帶引用的對照任務 | BrowseComp 回落,不能用編碼分數代替研究品質。 |
| 日常低成本編碼 | Sonnet 5 | 參考其獨立價格與 effort 證據。 |
Tabbit 的實際邊界
Tabbit Browser 總覽和AI 瀏覽器說明描述的是客戶端工作流。本文沒有完成登入後的 Opus 4.7 任務,因此不宣稱它一定出現在選擇器中,也不宣稱瀏覽器暴露 1M 上下文或相同價格。若帳戶能看到它,先做一個可回滾的研究任務,保存來源並按書面驗收條件判斷。
Verdict
Claude Opus 4.7 在困難編碼、工具使用和視覺推理上是有意義的 4.6 升級,但 BrowseComp 回落、新 tokenizer 的成本邊界和社群分歧都不支持「全部升級」。它仍值得受控試點;新生產專案則應現在把 Opus 5 納入比較並保留回滾路徑。
來源
主要來源為 Anthropic 的發布公告、Opus 4.7 模型頁、定價文件、生命週期文件、Opus 5 遷移指南與系統卡。獨立解讀為Vellum 基準說明。
常見問題
Claude Opus 4.7 是什麼?
Claude Opus 4.7 是 Anthropic 在 2026 年 4 月發布的 Opus 版本,重點面向困難軟體工程、工具型 Agent 與高解析度視覺任務。模型頁列出 claude-opus-4-7、1M 上下文、128K 最大輸出與自適應思考。
Claude Opus 4.7 比 4.6 改了什麼?
Anthropic 回報編碼、工具呼叫、電腦操作與視覺推理提升,但公開表格的 BrowseComp 低於 4.6。新版 tokenizer 與 effort 也會改變任務成本,所以應用固定工作負載測試。
Claude Opus 4.7 多少錢?
目前 Claude Platform 列出的 API 價格是每百萬輸入 token 5 美元、輸出 token 25 美元,快取與 Batch 另計。API 價格不等於 Claude 訂閱、雲端供應商帳單或 Tabbit 可用性。
Claude Opus 4.7 還能使用嗎?
可以,實時模型頁標為 Active(legacy),並寫明最早不會早於 2027 年 4 月 16 日退休。Anthropic 同時建議考慮 Opus 5,因此新整合應先比較新路線。
應該從 Opus 4.7 遷移到 Opus 5 嗎?
先用固定驗收集測試,再檢查 thinking 預設值、max_tokens、回應區塊處理、工具迴圈、tokenizer 變化與安全 fallback。生產遷移不能只替換模型 ID。
可以在 Tabbit 測試 Claude Opus 4.7 嗎?
本文沒有執行登入後的 Tabbit Opus 4.7 任務,因此不確認選擇器、有效上下文、延遲、成本或工具權限。請在自己的即時帳戶檢查,並用一個可回滾任務驗證。