Claude Opus 4.8は、複雑なコード、ブラウザーエージェント、ツール、長いコンテキスト作業向けのAnthropicモデルです。試す価値はありますが、2026年9月20日現在、Claude Platformのカタログでは Legacy と表示され、Opus 5の検討が勧められています。
これが現在の判断軸です。通常料金はOpus 4.7と同じ入力5ドル、出力25ドルで、1Mコンテキスト、128K出力、adaptive thinkingも掲載されています。新しい統合では、タスクを解けるかだけでなく、サポート期間も確認します。まずClaude Opus 4.8モデル資源 (English)を読み、実際の経路を確認してください。
要点
4.7の後継で、effort制御、Fast Mode、Claude CodeのDynamic Workflowsを備えます。
API IDは
claude-opus-4-8、コンテキスト1M、最大出力128K、既定effortはhigh、知識カットオフは2026年1月です。独立総合指数では上位でしたが、引用されたTerminal-Bench 2.1ではGPT-5.5が上でした。harnessを残して読んでください。
effort、thinking、長い文脈、再試行はタスク費用を変えます。単価だけを予算にしないでください。
利用可能でもLegacyです。新規本番ではOpus 5も比較します。
仕様と取得
| 項目 | 2026-09-20のカタログ | 境界 |
|---|---|---|
| API ID | claude-opus-4-8 | ログに固定し、提供者の別名と区別する。 |
| 状態 | 2026-05-28公開、Active (legacy) | 利用可能と現行は同じではない。 |
| Context / 出力 | 1M / 128K | クライアントや提供者は小さい窓かもしれない。 |
| 入出力 | テキスト、画像 / テキスト | ツール権限は経路による。 |
| Thinking / effort | Adaptive、既定high、extra/xhigh、max | タスクごとに比較する。 |
| 標準API | $5 / $25 MTok | キャッシュ、Batch、Fast Modeは別。 |
| 退役 | 2027-05-28より前ではない | 新規作業はOpus 5も確認する。 |
プロンプト資源 (English)とレビュー資源 (English)は原資料の確認に使えます。
4.7からの変更
Anthropicは判断、指示追従、ツール効率、生成コードの自己検証を改善したと説明しています。高effortはより多くのトークンを使い、低effortは速くレート制限を遅く消費します。Fast Modeは同じモデルを約2.5倍速くする経路で、入力10ドル、出力50ドルです。Dynamic WorkflowsはEnterprise、Team、Max向けClaude Codeの研究プレビューで、数百のサブエージェントを扱います。
コミュニティは分かれています。あるReddit利用者はPlaywright、Cloud CLI、Kubernetes CLIで4.8が明確な更新だが、大きなコードベースではGPT-5.5がより自律的と報告しました(報告)。別の早期投稿は、壊れたコード修正で速く自信のある問題回答が出たと述べています(投稿)。どちらも個別経験です。
ベンチマークと安全性
Digital Appliedの初期まとめでは、Artificial Analysisの総合指数が4.8 61.4、GPT-5.5 60.2でした。一方、Terminal-Bench 2.1は4.8 74.6、GPT-5.5 78.2で、SWE-Bench Proは4.8 69.2、4.7 64.3でした。タスク、日付、harnessが違うため、単一の順位にしないでください。別レビューはAnthropicのSWE-bench値が独立再現されていないと注意し、2026年8月3日のArtificial Analysis独自実行を84.6%としています。
7,826の有害意図を扱う独立red-team研究では、適応的tree-of-attacksがOpus 4.8の11.5%の意図を突破しました。通常の失敗率ではありませんが、モデル評価がアプリケーション制御を置き換えないことを示します。
ライフサイクル、料金、経路
Platformは4.8をLegacyとして掲載し、Opus 5への移行を案内しています。AnthropicはClaude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWSを列挙します。Claude.aiとClaude Codeのプランには別の選択、quota、機能条件があります。
| 経路/機能 | 公開情報 | そこから言えないこと |
|---|---|---|
| Claude API | claude-opus-4-8、$5/$25 | ブラウザーや契約が同じ制限とは限らない。 |
| クラウド提供者 | 独自IDと条件 | 地域、quota、ツールが同じとは限らない。 |
| Claude.ai / Code | effortと製品アクセス | APIクレジットを含むとは限らない。 |
| Fast Mode | 研究プレビュー、約2.5倍、$10/$50 | 全プランで使えるとは限らない。 |
| Cache / Batch | 独立した料金と割引 | 長いタスクが自動的に安いわけではない。 |
| Dynamic Workflows | Enterprise、Team、Maxの研究プレビュー | 全員が数百エージェントを使えるわけではない。 |
thinking、cache read、再試行、ツール、サブエージェントが最終費用を変えます。API、サブスクリプション、提供者、Fast Mode、Tabbitを混ぜないでください。
周辺モデルを比較するなら、Claude Sonnet 5の概要とClaude Fable 5.1のレビューを別々に読んでください。effort、料金、ライフサイクルの証拠は4.8へそのまま移せません。
自己点検とTabbitの境界
ID、クライアント、提供者、地域、日付、effort、ツールを記録します。入力、期待出力、検収、停止条件を決め、コードはテストとdiff、エージェントはログと不可逆操作の確認、調査は引用と反証確認を行います。
Redditではthinking有効時に1ターン900,000 cache tokenまで増えたという測定や、大規模コードベースで数十万tokenを使ったという報告があります(出典)。個人測定であり、公式1M上限の変更ではありません。
認証済みTabbitで4.8を実行していないため、セレクター、実効文脈、遅延、提供者、サブスクリプション、ツール、料金を主張しません。エージェントブラウザー、ブラウザー自動化、AIブラウザー、Tabbit概要はクライアントの境界を説明します。
結論
Claude Opus 4.8は複雑なコード、ツール分析、ブラウザーエージェントの候補です。4.7からの改善はありますが、独立評価はharness依存で、カタログはすでにLegacyです。固定した検収で試し、新しい本番統合ならOpus 5も比較し、不可逆操作には人の承認を残します。
参考資料と質問
主な資料はAnthropic発表、Platform、料金、System Card、Digital Applied、ThePlanetTools、red-teamです。コミュニティURLと収集上の制約は内部調査記録に保存しました。
まだ利用できますか?
利用できますがLegacyです。退役は2027年5月28日より前ではありません。
すべてのクライアントが1Mを出しますか?
いいえ。提供者やプランが小さい有効窓を出すことがあります。
どのeffortを選びますか?
検収を通る最低の設定から始めます。高い設定はtokenとquotaを増やす可能性があります。
Fast Modeは別モデルですか?
いいえ。同じ4.8の高速経路で、料金が別です。
4.7より安全ですか?
公式評価は改善を示しますが、独立red-teamは攻撃面を確認しました。
Tabbitで使えますか?
認証済みセッションは未確認です。自分のセレクターを確認してください。
よくある質問
Claude Opus 4.8とは何ですか?
2026年5月にAnthropicが公開したOpusモデルで、複雑なコーディング、ツール、ブラウザーエージェント、長いコンテキストの作業を対象にします。API IDはclaude-opus-4-8で、カタログは1Mコンテキストと128K最大出力を示します。
まだ現行モデルですか?
利用できますが、2026年9月20日に確認したClaude PlatformはLegacyと表示し、Opus 5の検討を勧めています。退役は2027年5月28日より前ではないと記載されています。
料金はいくらですか?
標準APIは入力5ドル、出力25ドル(100万トークンあたり)です。Fast Modeは10ドルと50ドルで、キャッシュ、Batch、提供者、消費者プランは別条件です。
どのeffortを使いますか?
Adaptive thinkingで、既定値はhighです。extraまたはxhigh、maxも文書化されています。低いeffortは速く、高いeffortはより多くのトークンを使う可能性があります。
4.7から何が変わりましたか?
判断、指示追従、ツール効率、自己検証の改善に加え、effort、Fast Mode、Dynamic Workflowsが追加されました。独立評価はharnessごとに混在しています。
Tabbitで使えますか?
認証済みTabbitで4.8のタスクを実行していません。そのためセレクター、実効コンテキスト、遅延、費用、ツールを主張せず、自分のアカウントで確認してください。