TabbitBlog

GPT-6 Astra の価格:API 料金、ティア別料金と実際のタスクコスト

GPT-6 Astra の価格を徹底解説:公式 API 料金表、Batch/Flex/Fast ティア、272K の長文コンテキスト崖、ChatGPT プラン、試算例、ローカル計算ツール。

この記事の内容
  1. 要点
  2. GPT-6 Astra の価格早見表
  3. 唯一の重要な数字:同じカードで 1 タスク 0.82〜3.26 ドル
  4. 「Sol の 2.5 倍」を平易に翻訳する
  5. 見出しの外にある課金項目
  6. ファミリーの階段:どの行があなたのものか
  7. 料金表がカバーしないもの
  8. プランの可用性:API ティアと ChatGPT プラン
  9. 2 つの試算、仮定はすべて見えるように
  10. 実践的な選択肢:Tabbit で比較を走らせる
  11. GPT-6 Astra 価格の意思決定表
  12. 最終判断
  13. 出典

GPT-6 Astra の標準 API 料金は100 万入力トークンあたり 10 ドル、100 万出力トークンあたり 50 ドル、キャッシュ済み入力 1 ドル、キャッシュ書き込み 12.50 ドル——これらはすべて 2026 年 9 月 22 日に OpenAI の公式ページで確認しました。しかしこれは料金表であって、請求書ではありません。同じカードのまま、Artificial Analysis は同一ベンチマークタスクのコストを low 推論 effort で 0.82 ドル、max で 3.26 ドルと計測しています。価格を一つも変えずに、コストが約 4 倍動きます。

この 2 つの数字の間の落差が、この記事が存在する理由です。Astra の発売時、ある Reddit 開発者はこう書きました。「GPT-5.6 Sol:入力 $4/M、出力 $20/M。GPT-6 Astra:入力 $10/M、出力 $50/M。入出力とも文字通り 2.5 倍の値上げだ」(r/codex スレッド、456 評価)。計算は正しい。しかし「高いか安いか」という結論は計算だけでは出ません。推論 effort、サービスティア、コンテキスト長、キャッシュヒット率のそれぞれが、モデルの選択そのものより請求額を大きく動かすからです。記事の後半では、予算が固まった後にモデルルートを比較する実践的な場として Tabbit Browser を紹介します。まずは数字から。

要点

  • 標準料金:100 万トークンあたり入力 10 ドル、キャッシュ済み入力 1 ドル、キャッシュ書き込み 12.50 ドル、出力 50 ドル。入力が 272K を超えるとリクエスト全体が 20/2/25/75 ドルに切り替わります。

  • 同じカードで 4 倍の差。Batch と Flex は全料金が半額、Fast モードは 2 倍。Artificial Analysis は同一トークン価格で 1 タスク 0.82 ドル(low)から 3.26 ドル(max)を計測。

  • 2.5 倍のプレミアムの基準はプロモ価格。Sol の 4/20 ドルは「少なくとも 2026 年 11 月 21 日まで」のプロモ価格と明記。前世代 GPT-5.5 の入力は 5 ドルでした。

  • サブスクリプションは別の経済圏。ChatGPT Plus は月 20 ドルで限定的な Astra、Pro は 100 ドルから。コミュニティ計測では Astra のサブスク実効コストは API 価格の約 1.9 倍、キャッシュ保持は約 30 分。

  • トークン単価ではなくタスクの形で予算を立てる。短い応答は出力主導、キャッシュが効くエージェントループはキャッシュ読み取り主導、272K 超はすべて長文コンテキストのプレミアムを支払います。

GPT-6 Astra の価格早見表

2026 年 9 月 22 日に OpenAI の API 料金ページから取得した完全な標準料金表です。GPT-6 Astra 総覧はモデルの説明、この表はお金の側です。

モデル入力 / 100 万キャッシュ済み入力 / 100 万キャッシュ書き込み / 100 万出力 / 100 万
gpt-6-astra$10.00$1.00$12.50$50.00
gpt-5.6-sol$4.00$0.40$5.00$20.00
gpt-5.6-terra$2.00$0.20$2.50$12.00
gpt-5.6-luna$0.20$0.02$0.25$1.20
gpt-6-astra、gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna の標準と長文コンテキスト料金を示す OpenAI のフラッグシップモデル料金表
2026 年 9 月 22 日の OpenAI 公式フラッグシップ料金表。短文と長文コンテキストの列が並んで表示されている。

この表で実際に請求額を決めるのは 3 つのことで、どれも見出しの 10 ドルではありません。

  1. 出力は入力の 5 倍。Astra は推論モデルであり、思考の過程がそのまま課金対象の出力トークンです。短いプロンプトに長い思考の连锁が続けば、入力の姿をした出力の請求書になります。

  2. キャッシュ書き込みは入力より高い。12.50 ドルは非キャッシュ価格の 1.25 倍——料金ページに 1.25x ルールが明記されています。プレフィックスが実際に再利用されるときだけキャッシュは価値を持ちます。

  3. 272K の崖はリクエスト全体に適用。入力が 272,000 トークンを超えると、超過分だけではなくリクエスト全体が入力 20 ドル、キャッシュ 2 ドル、書き込み 25 ドル、出力 75 ドルで課金されます。105 万トークンのコンテキストウィンドウは、標準料金での 105 万トークンの予算ではありません。

唯一の重要な数字:同じカードで 1 タスク 0.82〜3.26 ドル

一つの数字だけ覚えるなら、料金ではなく振れ幅です。Artificial Analysis は GPT-6 Astra を推論 effort 別に 5 エントリーで追跡しており、「知能指数タスクあたりのコスト」(2026 年 9 月 22 日スナップショット)は次の通りです。

推論 effort知能指数1 タスクコスト出力速度
low46$0.8255 t/s
medium50$1.5452 t/s
high51$1.7359 t/s
xhigh52$2.3155 t/s
max53$3.2667 t/s

外側の 2 列を並べて読んでください。max の 1 タスクコストは low の 3.98 倍で、知能指数の差は 7 ポイントです。同じスナップショットで low は初トークンまでの時間も最短(2.46 秒)です。高い設定が慎重な設定とは限りません。課金トークンの中で長く考える設定でしかありません。

これはエージェント型の仕事で二重に効きます。Astra の最も派手な公開結果——OpenAI のシミュレーションで OSWorld 2.0 の 1 タスク約 40 分、Sol は約 75 分——は、まさに effort とリトライが複利で効くワークロードを表しています。ループのたびにコンテキストを読み直し、各ステップで推論トークンを吐き出し、「ずっと動ける」モデルは「ずっと課金され続ける」モデルでもあります。Hacker News では 15 通のメッセージで ChatGPT の 5 時間枠を使い切ったという報告があり(HN ディスカッション)、同じ形が API 課金にそのまま現れるのが、エージェント推論ガイドが長いループの前に受け入れ基準を固めるべきだと言う理由です。予算は完了したタスク単位で、失敗した試行を含めて立ててください。

「Sol の 2.5 倍」を平易に翻訳する

GPT-5.6 Sol の入力 4 ドル・出力 20 ドルと GPT-6 Astra の入力 10 ドル・出力 50 ドルを比較する r/codex の投稿
r/codex、2026 年 9 月:ユーザーが最初に報告した 2.5 倍の値上げ。コミュニティ投稿であり公式発表ではない。

2.5 倍という数字の算数は正しいですが、予算を組む前に 2 つの注意事項を横に置く必要があります。

注意 1:比較基準はプロモ価格。OpenAI の Sol ページは「GPT-5.6 Sol のプロモ価格は少なくとも 2026 年 11 月 21 日まで利用可能」と注記し、クイック比較列では前世代 GPT-5.5 の入力価格が 5.00 ドルと表示されています。Sol のこの値下げは 2026 年 7 月 30 日に起きました。Sam Altman は当日、Luna を 80% 値下げ(0.20/1.20 ドルに)、Terra を 20% 値下げ(2/12 ドルに)、Sol に 2 倍の価格で最大 2.5 倍の速度を得る Fast モードを追加すると発表しました(@sama)。Sol のプロモが終われば「2.5 倍のプレミアム」は勝手に縮みますが、Astra は 1 ドルも下がりません。GPT-5.6 Sol のロングコンテキスト分析がこのファミリーを個別に追跡しています。

注意 2:1 タスクコストは収束しうる。上のスレッドは料金表への値上げショックです。しかし Artificial Analysis が low で 1 タスク 0.82 ドルと計測したように、請求額は定価よりずっと下に落ちることがあります。そして能力がリトライを節約する場合、方向は完全に反転します。Sol が 2 回失敗し Astra が 1 回で終わるタスクは、2.5 倍の料金でも Astra の方が安い。あなたのタスクがどちらなのかは経験の問題で、下の試算例で答えるものであり、料金表が答えるものではありません。

見出しの外にある課金項目

実際の請求額の大半を決めるのは 4 つの行で、発売報道が触れたのは最初の 1 つだけです。

Batch と Flex:50% のレバー。どちらも標準料金の半額——入力 5 ドル、キャッシュ 0.50 ドル、書き込み 6.25 ドル、出力 25 ドル。Batch は数時間待てる仕事向け(API は v1/batch を公開し、キュー上限は Tier 1 の 150 万トークンから Tier 5 の 150 億まで)。Flex は別の低価格容量モードで、可用性のトレードオフが異なります。評価バッチ、オフラインのデータ加工、ユーザーの目に触れない作業すべてにおいて、このスイッチ 1 つがプロンプト最適化より多くを節約します。割引は重ねられません。1 回に選ぶのは 1 モードです。

Fast モード:2 倍の加速器。適用料金の 2 倍——標準で 20/100 ドル。「適用」に注意してください。Batch ジョブで Fast を使うと Batch 価格が 2 倍になり、標準価格に戻ってから 2 倍ではありません。Priority processing は 2026 年 7 月 30 日に Fast mode と改名され、service_tier: "priority""fast" の両方が使えます。古いコードは要確認です。

リージョン処理:+10%。データレジデンシーエンドポイントは、2026 年 3 月 5 日以降にリリースされデータレジデンシー対応のモデルに 10% の上乗せとなります。Astra はリリース日から対象です。コンプライアンス駆動のリージョンはすべての行で 1 割多く支払います。

272K の崖とキャッシュの時計。入力が 272K を超えると、長文コンテキスト行(20/2/25/75 ドル)がリクエスト全体に適用されます。「超過分だけ」という計算はありません。そして繰り返し読み取りを安くするはずのキャッシュには、コミュニティで報告された短い寿命があります。Codex ユーザーは Astra で約 30 分、Sol 以前のモデルでは 24 時間と観測しました。

Astra のキャッシュ TTL が 30 分以下、GPT-5.6 Sol は 24 時間だと報告する Reddit コメント
r/codex コメント:Pro 20x ユーザーによるキャッシュ保持時間の比較。コミュニティの観察であり OpenAI の公式仕様ではない。

OpenAI は TTL 表を公表していないため、30 分は 2 つの独立ソースのある報告された挙動として扱い(スレッドコメント)、保証ではありません。ループがステップ間でこれより長く眠ると、1 ドルのキャッシュ読み取りは 10 ドルのコールドリードと 12.50 ドルの書き込みに静かに戻ります。

ツール呼び出しはこれらすべての外にあります。OpenAI は web search などのツール型機能を呼び出しごとに課金すると説明しており、40 回検索するエージェントには 2 つ目のメーターが回っています。

ファミリーの階段:どの行があなたのものか

階段で直感に反する行は Luna です。Astra の入力より 50 倍安く、実在する製品行です。公式のモデルカタログは Luna をコスト重視・大量処理向けと説明し、OpenAI 自身の選定ガイダンスも「仕事がフラッグシップを必要とするほど難しくない限り、Terra または Luna をデフォルトにせよ」というものです。安い行はおもちゃではなくルーティング先であり、Astra ではなく Luna に流れたトークンごとに入力側で 50 倍を節約します。

2 つ目の直感に反する発見はファミリーの外から来ます。Astra と Anthropic の Fable 5.1 はまったく同じ 10/50 ドルでリストされていますが、実コストは逆方向に動きます。

GPT-6 Astra と Fable 5.1 が同じ定価でも実コストが異なることを説明する r/LLMDevs の投稿
r/LLMDevs、2026 年 9 月:同じ定価、異なる実コスト。方法を明示したコミュニティ分析。

投稿者の計算では、Astra は 1 タスクを完了するトークンが少なく(長い単発タスクで「Fable 5.1 の半分未満のトークンコスト」)、一方 Fable のキャッシュ読み取りは 100 万あたり 0.25 ドルで Astra の 1.00 ドルの 4 分の 1 です。大きなキャッシュ済みコンテキストへの高頻度トラフィックは Fable に、長い単発タスクは Astra に傾きます。あるコメント投稿者は両モデルで 1 週間のドキュメント検索パイプラインを走らせ、85% のキャッシュヒットで Fable のコストは約半分、「そのタスクではパフォーマンスは実質同じでした」。

85% のキャッシュヒットで 1 週間の検索パイプラインが Fable で半額になったと説明する Reddit コメント
r/LLMDevs コメント:1 週間、85% ヒット、半分のコスト。単一パイプラインの報告でありランキングではない。

どちらの实验室を選ばなくても移転可能な教訓は同じです。料金表はコスト関数への最小の入力です。タスクの長さ、キャッシュヒット率、出力量というトラフィックの形が支配します。コミュニティレビュー集 (English)に、条件付きのこの種の報告がさらに保存されています。

料金表がカバーしないもの

  • サブスクリプションは API クレジットではない。ChatGPT プランが与えるのは使用量で、枠と時間窓で値付けされます。次の節で示す通り、これらの枠は独自の経済圏です。月 20 ドルのプランをトークン単価で割らないこと。

  • 失敗した試行も課金されうる。発売週に記録された 33 分の Codex 実行では、成功したリクエストの前に 2 回のタイムアウトが枠を消費しました(r/ChatGPT)。リトライはコストの行であり、無料ではありません。

  • API 無料ティアは閉じている。レート制限表は Astra を Free で「非対応」と表示。有料は Tier 1 からで、毎分 500 リクエスト、50 万トークン。

  • 税、ツール、プロバイダーの上乗せは別。OpenRouter のページでは Azure と OpenAI の両方が Astra を 10/50/1 ドルで掲載しつつ、遅延プロファイルが異なります(本日のスナップショットで初トークン P50 はそれぞれ 6.92 秒と 4.80 秒)。同じ料金、異なるルーティングです。Amazon Bedrock の商用リージョンは OpenAI 直販と同額と公式に明記されています。

プランの可用性:API ティアと ChatGPT プラン

API ティアRPMTPMBatch キュー上限
Free非対応
Tier 1500500,000150 万トークン
Tier 25,0001,000,000300 万トークン
Tier 35,0002,000,0001 億トークン
Tier 410,0004,000,0002 億トークン
Tier 515,00040,000,000150 億トークン

出典:OpenAI の gpt-6-astra モデルページ、2026 年 9 月 22 日確認。ティアは支出に応じて上がるため、発売週の天井が永久に続くわけではありません。

コンシューマー側では、ChatGPT の料金ページが現在 4 プランを表示しています。Free は 0 ドル(GPT-5.6 Luna のテキストチャット無制限——Astra なし)、Go は月 8 ドル、Plus は月 20 ドルで「GPT-6 Astra と GPT-5.6 の高度な推論モデル」を含み(比較表では Astra は「制限あり」)、Pro は「月 100 ドルから」と 5 倍の使用量、「GPT-6 Astra 搭載の専門推論」と表示されています。コミュニティではまだ 200 ドルの Pro ティアにも言及があり、YouTube の概要欄には「100 ドルと 200 ドル」の両方が並びます。裁くのはライブページだけで、現時点では「〜から」の表示です。

サブスクリプションの経済学には独自の警告ラベルが必要です。3 つの独立したコミュニティ計測が同じ方向を指しているからです。

Sol での週あたり API 換算枠 2,500 ドル超から Astra で約 1,200 ドルへの減少を報告する Reddit 投稿
r/codex:2 つの Pro 20x アカウントで、Astra 切り替え後の比較可能な使用量が約 4 分の 1 になった実測。方法は自己申告。

第一に枠の数学です。2 つの Pro アカウントで、週あたりの API 換算枠は Sol の 2,500 ドル超から Astra の約 1,200 ドルに落ちました。しかもこの数字は Astra の高い単価で計算済みで、「同じサブスク料金で比較可能な使用量は約 4 分の 1」になります。第二に実効価格です。ある Plus 加入者は、同じ枠での Luna 比較で Astra の実効コストを API 価格の約 1.90 倍と逆算しました(実測使用量 134.42 対 70.59 ドル)。第三に燃焼の体験です。

Plus サブスクリプション下での Astra のコストが API 価格の約 1.90 倍と見積もる Reddit 投稿
r/codex:サブスク対 API の 1.90 倍の見積もりと方法の説明。投稿者は訂正を歓迎している。
月 200 ドルのサブスクでは Astra を有意義に使うトークンが足りないと語るゲーム開発者の Reddit 投稿
r/ChatGPT:月 200 ドルの加入者が Astra の消費速度を語る。単一のヘビーユーザーで、ワークロード依存。

「Astra は確かに優れている。でも意味のある仕事をするには、月 200 ドルのサブスクが与えるトークンでは全然足りない」——これはあるゲーム開発者のまとめで、能力と不満が同じ文の中にあります。監視下で時々使うだけなら Plus で足りるかもしれません。毎日のパイプラインのエンジンなら、Batch 付きの API が予測可能な道で、サブスクはプレミアムな対話の道です。

2 つの試算、仮定はすべて見えるように

標準の短文コンテキスト料金を使用。リトライ、ツール、税は含みません。算術のデモであって予測ではありません。

短い質問と長い思考。入力 10,000 トークン、出力 2,000 トークン:

(10,000 × $10 + 2,000 × $50) / 1,000,000 = $0.20

崖を跨ぐコールドスタートのエージェントループ。入力 300,000 トークン——既に 272K 超えなので長文コンテキスト料金が全体に適用——出力 8,000 トークン:

(300,000 × $20 + 8,000 × $75) / 1,000,000 = $6.60

同じループを 272K 未満(例えば 260,000 トークン)に収めれば 4.00 ドルです。あの線を跨ぐだけで、この形は 65% 多く支払います。次にウォーム版:同じ 300,000 トークンのコンテキスト、90% キャッシュ、毎時 1 回の書き込み、出力 8,000:

(270,000 × $2 + 30,000 × $20 + 8,000 × $75) / 1,000,000 = $1.68 + 書き込み

ローカル計算

GPT-6 Astra APIのトークン費用を見積もる

2026-09-22に確認した公式USD料金を使用します。入力値はブラウザー内だけで処理されます。

タスクあたり$0.20000
月あたり$0.20

キャッシュ書き込みは入力単価の1.25倍で課金されます。この見積もりは再試行、ツール、税金、10%の地域加算、業者上乗せを除外します。入力が272Kを超えると全ラインを自動的に長コンテキスト料金に切り替えます。 最新料金を確認

計算ツールは完全にこのページ内で動作し、どこにもデータを送信しません。272K の長文コンテキスト切替を自動適用し、選択したサービスティアで計算し、キャッシュ書き込みとヒットを分離します。意図的にモデル化しないもの:リトライ、ツール呼び出し料金、リージョンの 10%、キャッシュの時計です。これらはあなたのマージンの中に置いてください。予算を確定する前に公式料金表を再確認してください。本記事の数字は 2026 年 9 月 22 日時点です。

実践的な選択肢:Tabbit で比較を走らせる

予算の次に来るのは地味な部分です。Astra 型の仕事を実際に走らせるには、ページ、ファイル、モデル呼び出しが同じ場所にある環境が必要です。それが Tabbit Browser の位置です。モデルピッカー、ライブページ、ローカルファイルが 1 つの画面にある AI ブラウザーで、「まず Astra の medium で試して、駄目なら Luna に戻す」はオーケストレーション案件ではなく 1 回の選択になります。

利用可能なモデル一覧を表示する Tabbit Browser の新しいタブのモデルピッカー

境界は明確に述べます。Tabbit はクライアントであって OpenAI の課金レイヤーではありません。モデルの可用性はアカウントとエディション次第で、ブラウザー内の操作は OpenAI が請求する金額を一切変えません。上の料金表はどこで Astra を走らせても適用されます。ブラウザーが変えるのはセットアップコストです。GPT-6 Astra リソースページ (English)とそのプロンプト集 (English)には、ピッカーに対して直接走らせられる再現可能なタスクが説明されており、あなたのワークロードが本当にどの effort を必要とするかを、一行のオーケストレーションコードも書かずに確かめる最も安い方法です。

Tabbit Browser

仕事の中心が対話ではなくブラウザーレベルの自動化なら、エージェント的ブラウザー概要エージェント的ブラウザーとはブラウザー自動化ガイドがそのワークフローを扱います。AI ブラウザーガイドは一般的な出発点です。

GPT-6 Astra 価格の意思決定表

あなたのワークロードコストの駆動要因最適な出発経路注意点
対話型チャット、短い応答出力トークンAPI の low/medium、または Plus$50/M の出力が支配的。入力の 5 倍
一晩かかる評価や加工Batch の 50%ティアごとのキュー上限。結果は数時間後
272K 未満の長いエージェントループキャッシュ読み取りと書き込み標準 + 安定プレフィックスのキャッシュ約 30 分のキャッシュ保持が報告されている
272K 超のコンテキスト再構成して下回らせるか、20/75 で予算化リクエスト全体が再課金され、超過分だけではない
レイテンシ敏感な本番Fast モード十分な最低 effort で Fast(2x)effort の選択はティアよりコストを動かす
毎日のヘビーな消費者利用サブスク枠Pro(100 ドルから)または API+Batch枠の消費は Sol 比で約 4 倍速いとの報告

最終判断

GPT-6 Astra は「難しい仕事の原材料」として価格設定され、同じように請求します。タスクが長時間・ツール多用・人的監視コスト大のときに買い、それから慎重に買ってください。待てる仕事はすべて Batch、effort は受け入れテストが駄目だと言うまで low から、コンテキストは 272K 未満に設計し、キャッシュフレンドリーなプレフィックスは 30 分の時計に対して測定する。フラッグシップの能力を必要としない量は Luna か Terra に回す。ファミリーの階段が存在する意味は、フラッグシップをデフォルトではなくルーティング決定にすることです。

Astra が API での日常のエンジンなら、「完了したタスク」単位で(リトライとツール料金を含めて)予算を組み、毎月公式料金ページを再確認してください。Sol のプロモ基準には 11 月 21 日の日付が付いており、階段全体が動きえます。専用の代替品比較はまだ準備中です。公開まではモデルリソース (English)総覧、そして上記のコミュニティ記録が情報源です。

出典

よくある質問

GPT-6 Astra はいくらですか?

2026 年 9 月 22 日時点で OpenAI の公式ページで確認した標準 API 料金は、100 万入力トークンあたり 10 ドル、キャッシュ済み入力 1 ドル、キャッシュ書き込み 12.50 ドル、出力 50 ドルです。入力が 272K を超えるリクエストは全体が長文コンテキスト料金(入力 20 ドル、キャッシュ 2 ドル、書き込み 25 ドル、出力 75 ドル)に切り替わります。Batch と Flex は標準料金の 50%、Fast モードは 2 倍、データレジデンシー地域エンドポイントは 10% 追加です。

GPT-6 Astra に無料枠はありますか?

API の無料ティアでは利用できません。OpenAI のレート制限表では gpt-6-astra の Free ティアが「非対応」と表示され、有料アクセスは Tier 1 から始まります。コンシューマー側では、ChatGPT 無料プランは GPT-5.6 Luna のテキストチャット無制限を提供しますが Astra は含まれず、Plus には限定的な Astra アクセス、Pro は GPT-6 Astra 搭載の専門推論として案内されています。

なぜ GPT-6 Astra は GPT-5.6 Sol の 2.5 倍も高いのですか?

OpenAI は Astra を推論、コーディング、computer use、調査といった最も難しいエンドツーエンドの仕事向けに位置づけ、Sol の 4/20 ドルに対して 10/50 ドルで価格設定しています。ただし Sol の現行料金は 2026 年 11 月 21 日までと明記されたプロモ価格のため、比較基準自体が動く可能性があります。Astra がより少ないリトライでタスクを完了する場合、1 タスクあたりの実コストは Sol に近づきます。

GPT-6 Astra のためだけに ChatGPT Pro を買う価値はありますか?

ワークロード次第です。Pro は月 100 ドルからで 5 倍の使用量と Astra 搭載の推論と表示されますが、コミュニティの計測では週あたりの API 換算枠が Sol の約 2,500 ドルから Astra の約 1,200 ドルに減り、キャッシュ保持は約 30 分と報告されています。長時間のエージェント型タスクが中心なら、予算を慎重に立てるか、遅延を許容できる作業は API の Batch で実行してください。

GPT-6 Astra を最も安く動かす方法は?

レバーを組み合わせることです。緊急でない作業は Batch または Flex(標準の 50%)に回す。推論の effort は low か medium で始め、受け入れテストが落ちた時だけ上げる。入力を 272K 未満に保って長文コンテキスト料金を避ける。安定したプレフィックスをキャッシュし、繰り返し読み取りを 100 万トークン 10 ドルではなく 1 ドルで課金させる。

GPT-6 Astra の API 価格にツール呼び出しは含まれますか?

含まれません。公表されたトークン料金はテキストの入出力のみをカバーします。OpenAI は web search や computer use などのツール型機能を呼び出しごとに別課金すると説明しており、ツールを多用するエージェントには予算に別の行が必要です。

次のステップへ

Tabbit と一緒に仕事をしましょう。

タブをまたいで調査し、繰り返しのブラウザ作業を自動化し、あらゆる文脈を手の届くところに。