Gemini 3.6 Flashは、マルチモーダルなコード、文書、範囲を限定したエージェントの試験に向いた効率重視の候補です。価値はベンチマークだけでは決まりません。Googleは3.5 Flashより少ない出力トークンを主張しますが、コミュニティの経験では結果を安く検証できる場合だけ節約になります。
基準日はGoogleの2026年7月21日発表と、9月20日に再確認したカードです。gemini-3.6-flash、入力1,048,576、出力65,536、テキスト・画像・動画・音声・PDF入力、料金1.50/7.50ドル(100万入力/出力)が記載されています。3.7と3.8は隣接する経路で、自動的な置き換えではありません。Gemini 3.6モデルページ (English)から確認を始めてください。
判断の要点
マルチモーダル入力、速いループ、少ない出力料金が必要なら試す価値があります。
17%削減は日付付き比較で、タスク料金の普遍的な保証ではありません。
幻覚、タイムアウト、知識カットオフがあるため独立検証が必要です。
API、AI Studio/Antigravity、企業契約、Tabbitを別の経路として扱います。
書き込み可能なエージェントにはdiff、テスト、停止条件を要求します。
仕様
| 項目 | 確認内容 | 境界 |
|---|---|---|
| ID | 安定版 gemini-3.6-flash | クライアントのIDを再確認します。 |
| 入力 | テキスト、画像、動画、音声、PDF | クライアントが全形式を公開するとは限りません。 |
| トークン | 入力1,048,576、出力65,536 | プランの実効窓は小さい場合があります。 |
| ツール | キャッシュ、コード、computer use preview、検索、関数、grounding、構造化出力、URL context | API対応はアカウント公開を意味しません。 |
| 価格 | 入力1.50、出力7.50ドル/100万 | 無料層、ツール、リトライは別です。 |
| カットオフ | 2026年3月 | 現在の事実には出典が必要です。 |
エージェントブラウザーとは、AIブラウザー比較、Tabbit Browserの実践でAPIと製品を分けて考えます。
3.5から3.6へ、3.7との関係
Googleは3.6を3.5 Flashの次のワークホースと説明し、引用する比較で出力17%減、DeepSWE 49対37、MLE-Bench 63.9対49.7、OSWorld 83.0対78.4、GDPval-AA Elo 1421対1349を示します。これは提供者が選んだ比較で独立監査ではありません。
3.7と3.8は3.6を直ちに不要にするものではありません。3.6が少ないループで検証しやすい作業を完了するなら効率が意味を持ちます。長い自律計画には同じ課題で新しい経路を比較してください。エージェント推論ガイドで努力量、ツール、修正を記録できます。
結果と外部報告
カードはSWE-Bench Pro 58.7%、DeepSWE 49%、Terminal-Bench 78.0%、MLE-Bench 63.9%、OSWorld-Verified 83.0%、CharXiv(ツールなし)85.2%、GDM-MRCR 1M 54.0%を示します。これはコード、PC操作、図表、長文脈という別タスクです。1Mの点測は巨大入力が常に安く安定する証拠ではありません。LongCatのように転載するのではなく、Geminiのprompts (English)とreviews (English)で条件を残してください。
PromptsloveはOpenCode、高いthinking、24時間、4タスク(フロントエンド、ブラウザーゲーム、フォーム、Instagram動画)を比較しました。フォーム、CSV、編集、動画は機能した一方、フロントエンドの指定したスクロール表示、カウンター、レスポンシブ、仕上げを外したと報告しています。Redditでは範囲を絞った仕事の速度を評価する声がある一方、検証できない「確認済み」、危険な自律操作、テスト未実行、Firebaseルールの見落としが報告されました。ロールプレイでは文章を評価する声と、400エラー、拒否、長文の反復があります。条件はレビュー集合 (English)で確認してください。
価格と安全な試験
有料Standardは入力/出力1.50/7.50ドルで、thinkingも出力に含まれます。無料層は内容をGoogle製品改善に使う可能性を示し、有料層は使わないと説明します。地域と現在の条件を確認し、キャッシュ、Search grounding、ツール、リトライ、サブスクリプションを別に計算してください。APIとAI Studio、Antigravity、Enterpriseは同じ割当量とは限りません。
Tabbitも別経路です。ブラウザー自動化は課題設計には役立ちますが、セッションをGemini API請求に変えません。コードなら小さなリポジトリとテスト、文書なら日付と引用、PC操作なら捨てられるページ、長文なら反復率を受け入れ条件にします。
本稿ではTabbitのログイン済みタスクや4–8枚の適格な画像を取得していません。選択欄、実効文脈、速度、割当量、料金を主張しません。モデルが表示されたら公開文書から5つの事実とリンクを抽出し、手で確認してから書き込みを許可してください。
結論
Gemini 3.6 Flashはマルチモーダルなコードと範囲を限定したエージェント向けの効率型候補です。Googleのデータは3.5からの改善を示しますが、監督、割当量、検証が節約を消すこともあります。固定した課題で試し、自律性の価値がレビュー費を上回る場合だけ3.7や3.8へ移行してください。
出典
よくある質問
Gemini 3.6 Flashとは何ですか?
コード、知識作業、エージェント向けのGoogleの安定したマルチモーダルFlashモデルです。テキスト、画像、動画、音声、PDF入力、入力1,048,576トークン、出力65,536トークンに対応します。
3.5 Flashから何が変わりましたか?
Googleが引用するArtificial Analysisの比較では出力トークンが17%少なく、コードとマルチモーダル性能も改善しています。日付付きの提供者比較であり、全タスクのコスト保証ではありません。
料金はいくらですか?
2026年9月20日にGoogleの有料Standard行は入力1.50ドル、出力7.50ドル(100万トークン)でした。無料層、ツール、再試行は別条件です。
コーディングエージェントに向いていますか?
GoogleのカードはSWE-Bench Pro 58.7%、Terminal-Bench 2.1 78.0%、OSWorld-Verified 83.0%を示します。独立報告は範囲を限定し、監督できるタスクを勧めています。
制限はありますか?
Googleは幻覚、時々の遅さやタイムアウト、強化中の脱獄耐性、2026年3月の知識カットオフを挙げます。利用者は割当量、未実行テスト、長文の反復も報告しています。
Tabbitで使えますか?
本稿ではログイン済みのGemini 3.6 Flash Tabbitタスクを実行していません。ライブの選択欄とアカウント条件を確認してください。