長期的なコーディングと推論
Googleでこれまでで最高の推論・コーディングモデルと説明されており、ソフトウェアエンジニアリングや長期的なタスクで3.7 Flashを大きく上回る性能向上を実現しています。
Gemini 3.8 Flash and 3.8 Flash Cyberは、エージェント型コーディング、複数段階の推論、サイバーセキュリティ防御に対応するGoogle Geminiモデルです。3.8 Flashは汎用モデル、3.8 Flash CyberはFairwind Program経由で信頼できる防御担当者に提供されます。
Gemini 3.8 FlashとGemini 3.8 Flash Cyberは、関連しながらも異なる2つの用途、すなわち一般的なエージェント型推論とサイバーセキュリティ防御向けに発表されたGoogle Geminiモデルです。同社は3.8 Flashを、長期的なコーディング、自律型エージェント、複数段階の推論向けに設計された、最も知的なワークホースモデルと説明しています。一方、3.8 Flash Cyberは、脆弱性の発見と自動パッチ適用に重点を置く専門的なサイバー版です。
提供元の説明では、両モデルは基盤となる知性と、速度・コスト面で類似した特性を共有しており、3.8 Flashは3.7 Flashと同じ導入価格で提供されます。3.8 Flash Cyberは一般公開されておらず、政府や信頼できるパートナーが高度なサイバー防御ツールを利用するための限定アクセスプログラムであるFairwind Programを通じて、信頼できる防御担当者に提供されます。
Googleでこれまでで最高の推論・コーディングモデルと説明されており、ソフトウェアエンジニアリングや長期的なタスクで3.7 Flashを大きく上回る性能向上を実現しています。
提供元によると、3.8 Flashは複雑なタスクで追加の推論ステップを実行し、ツールを反復的に呼び出せます。これにより、専門領域をまたぐ複数段階の作業に対応できます。
3.8 Flashは、企業の重要な自律化に対応するワークホースモデルとして位置付けられており、定量、法律、STEM型の推論ワークロードに関するベンチマーク結果が示されています。
3.8 Flash Cyberは、自律的な脆弱性の発見と自動パッチ適用を目的としており、脆弱性の発見とコード修正で高い性能を示すベンチマーク結果が示されています。
Fairwind Programでは、3.8 Flash CyberとCodeMenderハーネスを組み合わせ、安全なクラウド環境内で防御担当者がエージェント規模で脆弱性を発見、検証、修正できるよう支援します。
提供元は、3.8 FlashにはCBRNおよびサイバー攻撃領域での悪用を防ぐ安全対策が組み込まれており、両モデルともプロンプトインジェクションへの堅牢性が向上していると説明しています。
長期的な計画、ツールの使用、エンドツーエンドの問題解決を必要とするソフトウェアエンジニアリングタスクに3.8 Flashを使用します。特に、より大規模なフロンティアモデルよりも低コストのモデルが望ましい場合に適しています。
タスクを完了するために、モデルが複数のステップにわたって作業を続け、自らの出力を修正し、ツールを複数回呼び出す必要があるエージェント型ワークフローに3.8 Flashを使用します。
複数段階の推論が重要となる金融、法律、STEMなどの分野やその他の専門領域で、専門的な分析やレポート作成に3.8 Flashを使用します。
安全な環境でCodeMenderとともに3.8 Flash Cyberを使用し、手作業による修正だけに頼らず、脆弱性の発見、検証、パッチの生成を行います。
信頼できる防御担当者向けのプログラムで3.8 Flash Cyberを使用し、多言語のリポジトリを含む複雑なコードベース全体から、大規模に脆弱性を発見します。
Gemini 3.8 Flashは、長期的なコーディング、エージェント型タスク、複数段階の推論に対応する汎用ワークホースモデルです。Gemini 3.8 Flash Cyberは、脆弱性の発見と自動パッチ適用に特化したサイバーセキュリティ版で、Fairwind Programを通じて信頼できる防御担当者にのみ提供されます。
Gemini 3.8 Flashは、3.7 Flashと同じ導入価格で提供されます。料金は入力トークン100万個あたり0.75ドル、出力トークン100万個あたり3.75ドルです。提供元の内容では、3.8 Flash Cyberの個別の公開料金は示されていません。
Gemini 3.8 Flash Cyberは、Fairwind Programを通じて限られた数の信頼できる防御担当者に提供されます。このプログラムは政府および信頼できるパートナー向けの限定アクセスプログラムで、参加組織は厳格な運用基準に同意するものと説明されています。
提供元の説明では、3.8 Flashは追加の推論ステップと反復的なツール呼び出しを使うことで、複雑なタスクに対してより深く取り組みます。また、計算効率が重要な場合は、低い推論 effortレベルによってトークンのオーバーヘッドを削減できるとされています。
提供元によると、3.8 Flash Cyberは、防御担当者が脆弱性を発見・検証・修正できるよう設計されており、安全なクラウド環境内で数分以内にデプロイ可能なパッチを生成することも含まれます。また、エクスプロイトなどの攻撃的な機能よりも、脆弱性の修正を優先している点が強調されています。
ByteAskは、C/C++向けのターミナル起点AIコーディングエージェント。リポジトリを編集し、コンパイラやデバッガ、サニタイザ、テストで変更を検証してから差分を表示。無料枠あり。
Manta AIは、URLからアプリの挙動を把握し、回帰を検出し、スクリプトやセレクタ管理なしでテストを生成できる自律型Webアプリテストツールです。
Ghostは、チャット、コード生成、コマンドラインでのタスク実行に対応したターミナル向けAIアシスタントです。無料モデルを同梱し、Linux、macOS、Windowsで使えます。オープンソースです。
Vi3ecodeは、AIコーディングエージェント向けの開発環境です。プロジェクト文脈、ターミナル、Git、メモリ、フロー、レビュー、コミュニケーションを連携させます。
Lucid Trainは、リポジトリのコードからアーキテクチャ図を生成し、その図をコーディングエージェント向けの仕様として使うローカルファーストのAIコーディング支援です。デスクトップアプリと軽量なRust CLIで利用でき、ローカルモデルや自分のAPIキーにも対応します。
CreateOS Sandboxは、FirecrackerマイクロVM上でコードやエージェントのワークロードを実行できる分離型コンピュート環境です。SDK、CLI、MCPで制御可能。