GoogleのGemini 3.8 Flash:高速な反復、よりスマートなエージェント、そしてサイバーセキュリティへの注力
Google、新しいGemini 3.8 FlashモデルでGeminiリリースを加速 TREE NEWS 報道: Gemini 3.7 Flashの発表からわずか3週間で、GoogleはGemini 3.8 FlashとGemini 3.8 Flash Cyberの2つの新モデルを発表しました。同社はこれらをこれまでで「最も強力な推論・プログラミングモデル」と主張しており、長期的なコーディング、自律エージェントワークフロー、複雑な推論に優れるように設計されています。Cyberバリアントは脆弱性の発見と自動パッチ適用に重点を置いています。独立系AIベンチマーク企業のArtificial Analysisによると、これはGoogleにとって6週間で3回目、4か月足らずで4回目のFlashモデルリリースとなります。 注目すべきは、Googleが攻撃的な価格戦略を維持していることです。Gemini 3.8 Flashのリスト価格は3.7 Flashと同じく、入力トークン100万あたり0.75ドル、出力トークン100万あたり3.75ドルで、割引は年末まで続きます。ただし、Artificial Analysisは、3.8 Flashの高推論モードはタスクあたり約0.58ドルかかり、3.7 Flashの0.40ドルより40%高いと指摘しています。これは、モデルが約30%多くのトークンを出力し、より多くのエージェントループに関与するためです。このモデルはArtificial Analysis Intelligence Indexで59(3.7 Flashの56から上昇)を獲得し、1秒あたり約305トークンを出力します。 コード生成から自律エージェントへ 中核となるアップグレードは、Geminiを単発のコード生成から、長期的なソフトウェアエンジニアリングと自律エージェントへと移行させます。Googleは、3.8 FlashがDeepSWE v1.1ベンチマークで優れており、多くの大規模フロンティアモデルよりもエンドツーエンドで複雑なエンジニアリング問題を解決すると報告しています。また、金融と法律の専門エージェントテストでも改善し、HLE-Verifiedで54.9%を獲得しました。このモデルは「より多くを行う」ように設計されており、追加の推論ステップを実行し、ツールを繰り返し呼び出し、長時間実行されるエージェントループで結果を自己評価します。デモには、単一のプロンプトからプレイ可能な3Dゲームを生成したり、ハードウェアの分解のインタラクティブな3Dビジュアライゼーションを作成したりすることが含まれます。...



