Gemini 3.7 Flash発表:コーディングとエージェント向けの新AIモデル、コスト半減で提供


ADVERTISEMENT

Gemini 3.7 Flashの技術的進化と主要機能

Googleは、AIモデルの迅速なイテレーションの一環として、Gemini 3.6 Flashのリリースからわずか3週間で、最新の「Gemini 3.7 Flash」を発表しました。このモデルは、コーディング、エージェントワークフロー、および知識集約型タスクに特化して設計されており、前モデルと比較して大幅な性能向上を実現しています。

Gemini 3.7 Flashは、特にソフトウェアエンジニアリング、Web開発、および複雑なドキュメント処理において顕著な進歩を見せています。コーディング能力に関しては、デバッグ、問題解決、および実稼働レベルのコード生成タスクで強力な改善を達成しています。具体的なベンチマークでは、FrontierCode 1.1 Mainで43.6%(3.6 Flashの34.4%から向上)、DeepSWE v1.1の長期的ソフトウェアエンジニアリングテストで65.3%(同49.0%から向上)を記録しました。Web開発においても、より少ないプロンプトで機能的なレイアウトとフル機能のアプリケーションを生成し、参照スクリーンショット、画像、デザインシステムへの高い準拠性を示しています。Code ArenaではEloスコア1588を達成し、3.6 Flashの1538から向上しています。

エージェントワークフローにおいては、Gemini 3.7 Flashは障害に遭遇した際の適応能力、意図の明確化、および指示の忠実な実行において改善が見られます。マルチステップの計画立案とツール呼び出しにおいて、より勤勉な「思考」を行うことで、手動での監視を減らし、再試行の回数を削減することが期待されます。また、金融、法律、生命科学といった知識集約型分野での推論と精度が向上しており、複雑なドキュメント理解を評価するGDP.pdfベンチマークでは34.0%(3.6 Flashの22.0%から向上)、実世界のビジネスワークフロー自動化を評価するAutomationBenchでは30.4%(同17.0%から向上)という結果を出し、その能力が示されています。

技術仕様としては、最大100万トークンのコンテキストウィンドウと、最大64,000トークンの出力に対応しています。テキスト、画像、音声、動画のマルチモーダル入力をサポートし、品質、コスト、レイテンシーのバランスを調整できるカスタマイズ可能な思考設定を提供します。

コスト効率と開発者体験の劇的改善

Gemini 3.7 Flashの最も注目すべき点の1つは、その価格設定戦略です。Googleは、モデルの導入を促進するため、2026年12月31日まで、入力トークン100万あたり$0.75、出力トークン100万あたり$3.75という特別価格を提供しています。これは、Gemini 3.6 Flashの標準API価格と比較して半分にあたるコストです。2027年1月1日からは、標準価格として入力トークン100万あたり$1.50、出力トークン100万あたり$7.50が適用される予定です。この戦略は、企業がAIエージェントや高頻度のコーディングワークフローにモデルを組み込む上で、非常に魅力的なインセンティブとなります。

このコスト削減は、特に大規模なAIデプロイメントを検討している企業やスタートアップにとって、総運用コストを大幅に削減する機会を提供します。Googleは、3.7 Flashの知能向上と低推論コストの組み合わせが、再試行の削減や手動監視の軽減につながり、結果としてトータルコストの低下に貢献すると述べています。

開発者体験の観点では、3.7 Flashは前モデルと比較して著しく改善された体験を提供します。障害発生時の適応能力の向上、必要な場合の意図の明確化、およびより高い忠実度での指示への追従は、開発者がよりスムーズに、かつ効率的にAIを統合できることを意味します。マルチステップの計画とツール呼び出しにおける勤勉な実行は、エンジニアリングワークフロー全体で手動監視を減らし、再試行を少なくすることに寄与します。

エージェントワークフローと知識集約型タスクへの応用展望

Gemini 3.7 Flashは、その強化された能力とコスト効率から、幅広いエージェントワークフローおよび知識集約型タスクへの応用が期待されています。特に、ソフトウェア開発ライフサイクルにおける自動化において、デバッグ、コード修正、および本番環境対応コードの生成といったコアタスクでの性能向上が、開発者の生産性を大きく向上させる可能性があります。Web開発では、デザインシステムや参照画像からのUI生成、機能完全なアプリケーションの迅速なプロトタイピングと構築が容易になります。

さらに、本モデルは、財務、法律、生命科学などの専門知識を要する分野での利用においてもその真価を発揮します。複雑なドキュメントからの情報抽出、推論、およびビジネスプロセスの自動化を支援することで、これらの業界におけるバックオフィス業務の効率化や、意思決定の質の向上に貢献するでしょう。Google AntigravityやGemini Enterprise Agent Platformなどのプラットフォームを通じて、企業は3.7 Flashを活用し、自律的なAIシステムを構築し、タスクの計画、ソフトウェアツールの使用、マルチステップのワークフロー実行を限定的な人間の介入で行えるようになります。

個人ユーザー向けには、Google AI ProおよびUltraサブスクライバー向けのGemini SparkにおいてGemini 3.7 Flashが利用可能となり、24時間365日稼働するパーソナルAIエージェントとして、知識作業の効率化、Google Workspaceアプリとの連携強化、および複雑なマルチスキルワークフローにおける精度と出力品質の向上を提供します。これにより、アイデアを行動に変え、ファイルの統合、メールの草稿作成、ステータスドキュメントの更新などをより効率的に実行できるようになります.

開発者・エンジニア視点での考察

  1. 高精度と低コストを両立したエージェント開発の加速: Gemini 3.7 Flashの導入価格は、入力トークン100万あたり$0.75、出力トークン100万あたり$3.75と、前モデルの半額でありながら、コーディング、エージェントタスク、知識集約型ワークフローにおける性能が向上しています。これにより、開発者は、特に高頻度なAPIコールを必要とする大規模な自律型エージェントや自動化ソリューションを、運用コストを大幅に削減しながら大規模に展開できるようになり、より高い投資対効果(ROI)を実現する機会が拡大します。

  2. 迅速な反復開発とフィードバックサイクルへの対応: GoogleがGemini 3.6 Flashのリリースからわずか3週間で3.7 Flashをリリースしたという異例の速さは、開発者のフィードバックとアルゴリズムの革新に対する同社のコミットメントを強く示しています。これにより、開発者は最新かつ最も効率的なAI技術を迅速に自身のプロジェクトに統合し、市場の要求やユーザーのニーズに柔軟に対応した製品開発を加速することが可能になります。

  3. マルチモーダル入力と豊富なツール連携によるアプリケーション拡張: 最大100万トークンの広範なコンテキストウィンドウと、テキスト、画像、音声、動画といった多様なマルチモーダル入力をサポートする能力は、単なるコード生成やテキスト処理に留まらない、よりリッチでインタラクティブなAIアプリケーションの設計を可能にします。関数呼び出し、検索連携、そしてコンピュータ使用といった機能と組み合わせることで、開発者は、デザインシステムからのUI自動生成、複雑な法的・財務文書の理解と処理、さらには実際の環境とインタラクトする自律型エージェントなど、これまで以上に多様で高度なユースケースへの道を開くことができます。


Source / 元記事

この記事について

著者
AIBloom AI編集部
初回公開
最終更新

この記事は、公開されているニュース、論文、公式発表、RSSフィードなどをもとに、AIが要約・補足調査・考察を行って作成しています。

元記事の完全な翻訳・逐語的な要約ではなく、AIによる背景説明や開発者向けの考察を含みます。

重要な技術仕様・価格・提供状況などは、必ず元記事または公式情報をご確認ください。

About AIBloom

ADVERTISEMENT