GoogleのGemini 3.6 Flashモデルは、長期... ノート
VentureBeat 日本語

GoogleのGemini 3.6 Flashモデルは、長期間にわたるエンジニアリングタスクにおいてAIエージェントのトークンコストを最大65%削減 — 3.5 Proも登場予定

Google DeepMindは、Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyberの3つの新しい独自AIモデルをローンチしました。これらのモデルは、よりトークン効率が高く設計されており、AIエージェントを大規模に運用する上で、より高速、よりスマート、そしてより安価にすることを可能にします。Gemini 3.6 Flashは、入力トークン100万あたり1.50ドル、出力トークン100万あたり7.50ドルで提供されます。一方、Gemini 3.5 Flash-Liteは、それぞれ0.30ドルと2.50ドルと、大幅に安価です。比較のために、Gemini 3.1 Flash-Liteのような以前のモデルは、最もコスト効率が高いままであるものの、速度は遅いです。新しいGemini 3.5 Flash-Liteは、絶対的な最低コストよりもパフォーマンスを優先する企業向けに、速度を向上させています。Gemini 3.6 Flashと3.5 Flash-Liteは、特定のベンチマークでトークン使用量を最大65%削減するなど、顕著な効率向上を実現しています。これらのモデルは、100万トークンの入力コンテキストウィンドウと64,000トークンの出力制限を備えています。Gemini 3.6 Flashは複雑なコーディングや知識作業に適しており、3.5 Flash-Liteは高スループット、低レイテンシのアプリケーションに優れています。Gemini 3.5 Flash Cyberは、サイバーセキュリティ研究向けの専門モデルであり、一部のパートナーに提供されます。これらのモデルはすべて独自のものであり、クローズドソースであり、GoogleのAPIを通じてのみアクセス可能です。注目すべきは、非常に期待されているGemini 3.5 Proフラッグシップモデルは、まだパートナーテスト中です。今回のリリースは、エージェンティックAI機能への注力を示しており、Flashシリーズは、古い燃費の悪いモデルと比較して、効率的な配送バンに例えられています。
CdXz5zHNQW_QEx9g1QmkG.png