VentureBeat 日本語
フォロー
SpaceXAIはGrok 4.6を発表し、Kimi K3のパフォーマンスを上回り、GPT-5.6に匹敵する性能で、人工分析において世界第3位となった。
SpaceXAIは、長時間のAIエージェント、コーディング、ナレッジワークに焦点を当てた最新のAIモデル「Grok 4.6」をリリースしました。この新しいモデルは、前モデルであるGrok 4.5と比較して大幅な改善が見られます。Grok 4.6は、サードパーティのベンチマークで競争力のあるスコアを達成し、OpenAIのGPT-5.6 Sol Maxに並び、エージェントおよびコーディングタスクで大幅に向上しました。性能は良好ですが、Claude Opus 5やFable 5のようなトップティアのモデルをすべての評価で普遍的に凌駕するわけではありません。Grok 4.6の重要な側面は、これらの要求の厳しいワークロードに対してコスト効率が高くなるように設計された価格設定戦略です。APIの価格は、入力トークン100万あたり2ドル、出力トークン100万あたり6ドルから始まり、他の主要モデルと比較して中程度の価格帯です。SpaceXAIは、Grok 4.6の拡張された運用におけるコンテキスト維持能力とタスクフォーカスの強化を強調しています。これは、拡張されたトレーニングデータとエージェント環境での強化学習によって達成されます。このモデルは、自己テストおよび検証能力も強化されています。しかし、Intelligence-versus-Cost-per-Taskの分析によると、タスクあたりの経済性では一部の前モデルや競合他社ほどではない可能性があります。エンタープライズは、200,000プロンプトトークンを超えると料金が大幅に上昇するため、長いコンテキストの価格設定を慎重に検討する必要があります。技術的なパフォーマンスとコストを超えて、Grokブランドは、安全性、バイアス、誤用に関する過去の論争により、かなりの負担を抱えています。これらの歴史的な問題は、Grok 4.6の機能強化と価格設定に関わらず、エンタープライズの採用に影響を与える可能性があります。