VentureBeat 日本語
フォロー
Qwen3.8-Maxは、エージェント型コンピューター利用においてGPT-5.6 Sol MaxおよびFable 5を上回るとの大胆な主張とともに登場しました。
AlibabaのQwenチームは、2.4兆パラメータのマルチモーダル大規模言語モデルであるQwen3.8-Maxを発表しました。この新しいモデルは、自律的なソフトウェアエンジニアリングと複雑で長期間にわたるエンタープライズタスクにおいて優れた性能を発揮することを目指しています。初期のベンチマークによると、Qwen3.8-Maxは、主要なプロプライエタリモデルであるGPT-5.6 Sol MaxやFable 5を、主要なエージェンティックコンピューティング評価で上回っています。OSWorld-Verified、PaperBench、その他のソフトウェアエンジニアリングおよびマルチモーダル推論ベンチマークで高いスコアを達成したと報告されています。重要な戦略的動きとして、Alibabaは来週、Qwen3.8-MaxとQwen3.8-27Bのオープンウェイトをリリースする計画です。これにより、MaxクラスのQwenモデルが初めてセルフホストデプロイメントで利用可能になり、エンタープライズでの採用が変革される可能性があります。しかし、これらのオープンウェイトのライセンス条件はまだ開示されておらず、潜在的な制限に関する不確実性が残っています。基盤モデルの競争環境はますます専門化しており、さまざまな企業が異なる強みに焦点を当てています。Qwen3.8-Maxは、これらの多くの機能を統合し、長期間にわたるプロジェクト実行のための自律的な同僚としての地位を確立しようとしています。そのパフォーマンスは、単一プロンプト応答だけでなく、ワークフロー完了で評価されるフロンティアモデルの傾向を強調しています。リリースに伴うベンチマークスイートは、長期間にわたる実行を重視しており、Qwen3.8-MaxはOSWorldとPaperBenchでリーダーシップを示しています。すべてのカテゴリで支配的ではありませんが、エンタープライズにアピールする広範でバランスの取れたパフォーマンスプロファイルを提供します。その潜在的な強みは、長期間にわたるソフトウェアエンジニアリング、コンピューター利用エージェント、研究自動化、およびマルチモーダル産業ワークフローにあります。Qwen3.8-MaxのAPI価格設定も競争力があり、主要な米国のプロプライエタリ製品よりも安価です。しかし、そのオープンウェイトリリースの最終的な影響は、Alibabaが実装することを選択する特定のライセンス条件にかかっています。