InfoQ 日本語
フォロー
AlloyDB、データベース内でローカル推論でLLM呼び出しを置き換えるプロキシモデルを出荷
Googleは、LLMの出力から軽量なローカルモデルをトレーニングし、外部呼び出しなしでデータベース速度でクエリを実行するプロキシモデルアーキテクチャでAlloyDB AI機能をGAとしてリリースしました。スマートバッチングにより、スループットが2,400倍向上します。プロキシモデルはプレビューで毎秒10万行に達しますが、ベンチマークの数値は内部テストのai.ifにのみ適用されます。Steef-Jan Wiggers著
AlloyDB Ships Proxy Models That Replace LLM Calls with Local Inference Inside the Database infoq.com