AlloyDB、データベース内でローカル推論でLLM呼び出し... ノート
InfoQ 日本語

AlloyDB、データベース内でローカル推論でLLM呼び出しを置き換えるプロキシモデルを出荷

Googleは、LLMの出力から軽量なローカルモデルをトレーニングし、外部呼び出しなしでデータベース速度でクエリを実行するプロキシモデルアーキテクチャでAlloyDB AI機能をGAとしてリリースしました。スマートバッチングにより、スループットが2,400倍向上します。プロキシモデルはプレビューで毎秒10万行に達しますが、ベンチマークの数値は内部テストのai.ifにのみ適用されます。Steef-Jan Wiggers著
CdXz5zHNQW_LyB1UbKSWs.jpeg