Cloud Run インスタンスでパーソナルAIエージェントをデプロイする
Google Cloud は、AI エージェントのような長期間実行されるステートフルなワークロードを低コストで実行するための新しいソリューションである Cloud Run インスタンスを導入しました。従来の Cloud Run サービスはゼロにスケールするため、継続的に実行されるエージェントには適していません。専用仮想マシンは常に利用可能ですが、コストが高く、管理も必要です。Cloud Run インスタンスは、自動スケーリングなしで単一インスタンスを実行する、専用のシングルトンコンピューティングランタイムを提供します。デフォルトの自動再起動ポリシーにより、最大 7 日間の継続的なランタイムをサポートします。各インスタンスには、更新や再起動を通じて安定したままの永続的な HTTPS URL が割り当てられます。ユーザーは必要に応じてインスタンスを停止および再開することもできます。バースト予算を利用した共有 vCPU を使用すると、継続的に実行されるインスタンスを 30 日間実行するためのコストはわずか 5.70 ドルからとなります。このモデルは、断続的なコンピューティング集約型のタスクを持つエージェントに最適です。OpenClaw のような AI エージェントのデプロイは、設定ファイルをアップロードした後の簡単なコマンドラインデプロイで簡素化されます。これらのデプロイされたインスタンスは無期限に実行でき、さまざまな通信プラットフォームを介して対話できます。Google Cloud ユーザーはすでに肯定的な結果を報告しており、OffDeal はコールドスタートの大幅な削減と高い信頼性を指摘しています。Cloud Run インスタンスは現在プレビュー段階にあり、この新しいクラスのワークロードに費用対効果の高いオプションを提供します。