VentureBeat 日本語
フォロー
OpenAIがCodexとChatGPTにGPT-Liveのフルデュプレックス音声コントロールをデスクトップで提供し、エージェンティックコーディングがハンズフリー化
OpenAIは、高度なGPT-LiveオーディオAIをmacOSおよびWindowsのChatGPTデスクトップアプリケーションに統合しました。この強化により、同時に聞き取りと発話が可能になり、厳格な交代制が排除され、より自然な会話が可能になります。開発者は、音声コマンドを使用して複雑なコーディングタスクを調整し、コードをレビューし、アプリケーションをデバッグできるようになり、ハンズフリーのソフトウェア開発体験が実現します。このシステムは、リアルタイムの音声レイヤーをバックグラウンドの推論モデルから分離し、重い計算ワークロードを委任しながら、流暢な会話を可能にします。macOSユーザーの場合、「Appshots」と画面コンテキスト機能により、ChatGPT Voiceはアクティブなウィンドウ、ローカルファイル、およびコード構造を分析できます。これにより、開発者が口頭で問題を議論している間にAIエージェントが非同期でタスクを実行するペアプログラミングのダイナミクスが生まれます。ソフトウェアエンジニアは、バグの調査やプルリクエストのレビューを同時に行うなど、単一の音声プロンプトで複数の同時タスクスレッドを開始できます。アプリケーションは、Slack、GitHub、およびローカルコードベースを含むさまざまなコンテキストにわたるアクションを調整します。開発者は、タスクを異なるレイヤーに分割することで、デザインモックアップを口頭でコードに変換することもできます。この音声対応デスクトップリリースへのアクセスは、さまざまなChatGPTプランの有料サブスクライバーに限定されています。基盤となるシステムは引き続きプロプライエタリであり、組織が変更したり、セルフホストしたりすることはできません。ChatGPT Voiceを介して開始されたタスクは、既存のプランクォータからの標準的な使用割り当てを消費します。開発者コミュニティは、ハンズフリーの自律コーディングワークフローの可能性に熱狂的な反応を示しており、一部はそれをパーソナルAGIへの一歩と見なしています。