OpenAI は今日、ChatGPT デスクトップアプリに大きなアップグレードを施しました。このクライアントはすでに Codex と統合されており、GPT-Live モデルによって駆動される ChatGPT Voice という新しい音声モードを正式に導入しました。新バージョンでは、チャット(Chat)、作業(Work)およびプログラミング(Codex)の3つのセクションで、直接音声を使ってタスクを開始、確認または調整することが可能です。マルチスレッド作業の協調性を、キーボード操作から口頭で行うように変えてくれます。

image.png

この機能の背景には長い歴史があります。OpenAI は2024年に初めて ChatGPT に音声認識を追加し、その後一歩一歩音声技術を進化させてきました。そして最新リリースされた GPT-Live モデルにより、双方向通信の能力が実現されました。これは、一方が話している間にもう片方が聞くことができ、AIとの会話がより人間に近づくことを可能にします。OpenAI の発表文では、ビジョンが明確に示されています。つまり、将来的にはユーザーがニーズを口頭で述べるだけで、ChatGPT があなたの思考に沿って迅速に複数のタスクを進行させるということです。