OpenAI が、人間と AI の自然な音声対話を目的とした新世代の音声モデル「GPT-Live」を公開した。公式発表によれば、このモデルは ChatGPT の音声機能(ChatGPT Voice)を支える基盤として稼働している。今回の要点は、音声機能を載せ替えたのではなく、音声対話を担うモデル自体が世代交代した点にある。

音声インターフェースはテキスト入力より操作の負荷が低く、ハンズフリー用途や日常利用で AI に触れる入口を広げる。その入口の質を決めるのが対話の自然さであり、それを担う中核が ChatGPT の巨大な利用基盤の上で入れ替わったことになる。既存の ChatGPT 利用者は、追加の乗り換えなしに既存の音声機能を通じて新モデルの体験に触れられる。

なお、詳細な技術仕様や性能数値は公式発表の要点として情報源には示されていない。読者はまず公式発表で対応範囲を確認し、導入済みの音声機能で応答の自然さを実際に試すのが妥当だ。