ニュース
OpenAIが3つのリアルタイム音声モデルを発表
OpenAIは、3つのリアルタイム音声モデルを発表しました。GPT-Realtime-2は、GPT-5レベルの推論能力とツール呼び出し機能を備えています。GPT-Realtime-Translateは、70以上の言語間でリアルタイム翻訳をサポートし、1分あたりわずか約0.25元という、人間の同時通訳の100分の1のコストを実現しています。GPT-Realtime-Whisperは、低遅延の音声文字起こしを実現します。これら3つのモデルはすべてRealtime APIを通じて利用可能で、イントネーションや感情を保持したエンドツーエンドの処理を提供します。