ニュース
Googleが音声認識モデル「Gemini 3.5 Transcribe」を発表
Googleは、音声認識技術「Gemini 3.5」をリリースしました。これは、音声認識モデル「Transcribe」の最新版で、「えーと」「あー」といった間投詞を自動的に削除し、テキストを自己修正することで、より流暢なテキストを生成します。前バージョンのChirp 3と比較すると、処理速度は約70%向上し、リアルタイム音声認識エラー率は5.5%にまで低減されています。このモデルは85言語に対応し、最大3つの録音済み音声トラックをサポートしており、Pixel 11のGboardキーボードの「Rambler」機能ですでに使用されています。