ニュース
StepAudioは、新世代の自動音声認識モデルであるStepAudio 2.5 ASRを発表しました。
次世代自動音声認識モデル「StepAudio 2.5」がリリースされました。このモデルは、大規模言語モデル推論高速化技術を音声認識分野に初めて導入した画期的なモデルです。ASR+MTP-5アーキテクチャをベースとし、推論速度を400%向上、レイテンシを60%削減、ピーク速度を500トークン/秒、コストを80%削減しました。中国語と英語の主要ベンチマークにおいて最先端(SOTA)性能を実現し、32Kのコンテキストウィンドウを再利用、30分間の音声を1回の処理で文字起こしできます。