語音生成/推論系統
Faster IndexTTS-2、自回帰音声パイプラインをTensorRTへ移植し、エンドツーエンドで最大3.6倍高速化
新たな研究では、TensorRTとTensorRT-LLMを用いてIndexTTS-2のGPT、Diffusion Transformer、ボコーダーを再構築し、ストリーミング推論とバッチ推論にも対応した。英語・中国語のSeed-TTS実験ではGPTが最大5倍高速化したが、現時点の公開資料だけでは、最適化パイプライン全体を直接再現するには不十分だ。