
株式会社TARVOで研究・開発したパラレル音声データを用いた音声変換技術が信号処理技術のトップカンファレンスである、2021 IEEE International Conference on Acoustics Speech and Signal Processing (ICASSP)に採録されました。本稿では、自己注意機構を備えたTransformerを拡張した非自己回帰系列変換モデルに基づく音声変換モデルを新たに提案しました。本提案モデルは、従来のRNNやTransformerを用いた自己回帰系列変換モデルを上回る変換精度・変換速度・変換制御性を実現しました。
本稿の概要は こちら をご覧ください。
変換サンプル音声も同じページで公開しています。
また、本技術に関するお問い合わせは こちら からお受けいたします。
T. Hayashi, W. C. Huang, K. Kobayashi, T. Toda, “Non-autoregressive sequence-to-sequence voice conversion,” 2021 IEEE International Conference on Acoustics Speech and Signal Processing (Accepted).