End-to-end speech generative model
Abstract
音声基盤モデルは、AIと人間のlow-latency/seamlessなコミュニケーションを実現する為に必要不可欠な物です。音声におけるこうした基盤技術の開発は、テキストにおけるLLMと比べて技術的な発展が遅れてきた背景がありました。今回の発表では、LLMの用に大量のGPU計算資源を投入して開発するend-to-endの音声基盤モデルに関して発表します。
Related Web pages
N/A
Achievements
(1) 学術論文 (査読あり)
該当なし
(2) 国際会議プロシーディングス (査読あり)
該当なし
(3) 国際会議発表(査読なし)
該当なし
(4) 国内会議発表(査読なし)
該当なし
(5) 公開したライブラリなど
該当なし
(6) その他(特許,プレスリリース,著書等)
[]Youtubeを通じたデモ公開