ニュース内容
ブラウザ上で入力した文章から映画のような対話や効果音、音楽を生成できる音声合成モデルが公開され、話者の感情や話す速度、声の高さ、アクセントを細かく調整することで人間のような自然な表現を実現したほか、短い音声サンプルから特定の人の声を再現する技術やノイズを含む音声からの学習機能も備えており、笑い声やため息といった呼吸音を自由に挿入できるため物語の朗読や動画の吹き替え、ポッドキャスト制作など幅広い用途で活用できるとしている。
リアルタイムの対話に適した高速モデルと品質を重視したモデルを選択できる柔軟性も確保されており、16言語に対応したこの技術は誰でも手軽に高品質な音声を生成できる環境を提供するため、クリエイターやコンテンツ制作の現場における今後の動向が注目される。
Webサイトqwenaudio.app