Suno、音声と音楽の同時生成を開始

音声生成の新機能

音声と音楽の同時生成
ウェブ・モバイル対応
背景音楽の解除機能

制作方法と調整項目

指示文で作る簡易モード
台本対応の詳細モード
声質と表現の調整機能
最長約8分の生成時間
詳細を読む

AI音楽生成サービスを手がけるSunoは2026年10月2日、台本や指示文から合成音声を作る新機能「Speech」をウェブ版とモバイル版で公開ベータとして提供し始めました。音声とAI生成の背景音楽を一つのトラックとして同時に作れる点が特徴で、音楽制作以外の表現へ事業領域を広げる狙いです。利用者は用途に応じ、背景音楽を外して音声だけを生成することもできます。

作成方法は二つあります。Simpleモードでは「乗組員を鼓舞する海賊船長」のように希望を指示文で伝え、Advancedモードでは任意の台本を入力し、声の性別や話し方、生成結果の多様性を調整できます。

生成できる音声は最長約8分です。Sunoは、詩に落ち着いた曲を添えたり、劇的なナレーションや激励の言葉に力強い曲を組み合わせたりする用途を例示しており、音声と音楽を一体で設計できます。

一方、現段階は完成版ではありません。英国風のアクセントが途中でオーストラリア風に変わる場合や、間の取り方が過度になる場合があり、Sunoは利用者の意見を基に改善を続ける方針です。

AI音声生成ではAdobeやElevenLabsなどが先行しています。Sunoは背景音楽との同時生成を独自性として打ち出し、音楽を中心にしながら人間の表現全般へ製品領域を広げようとしています。