「オペラからヘヴィメタルへ、一曲の中でシームレスなジャンル遷移が可能に。」
ElevenLabsが次世代音楽モデルMusic v2のリリースを発表しました。
こんにちは、ElevenLabsラボです。⚡
2026年5月27日、ElevenLabsが次世代音楽生成モデルMusic v2の正式リリースを発表しました。前モデルの登場から約4ヶ月という短期間でのメジャーアップデートとなりますが、公式発表では「品質・制御性・創造性において次世代への大きな飛躍(major step forward)」を遂げたと強調されています。
今回は、ElevenLabsが公式発表したv2の改善点をまとめ、当ラボでどのような項目をどのように検証していくのかをお伝えします。実際の検証結果は、次回の記事でデモ曲パッケージとして共有する予定です。
🎯 ElevenLabsが発表したv2の主要4項目(公式発表に基づく)
1. 高度な制御性(Highly Steerable Generation)
公式の言及:「高速なラップ、複雑なボーカルフレーズ、突然のスタイル・デリバリー・楽器の切り替えなど、詳細なクリエイティブの指示に対して安定して応答するよう設計されました。」
→ 注目ポイント:v1まではプロンプトを詳細に指定しても「雰囲気だけ似たような」結果になることが多かったですが、v2で指示通りのディテールがどれだけ忠実に反映されるのかを確認します。
2. デフォルト音質の向上(Improved Sound by Default)
公式の言及:「ボーカル、楽器編成、パフォーマンスが改善され、モデルから生成された時点でよりポリッシュ(洗練)され、表現豊かで聴き心地の良いサウンドになっています。」
→ 注目ポイント:「プロンプトを細かく調整せず、デフォルト設定のままで実用レベルに達しているか?」をv1と同一条件で比較検証します。
3. ジャンル遷移(Genre Transitions)
公式の言及:「一曲の中でオペラとヘヴィメタルのような全く異なるジャンルを行き来しても、音楽的な一貫性(coherence)を維持します。スプライシング(編集作業)は不要です。」
→ 注目ポイント:これが事実ならBGM制作のワークフローが根本から変わります。一曲の中で自然な遷移が起こるのか、音の途切れや不自然なノイズがないか、実際に聴いて判断します。
4. 多言語生成(Multilingual Generation)
公式の言及:「多言語での音楽生成能力が向上し、入力した言語の通りに歌詞・ボーカル・アレンジがより安定して動作します。」
→ 注目ポイント(日本語ユーザーにとって最重要):v1までは日本語の歌詞生成において発音が不自然だったり、英語のイントネーションに引きずられたりするケースがありましたが、v2でどれほど改善されたかを日本語の歌詞で直接テストします。
💡 誰にとってメリットがあるのか?
公式発表に基づいた予測です(実際の有用性は検証後に更新します):
J-POPスタイルのデモを作る作曲家 — v1の日本語ボーカルに満足できなかった方は、v2の検証結果をぜひお待ちください。
YouTubeショートやInstagramリールのBGM制作者 — 「一曲でジャンルを2〜3個ミックスできる」という主張が本当なら、30秒のフッキングBGM制作が格段に速くなる可能性があります。
Suno/Udioの無料枠に限界を感じている方 — ElevenLabsのCreatorプラン(月額$22、割引適用時は$11)で、ボイスクローン(PVC)+ ダビング + Music v2 + Studio + Agentsをすべてまとめて利用可能です。
🎵 早速使ってみる(ファーストインプレッション)
Music v2はElevenMusicからすぐに利用可能と発表されています。無料プランのクレジットを使ってテストすることも可能です。
🔬 次回予告:v1 vs v2 直接比較パッケージ公開
公式発表を鵜呑みにはできません。ラボでは、同じ歌詞 + 同じ構成 + 3種類のジャンルプロンプトを用いて、v1とv2を並べて書き出した検証パッケージを準備しました。
共通の英語歌詞 1曲 — 構成タグ(
[Intro],[Verse],[Chorus],[Outro])の反映能力を比較3つのジャンルプロンプト — Synthwave(ボーカルの分離度)、Modern Alt Rock(楽器の分離度)、R&B/Neo-Soul(ボーカルのディテール)
計6トラック — v1とv2の同一条件直接比較
聴き比べの3大ポイント — ボーカルの複雑さ / 楽器の分離度 / 構造の認識力
次回は、検証パッケージの全貌を公開し、皆さんがご自身の耳で違いを確認できるようにガイドをお届けします。🔔
📚 併せて読みたい記事
今日も良い創作を!
ElevenLabsラボ ⚡
❓ FAQ: よくある質問
Q1. Music v2 はいつリリースされましたか?
A. 2026年5月27日に正式リリースが発表されました。
ElevenMusic v1 のリリースから約4ヶ月ぶりとなるメジャーアップデートです。
Q2. v1 と比較して何が変更されたと発表されましたか?
A. 公式発表によると、主な変更点は以下の4点です。
① 細かな指示に対する安定した制御性能
② プロンプトを工夫しなくても向上する基本音質
③ 1曲内でのジャンル切り替え
④ 多言語生成の安定化
Q3. 1曲の中でジャンルが変わるとはどういう意味ですか?
A. オペラとヘビーメタルのように、全く異なるジャンルを1曲の中で行き来できるという発表です。
その際も音楽的な一貫性は維持されるとのことです。
個別に作成したセクションをつなぎ合わせるスプライシング作業が不要になるという意味です。
実際に途切れや不自然な跳ねがないか、私たちも直接聴いて確認する予定です。
Q4. 日本語の歌詞も自然になりましたか?
A. 発表には、様々な言語において歌詞やボーカル、編曲がより安定して動作するようになったと記載されています。
v1 までは日本語の歌詞において発音が不自然だったり、英語のような抑揚になるケースがありました。
v2 で実際に改善されているかどうかは、日本語の歌詞で直接テストして共有します。
Q5. どこで利用でき、料金はいくらですか?
A. ElevenMusic ですぐに利用可能です。
Free プランの無料クレジットでもテストできます。
Creator プラン(月額 $22、割引時 $11)であれば
PVC・Dubbing・Music v2・Studio・Agents をまとめて利用できます。
Q6. この記事の内容は検証済みですか?
A. いいえ、検証済みではありません。
この記事は公式発表をまとめたものであり、実際の使用結果ではありません。
同じ歌詞と構成で3種類のジャンルプロンプトを使用し
v1 と v2 を並べてバウンス比較する検証を準備しています。
結果は次回の記事で公開します。