"Od opery po heavy metal – naturalne przejścia między gatunkami w jednym utworze."
ElevenLabs ogłasza premierę nowej generacji modelu muzycznego: Music v2.
Witajcie w Sonetho! ⚡
27 maja 2026 r. firma ElevenLabs oficjalnie zaprezentowała swój najnowszy model muzyczny – Music v2. To przełomowa aktualizacja, wydana zaledwie cztery miesiące po debiucie Music v1. Według oficjalnych zapewnień jest to "wielki krok naprzód pod względem jakości, możliwości kontroli oraz kreatywności".
Dziś podsumowujemy najważniejsze ulepszenia wprowadzone w wersji v2 oraz przedstawiamy plan testów, które przeprowadzimy w naszym zespole. Wyniki naszych eksperymentów wraz z pakietem utworów demonstracyjnych udostępnimy w kolejnym artykule.
🎯 4 filary nowej generacji v2 (według oficjalnej specyfikacji)
1. Wysoki poziom sterowalności (Highly Steerable Generation)
Oficjalny komunikat: "Model został zaprojektowany tak, by precyzyjnie reagować na szczegółowe polecenia kreatywne, takie jak szybki rap, skomplikowane frazowanie wokalne czy nagłe zmiany stylu, artykulacji i instrumentarium."
→ Nasz punkt obserwacji: W v1 szczegółowe prompty często kończyły się efektem "podobnym w klimacie". W v2 sprawdzimy, czy model faktycznie realizuje nasze instrukcje z zegarmistrzowską precyzją.
2. Ulepszona jakość dźwięku (Improved Sound by Default)
Oficjalny komunikat: "Poprawiono jakość wokali, aranżacji instrumentów oraz dynamikę wykonania. Rezultaty prosto z modelu brzmią bardziej profesjonalnie (polished), ekspresyjnie i angażująco."
→ Nasz punkt obserwacji: Sprawdzimy, czy bez konieczności dopracowywania promptów, domyślna jakość v2 przewyższa v1 w bezpośrednim teście porównawczym.
3. Przejścia między gatunkami (Genre Transitions)
Oficjalny komunikat: "Model potrafi płynnie łączyć zupełnie różne gatunki w obrębie jednego utworu, np. operę z heavy metalem, utrzymując pełną spójność muzyczną. Bez potrzeby ręcznego cięcia (splicing)."
→ Nasz punkt obserwacji: Jeśli to prawda, workflow tworzenia muzyki w tle (BGM) zmieni się radykalnie. Przetestujemy, czy te przejścia są rzeczywiście naturalne i pozbawione artefaktów czy nagłych "skoków".
4. Generowanie wielojęzyczne (Multilingual Generation)
Oficjalny komunikat: "Zwiększono możliwości generowania muzyki w wielu językach, dzięki czemu teksty, wokale i aranżacje działają znacznie stabilniej w językach ojczystych."
→ Nasz punkt obserwacji: To kluczowe dla twórców operujących na różnych rynkach. Przetestujemy, czy v2 wyeliminowało problemy z obcym akcentem w języku polskim, które zdarzały się w poprzedniej wersji.
💡 Dla kogo ta aktualizacja jest najważniejsza?
Oto nasze przypuszczenia (które zweryfikujemy w testach):
Kompozytorzy tworzący dema w stylu Pop/Modern Charts — jeśli narzekaliście na brzmienie wokalu w wersji v1, wyniki testów v2 są właśnie dla Was.
Twórcy muzyki do YouTube Shorts/Reels — jeśli obietnica płynnego łączenia gatunków w jednym tracku się sprawdzi, produkcja 30-sekundowych, angażujących podkładów stanie się błyskawiczna.
Użytkownicy szukający alternatywy dla Suno/Udio — z planem Creator (22 USD miesięcznie) zyskujecie dostęp do pełnego ekosystemu: PVC, dubbingu, Music v2, Studio oraz agentów w jednym miejscu.
🎵 Wypróbuj już teraz (Pierwsze wrażenia)
Model Music v2 jest już dostępny bezpośrednio w aplikacji ElevenMusic. Możecie go przetestować, korzystając ze swoich kredytów.
🔬 Zapowiedź: Wielkie porównanie v1 vs v2
Nie bierzemy obietnic na słowo. W naszym zespole przygotowaliśmy ten sam tekst + ta sama struktura + 3 różne style muzyczne, aby porównać oba modele jeden do jednego.
Wspólny tekst w języku angielskim — testujemy realizację znaczników struktury (
[Intro],[Verse],[Chorus],[Outro]).3 gatunki — Synthwave (separacja wokalu), Modern Alt Rock (separacja instrumentów), R&B/Neo-Soul (detale wokalne).
6 utworów — bezpośrednie zestawienie v1 i v2 w identycznych warunkach.
Kluczowe kryteria oceny — złożoność wokalu, separacja instrumentów oraz rozpoznawalność struktury utworu.
W następnym wpisie udostępnimy cały pakiet testowy, abyście sami mogli usłyszeć różnicę. 🔔
📚 Warto przeczytać
Suno vs Udio vs ElevenMusic: 3 lata doświadczeń (7 wydanych singli)
Zarabianie na muzyce AI: poradnik 5 kroków (Suno → Distrokid)
Ile zarobiłem na 4 utworach AI w ElevenLabs Music Marketplace?
Dlaczego nie warto subskrybować ElevenMusic – jeszcze nie teraz
❓ FAQ: Najczęściej zadawane pytania
Q1. Kiedy pojawił się Music v2?
A. Oficjalna premiera miała miejsce 27 maja 2026 roku.
To pierwsza duża aktualizacja około 4 miesiące po wydaniu ElevenMusic v1.
Q2. Co według zapowiedzi zmieniło się w porównaniu do v1?
A. Zgodnie z oficjalnym komunikatem wprowadzono cztery główne zmiany:
① Zwiększona kontrola, pozwalająca na stabilne reagowanie na szczegółowe wytyczne twórcze
② Poprawa jakości dźwięku bazowego bez potrzeby dopracowywania promptów
③ Zmiana gatunku muzycznego w obrębie jednego utworu
④ Stabilniejsza generacja wielojęzyczna
Q3. Co oznacza możliwość zmiany gatunku w ramach jednego utworu?
A. Zapowiedziano, że utwór może łączyć zupełnie różne style, takie jak opera i heavy metal.
Producent zapewnia przy tym zachowanie spójności muzycznej.
Oznacza to, że nie ma potrzeby ręcznego łączenia sekcji, czyli tzw. splicingu.
Zamierzamy osobiście sprawdzić, czy rzeczywiście nie występują żadne przerwy ani zakłócenia dźwięku.
Q4. Czy teksty w języku koreańskim brzmią teraz naturalniej?
A. W oficjalnym komunikacie wspomniano, że generowanie tekstów, wokalu i aranżacji działa stabilniej w wielu językach.
Do wersji v1 zdarzało się, że koreańska wymowa była nienaturalna lub brzmiała z angielskim akcentem.
Przetestujemy to osobiście na koreańskich tekstach i podzielimy się wynikami, aby sprawdzić realne poprawki w v2.
Q5. Gdzie mogę to przetestować i ile to kosztuje?
A. Usługa jest dostępna bezpośrednio w ElevenMusic.
Można ją przetestować w ramach darmowych kredytów w planie Free.
Wybierając plan Creator (22 $ miesięcznie, 11 $ po zniżce)
uzyskujesz dostęp do PVC, Dubbing, Music v2, Studio oraz Agents jednocześnie.
Q6. Czy zawarte tu informacje zostały zweryfikowane?
A. Nie.
Ten tekst jest jedynie podsumowaniem oficjalnego ogłoszenia, a nie wynikami z rzeczywistego użytkowania.
Przygotowaliśmy test porównawczy, używając tego samego tekstu i struktury z trzema różnymi promptami gatunkowymi.
Porównamy brzmienie v1 oraz v2 zestawione obok siebie.
Wyniki opublikujemy w następnym wpisie.
Owocnej twórczości!
Sonetho ⚡