Elevenlabs uruchomiło model Music v2.5 z darmowym i płatnym planem, oferujący pełniejsze brzmienie i licencjonowane dane treningowe.

Źródło zdjęcia: The Decoder
Elevenlabs udostępnia nowy model generowania muzyki, Music v2.5, dostępny za darmo i w wersji płatnej. Firma zapewnia, że wygenerowane utwory brzmią „pełniej i naturalniej” niż wcześniej, a użytkownicy zachowują prawa do swoich nagrań. Szczegóły opisuje the-decoder.com.
Elevenlabs deklaruje, że najnowsza wersja modelu generuje muzykę brzmiącą pełniej i bardziej naturalnie niż poprzednia. Kluczowym dowodem na to jest wewnętrzny test porównawczy przeprowadzony na bardzo dużej próbie – niemal 48 tysiącach par porównawczych. Wyniki wskazują, że słuchacze preferowali v2.5 w większości przypadków, przy czym przewaga była szczególnie wyraźna w gatunkach opierających się na bogatej instrumentacji i dynamice wokalnej: R&B, soul, hip-hop, rock oraz muzyka orkiestrowa.
Model jest dostępny dwutorowo – jako część aplikacji ElevenMusic oraz przez API, co pozwala programistom integrować generowanie muzyki bezpośrednio w swoich produktach. Starsza wersja v2 nie zostaje wycofana i pozostaje dostępna równolegle, co daje użytkownikom możliwość wyboru między modelami w zależności od potrzeb.
Elevenlabs zachowuje ostrożne podejście do praw autorskich. Użytkownicy zatrzymują prawa do wygenerowanych przez siebie utworów, a komercyjne wykorzystanie jest dopuszczalne, choć jego zakres zależy od branży i konkretnego zastosowania. Warunkiem korzystania z darmowego planu jest jednak podanie atrybucji – czyli oznaczenie, że utwór powstał z pomocą AI.
Firma wprowadziła też konkretne zabezpieczenia przed nadużyciami: pobieranie utworów, które powstały na bazie piosenek innych artystów, jest blokowane, a system nie pozwala na tworzenie muzyki imitującej stylistykę konkretnych, istniejących muzyków. To rozwiązanie ma chronić zarówno twórców, jak i samą Elevenlabs przed potencjalnymi roszczeniami.
Elevenlabs niedawno podpisało umowę licencyjną z Universal Music Group, jednak – jak zaznacza firma – porozumienie to dotyczy wyłącznie przyszłych, osobnych produktów, a nie obecnego modelu Music v2.5. Firma twierdzi, że istniejące modele muzyczne trenowała na „licencjonowanych ścieżkach (stems) i muzyce”, bez podania dokładnych szczegółów dotyczących zbioru danych treningowych.
Mimo braku pełnej transparentności co do źródeł danych, deklaracja o licencjonowanych materiałach odróżnia Elevenlabs od konkurenta – Suno, które zostało pozwane za trenowanie modeli na chronionych prawem autorskim treściach bez zgody właścicieli praw. Warto dodać, że Suno w tym samym tygodniu wypuściło własne nowe modele, co czyni obecny moment ważnym punktem zwrotnym w rywalizacji między firmami zajmującymi się generowaniem muzyki przy pomocy AI.
Premiera Music v2.5 pokazuje, że Elevenlabs stawia na jakość generowanego dźwięku oraz ostrożne, licencyjnie uzasadnione podejście do treningu modeli – co w obliczu trwających spraw sądowych wokół praw autorskich w branży AI może okazać się istotną przewagą konkurencyjną.
OpenAI wyjaśnia, jak dobrać model z rodziny GPT-6, pisać prompty i zoptymalizować koszty w produkcji dzięki cache'owaniu i kompakcji.

Meta open sourcowała kod do budowy własnych gadżetów z Muse oraz rozdaje 5000 egzemplarzy gotowego urządzenia Muse Home Link.

Sean Parker i Stability AI wiążą się z Sony, Warnerem i Universal, budując narzędzia AI do generowania muzyki z licencjonowanych katalogów.