Firma Stability AI ogłosiła premierę Stable Audio 3.0, czyli zestawu czterech nowych modeli sztucznej inteligencji przeznaczonych do generowania muzyki. Kluczową nowością jest fakt, że wszystkie modeły zostały wytrenowane wyłącznie na legalnie pozyskanych danych, a także potrafią tworzyć pełne ścieżki dźwiękowe o długości przekraczającej sześć minut.
W porównaniu do poprzedniej wersji 2.0, która w 2024 roku oferowała maksymalnie trzy minuty generowanego dźwięku, nowa odsłona stanowi znaczący skok jakościowy. Trzy z czterech modeli udostępniono jako „open-weight”, co oznacza, że można je bezpłatnie pobierać i modyfikować na własne potrzeby.
Według informacji podanych przez firmę, model 3.0 Small generuje do dwóch minut muzyki, podczas gdy jego poprzednicy – Stable Audio Open Small i Stable Audio Open – osiągały zaledwie 11 i 47 sekund. Modele 3.0 Medium i 3.0 Large potrafią tworzyć utwory trwające ponad sześć minut. Stability AI podkreśla, że 3.0 Small jest jedynym modelem zdolnym do pełnej kompozycji muzycznej bezpośrednio na urządzeniu, co otwiera możliwości offline’owego tworzenia całych utworów.
W opublikowanym równolegle dokumencie badawczym ujawniono, że nowe modele trenowano na połączeniu licencjonowanych nagrań z biblioteki AudioSparx (ponad 800 tysięcy plików) oraz nagrań na licencji Creative Commons z platformy Freesound. Firma podkreśla, że muzyka zawsze rozwijała się dzięki zbiorowej kreatywności społeczności – remiksy, interpolacje i mashupy to naturalne narzędzia artystów. Generative audio, zdaniem Stability AI, nie będzie inne i ma na celu wspieranie innowacji napędzanych przez społeczność, podobnie jak w przypadku modeli Stable Diffusion w dziedzinie obrazu.
Na mocy licencji społecznościowej (Community License) twórcy zachowują prawa do swoich utworów i mogą je swobodnie dystrybuować oraz komercjalizować. Firma zaznacza, że inne otwarte modele muzyczne często ograniczają użytek komercyjny lub niosą ryzyko związane z trenowaniem na nielegalnych danych. Organizacje o rocznych przychodach powyżej miliona dolarów będą zobowiązane do wykupienia licencji korporacyjnej, która obejmuje również ochronę prawną (indemnifikację).
Eksperci zwracają uwagę, że podejście Stability AI może stać się wzorem dla całej branży AI, gdzie problem nielegalnego wykorzystania utworów muzycznych do trenowania modeli budzi coraz większe kontrowersje. Przykładowo, w 2023 roku kilka wytwórni muzycznych pozwało twórców generatywnych narzędzi za naruszenie praw autorskich. Stable Audio 3.0, dzięki licencjonowanym danym, może uniknąć podobnych zarzutów i zdobyć zaufanie artystów oraz producentów.
Foto: digitalmusicnews.com
















Leave a Reply