Buod
- Isang imbestigasyon ng The Atlantic ang nagbunyag ng apat na searchable na dataset na naglalaman ng mahigit 21 milyong track na ginamit sa pag-train ng mga generative AI music model.
- Ipinapakita ng mga rekord na walang pahintulot na kinayod ng mga developer mula sa internet ang mga obra ng malalaking artist tulad nina Taylor Swift at Bad Bunny, nang walang kahit anong bayad.
- Nagsisilbi ang mga natuklasan bilang mahalagang ebidensya para sa malalaking label na kasalukuyang nagsasampa ng kaso laban sa mga plataporma tulad ng Suno dahil sa malawakang paglabag sa copyright.
Isang imbestigasyon mula sa The Atlanticang naglantad sa matinding lawak ng data scraping na nagpapakarga sa mga generative AI music platform. Pinangunahan ng staff writer na si Alex Reisner, inilalatag ng ulat ang pagkakatuklas ng apat na dataset na humigit-kumulang 21.2 milyong track na ginamit sa pag-train ng mga model. Ang pinakamalaking archive ay may 12 milyong kanta, habang ang isa pa ay may 9 milyon. Sa pamamagitan ng mga rekord na ito, nagkakaroon ang mga may hawak ng karapatan ng paraan para beripikahin kung isinama ng mga developer ang kanilang mga obra upang bumuo ng mga serbisyong kayang manggaya ng human performances. Kinukumpirma ng mga searchable database na kabilang dito ang mga track mula sa mga kilalang artist tulad nina Taylor Swift, Bad Bunny, Billie Eilish at Nirvana.
Dumating ang pagbubunyag na ito sa isang kritikal na sandali para sa music industry habang nakikipaglaban ito sa walang-pahintulot na AI-generated na content. Madalas umasa ang mga generative AI company sa depensang fair use at iginiit na hindi sinasaktan ang orihinal na merkado ang pag-train ng mga model gamit ang umiiral na media. Pinahihina ng mga bagong nalantad na dataset ang posisyong ito sa pamamagitan ng eksaktong pagpapakita ng mga materyal na may copyright na kailangan para makapaglabas ng mga clone na komersiyal na mapagkakakitaan. Nahihirapan na ang mga streaming service tulad ng Spotify at Deezer na pamahalaan ang dagsa ng artipisyal na audio, kung saan iniulat ng Deezer na halos kalahati ng kanilang araw-araw na upload ay AI-generated na.
Direktang naaapektuhan ng mga kongkretong natuklasan na ito ang mga high-profile na legal na aksyon laban sa mga tech company. Ang Universal Music Group at Sony Music Entertainment ay kasalukuyang sangkot sa isang malakihang demanda sa paglabag sa copyright laban sa AI platform na Suno. Kamakailan ay hiniling ng mga label sa isang federal court na idagdag ang mahigit 61,000 sound recording sa kanilang kaso matapos matukoy ang kanilang mga pag-aari sa loob ng training data. Inamin na noon ng Suno na ipinakita nito sa programa ang dose-dosenang milyong ulit ng iba’t ibang recording upang mabuo ang kanilang serbisyo.
Ang mga korte ngayon ang nakatokang magpasya kung ang ganitong kalaking pagkuha ng data ay maituturing na transformative use o hayagang pandarambong sa karapatang-ari. Ang mga naunang legal na labanan sa tech sector, gaya ng kasongBartz v. Anthropic tungkol sa copyright, ay nagpapakita ng nagpapatuloy na tensyon sa pagitan ng mga creator at mga AI developer. Ang detalyadong ebidensyang binuo ng The Atlantic ay nagbibigay sa mga musikero ng konkretong sulyap sa mekanismo sa likod ng mga tool na lumilikha ng mga track na ginagaya ang kanilang pirma at tunog. Ang ganitong antas ng transparency ay nag-aalis sa tabing ng sekresyong karaniwang pinangangalagaan ng mga AI company at nagtatakda ng bagong pamantayan ng pananagutan sa digital na mundo ng musika.



