Kunstig Intelligens

Musikkbransjens «Napster-øyeblikk»: Gigantiske datasett for AI-trening avslørt

Journalisten Alex Reisner fra The Atlantic har avdekket fire enorme datasett med musikk som i hemmelighet har blitt brukt til å trene opp kunstig intelligens, og han har gjort hele registeret søkbart for offentligheten. To av disse datasettene er svimlende store og inneholder henholdsvis 12 og 9 millioner låter. Tidligere har AI-utviklere holdt kortene ekstremt tett til brystet når det gjelder hva modellene deres faktisk mates med. Nå er lokket i ferd med å sprenges av. Les hele saken hos The Verge.

Tenk deg at du har brukt år på å utvikle unikt innhold eller åndsverk, bare for å finne ut at en teknologigigant har støvsugd alt sammen for å trene sin egen kommersielle konkurrent – helt uten å spørre. Frem til nå har AI-trening i stor grad vært en lukket «svart boks». Med denne nye søkbare databasen får rettighetshavere for første gang håndfaste, søkbare bevis på at verkene deres er brukt. Dette vil utvilsomt utløse en ny bølge av søksmål og rettslige oppgjør globalt.

For mediehus, innholdsprodusenter og juridiske avdelinger markerer dette slutten på «tilgivelse fremfor tillatelse»-æraen innen AI-trening. Det å bygge AI-modeller på uautorisert data blir en strategi med ekstremt høy risiko fremover. Selskaper som går til anskaffelse av kommersielle AI-verktøy må nå kreve fullstendig transparente leverandørkjeder og lisenser for dataene som er brukt, ellers risikerer de å sitte på en tidsinnstilt juridisk bombe av opphavsrettsbrudd. For investorer betyr dette at AI-selskaper med "rene" og fullt lisensierte treningsdata vil skyte i verdi.

Internasjonale Trender

Er merkevaren din «i vektene»? AI-alderens nye søkemotoroptimalisering

Hvor mye av ditt selskap eller ditt personlige arbeid har egentlig blitt en del av hjernen til de ledende AI-modellene? Det er spørsmålet bak den nye tjenesten «In the Weights», som beskrives som en moderne, AI-sentrisk form for «egogoogling». Verktøyet lar brukere og merkevarer sjekke i hvor stor grad deres navn og innhold ligger lagret i treningsdataene – de såkalte vektene – til kjente AI-modeller. Les saken hos TechCrunch.

I internettets barndom googlet vi oss selv for å se hvilke nettsider som nevnte oss. I dag handler det ikke lenger bare om å dukke opp i et tradisjonelt søkeresultat, men om å være en integrert del av den statistiske forståelsen til AI-modellene. Når en kunde ber en AI-assistent om å anbefale de beste løsningene innen din bransje, henter ikke assistenten bare en lenke; den genererer et svar basert på alt den har lært under treningen.

For markedsavdelinger og omdømmeansvarlige tvinger dette frem et fundamentalt skifte i strategi. Det holder ikke lenger å optimalisere nettsider for Google (tradisjonell SEO). Man må nå forstå hvordan man påvirker AI-modellenes treningsgrunnlag – en disiplin som kalles GEO (Generative Engine Optimization). Hvis virksomheten din er helt fraværende «i vektene», vil dere i praksis være usynlige for fremtidens AI-drevne innkjøpsagenter. Dette verktøyet gir merkevarebyggere det første konkrete måleinstrumentet for å forstå denne nye virkeligheten.

Andre Nyheter