Når musik, bøger, film, tv, billeder, kunst og alt muligt andet stopfodres ind i den evigt energi- og informationssultne kunstige intelligens, sker det som regel uden at spørge om lov, i en eller anden afsides serverhal bag digital og fysisk pigtråd. Tyveriet er så stort og abstrakt udført, at man ikke kan få hovedet omkring det.
Jeg har gennemgået et lille hjørne af de enorme datasæt, AI-modeller trænes på, og de er ikke overraskende fyldt med dansk indhold. I skrivende stund er tallet 52.029 danske værker, musik og bøger, og det tal vil vokse, efterhånden som jeg når igennem flere datasæt.
Det er folk som Kim Larsen, Shu-Bi-Dua, Anne Linnet, Volbeat, MØ og Lukas Graham. Og Tove Ditlevsen, Peter Høeg, Helle Helle, Jussi Adler-Olsen, Klaus Rifbjerg og Carsten Jensen. Men det er i lige så høj grad en helvedes masse helt små artister og kunstnere. Ingen af dem er blevet spurgt, og ingen har fået en dollar eller yen for det.
Jeg bliver ved et stykke tid endnu og prøver at gøre det så konkret som muligt, hvad der er taget fra danske rettighedshavere. Hvis de da reelt stadig har nogen rettigheder i den her fagre nye verden.
Du må meget gerne hjælpe. Støder du på et træningsdatasæt, der ligger åbent tilgængeligt, og som kan sandsynliggøres eller påvises anvendt til AI-træning, så send mig et tip, så kigger jeg på det. For alle de nuværende og aspirerende ultrarige idioter, der stjæler fra vores fantastiske kunstnere, fortjener som minimum en kæmpe fuckfinger og et skam jer. Og forhåbentlig også at blive stillet til ansvar for deres tyverier.
På siden kan du søge på kunstnernavne, både artister, forfattere, domæner og på selskaber og forlag, og se hvad der er havnet i træningsdataene.
Se og søg selv her: thormartinbaerug.com/ai-traeningsdata