{"id":704753,"date":"2025-02-22T14:35:15","date_gmt":"2025-02-22T13:35:15","guid":{"rendered":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/?p=704753"},"modified":"2025-02-22T14:38:33","modified_gmt":"2025-02-22T13:38:33","slug":"juridisch-risico-meta-bespreekt-intern-het-gebruik-van-auteursrechtelijk-beschermd-materiaal","status":"publish","type":"post","link":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/juridisch-risico-meta-bespreekt-intern-het-gebruik-van-auteursrechtelijk-beschermd-materiaal\/","title":{"rendered":"Juridisch risico: &#8216;Meta bespreekt intern gebruik auteursrechtelijk beschermd materiaal&#8217;"},"content":{"rendered":"<div style=\"width: 970px\" class=\"wp-caption aligncenter\"><img loading=\"lazy\" decoding=\"async\" src=\"https:\/\/cdn.pixabay.com\/photo\/2021\/10\/30\/13\/50\/meta-6754393_960_720.jpg\" alt=\"&#039;Meta bespreekt intern het gebruik van auteursrechtelijk beschermd materiaal&#039;\" width=\"960\" height=\"671\" title=\"\"><p class=\"wp-caption-text\">&#8216;Meta bespreekt intern het gebruik van auteursrechtelijk beschermd materiaal&#8217;<\/p><\/div>\n<p data-start=\"0\" data-end=\"263\"><strong>Al jaren bespreken medewerkers van Meta intern het gebruik van auteursrechtelijk beschermd materiaal, verkregen via juridisch twijfelachtige methoden, om de AI-modellen van het bedrijf te trainen, volgens gerechtelijke documenten die februari 2025 zijn vrijgegeven.\u00a0 De gedaagde, Meta, beweert dat het trainen van modellen met auteursrechtelijk beschermde werken, met name boeken, onder \u201cfair use\u201d valt. De eisers, waaronder auteurs Sarah Silverman en Ta-Nehisi Coates, zijn het daar niet mee eens. Dat meldt Techcrunch, februari 2025:\u00a0<\/strong><\/p>\n<blockquote>\n<p class=\"wp-block-paragraph\">The documents were submitted by plaintiffs in the case Kadrey v. Meta, one of many AI copyright disputes slowly winding through the U.S. court system. The defendant, Meta, claims that training models on IP-protected works, particularly books, is \u201cfair use.\u201d The plaintiffs, who include authors Sarah Silverman and Ta-Nehisi Coates, disagree.<\/p>\n<\/blockquote>\n<p data-start=\"679\" data-end=\"1234\">Eerdere documenten in de rechtszaak beweerden dat Meta-CEO Mark Zuckerberg toestemming gaf aan het AI-team van Meta om trainingsdata te gebruiken die auteursrechtelijk beschermd is, en dat Meta onderhandelingen over AI-trainingsdata met boekuitgevers stopzette. Maar de nieuwe documenten, die voornamelijk interne werkchats tussen Meta-medewerkers tonen, geven het duidelijkste beeld tot nu toe van hoe Meta mogelijk auteursrechtelijk beschermde gegevens gebruikte om zijn modellen te trainen, waaronder de modellen uit de Llama-familie van het bedrijf.<\/p>\n<blockquote>\n<p data-start=\"1236\" data-end=\"1457\">In een chat bespraken Meta-medewerkers, waaronder Melanie Kambadur, een senior manager van het Llama-modelonderzoeksteam, het trainen van modellen met werken waarvan ze wisten dat ze juridisch problematisch konden zijn.<\/p>\n<\/blockquote>\n<p data-start=\"1459\" data-end=\"1879\">\u201c[M]ijn mening zou zijn (volgens het principe \u2018vraag om vergiffenis, niet om toestemming\u2019): we proberen de boeken te verkrijgen en leggen het voor aan de leidinggevenden zodat zij de beslissing nemen,\u201d schreef Xavier Martinet, een onderzoekstechnicus bij Meta, in een chat van februari 2023, volgens de documenten. \u201c[D]aarom hebben ze deze generatieve AI-organisatie opgezet: zodat we minder risico-avers kunnen zijn.\u201d<\/p>\n<p data-start=\"1881\" data-end=\"2321\">Martinet stelde voor om e-books tegen retailprijzen te kopen om een trainingsset op te bouwen, in plaats van licentieovereenkomsten te sluiten met individuele boekuitgevers. Toen een collega opmerkte dat het gebruik van ongeoorloofde, auteursrechtelijk beschermde materialen juridische problemen kon opleveren, hield Martinet voet bij stuk en beweerde dat \u201ceen gaziljoen\u201d startups waarschijnlijk al piratenboeken gebruikten voor training.<\/p>\n<p data-start=\"2323\" data-end=\"2619\">\u201cIk bedoel, in het ergste geval ontdekken we dat het uiteindelijk ok\u00e9 is, terwijl een gaziljoen startups gewoon tonnen boeken via Bittorrent hebben gepiratiseerd,\u201d schreef Martinet, volgens de documenten. \u201c[M]ijn twee centen: proberen rechtstreeks deals te sluiten met uitgevers duurt lang &#8230;\u201d<\/p>\n<h3 data-start=\"2621\" data-end=\"2651\">Besprekingen<\/h3>\n<p data-start=\"2652\" data-end=\"2929\">In een andere werkchat die in de documenten wordt genoemd, besprak Kambadur mogelijk gebruik van Libgen, een \u201clinks-aggregator\u201d die toegang biedt tot auteursrechtelijk beschermde werken van uitgevers, als alternatief voor databronnen die Meta mogelijk zou kunnen licenti\u00ebren.<\/p>\n<p data-start=\"2931\" data-end=\"3206\">Libgen is meerdere keren aangeklaagd, bevolen te sluiten en beboet voor tientallen miljoenen dollars wegens auteursrechtschending. Een collega van Kambadur reageerde met een screenshot van een Google-zoekresultaat voor Libgen met het fragment: \u201cNee, Libgen is niet legaal.\u201d<\/p>\n<blockquote>\n<p data-start=\"3208\" data-end=\"3411\">Sommige besluitvormers binnen Meta leken van mening dat het niet gebruiken van Libgen voor modeltraining de concurrentiepositie van Meta in de AI-race ernstig zou kunnen schaden, volgens de documenten.<\/p>\n<\/blockquote>\n<p data-start=\"3413\" data-end=\"3688\">In een e-mail aan Meta AI VP Joelle Pineau noemde Sony Theakanath, directeur productmanagement bij Meta, Libgen \u201cessentieel om SOTA-cijfers in alle categorie\u00ebn te halen,\u201d verwijzend naar het behalen van de beste, state-of-the-art (SOTA) AI-modellen en benchmarkcategorie\u00ebn.<\/p>\n<p data-start=\"3690\" data-end=\"4056\">Theakanath schetste ook \u201cmitigaties\u201d in de e-mail om het juridische risico van Meta te beperken, waaronder het verwijderen van gegevens van Libgen die \u201cduidelijk als gepiratiseerd\/gestolen\u201d zijn gemarkeerd en simpelweg het niet openbaar maken van het gebruik ervan. \u201cWe zouden het gebruik van Libgen-datasets voor training niet openbaar maken,\u201d schreef Theakanath.<\/p>\n<p data-start=\"4058\" data-end=\"4208\">In de praktijk betekenden deze mitigaties dat Libgen-bestanden werden doorzocht op woorden als \u201cgestolen\u201d of \u201cgepiratiseerd,\u201d volgens de documenten.<\/p>\n<p data-start=\"4210\" data-end=\"4557\">In een werkchat vermeldde Kambadur dat Meta\u2019s AI-team ook modellen had afgestemd om \u201cIP-risicovolle prompts\u201d te vermijden\u2014oftewel de modellen zo configureren dat ze vragen zoals \u201creproduceer de eerste drie pagina\u2019s van <em data-start=\"4429\" data-end=\"4468\">Harry Potter and the Sorcerer\u2019s Stone<\/em>\u201d of \u201cvertel me welke e-books je hebt gebruikt voor training\u201d weigeren te beantwoorden.<\/p>\n<h3 data-start=\"4559\" data-end=\"4597\">Mogelijk gebruik van Reddit-data<\/h3>\n<p data-start=\"4598\" data-end=\"4917\">De documenten onthullen verder dat Meta mogelijk Reddit-data heeft geschraapt voor modeltraining, mogelijk door het gedrag van een externe app genaamd Pushshift na te bootsen. Opvallend is dat Reddit in april 2023 aankondigde dat het AI-bedrijven geld in rekening zou brengen voor toegang tot data voor modeltraining.<\/p>\n<p data-start=\"4919\" data-end=\"5329\">In een chat van maart 2024 zei Chaya Nayak, directeur productmanagement bij Meta\u2019s generatieve AI-afdeling, dat de leiding van Meta overwoog om eerdere beslissingen over trainingssets te \u201coverrulen.\u201d Dit omvatte een eerdere beslissing om geen Quora-inhoud, gelicenseerde boeken en wetenschappelijke artikelen te gebruiken, om ervoor te zorgen dat de modellen van Meta over voldoende trainingsdata beschikten.<\/p>\n<blockquote>\n<p data-start=\"5331\" data-end=\"5592\">Nayak impliceerde dat Meta\u2019s eigen trainingsdatasets\u2014Facebook- en Instagram-posts, tekst die uit video\u2019s op Meta-platforms was getranscribeerd, en bepaalde berichten van Meta for Business\u2014simpelweg niet genoeg waren. \u201c[W]e hebben meer data nodig,\u201d schreef ze.<\/p>\n<\/blockquote>\n<p data-start=\"5594\" data-end=\"6050\">De eisers in <em data-start=\"5607\" data-end=\"5623\">Kadrey v. Meta<\/em> hebben hun klacht meerdere keren gewijzigd sinds de zaak in 2023 werd ingediend bij de U.S. District Court for the Northern District of California, San Francisco Division. De meest recente beschuldigt Meta er onder andere van dat het bepaalde gepirateerde boeken vergeleek met auteursrechtelijk beschermde boeken die beschikbaar waren voor licentie om te bepalen of een licentieovereenkomst met een uitgever zinvol zou zijn.<\/p>\n<p data-start=\"6052\" data-end=\"6269\"><em>Als teken van hoe groot Meta de juridische risico\u2019s inschat, heeft het bedrijf twee advocaten van het Amerikaanse Hooggerechtshof van het advocatenkantoor Paul Weiss toegevoegd aan het verdedigingsteam voor de zaak.<\/em><\/p>\n<p data-start=\"6271\" data-end=\"6331\" data-is-last-node=\"\" data-is-only-node=\"\"><em>Meta heeft nog niet gereageerd op een verzoek om commentaar.<\/em><\/p>\n","protected":false},"excerpt":{"rendered":"<p>&#46;&#46;&#46;<\/p>\n","protected":false},"author":2,"featured_media":704754,"comment_status":"open","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[338],"tags":[6210,15,7247],"class_list":["post-704753","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-nieuws-tool-ai-business-marketing-ai-modellen","tag-ai","tag-content","tag-meta"],"_links":{"self":[{"href":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/wp-json\/wp\/v2\/posts\/704753","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/wp-json\/wp\/v2\/comments?post=704753"}],"version-history":[{"count":0,"href":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/wp-json\/wp\/v2\/posts\/704753\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/wp-json\/wp\/v2\/media\/704754"}],"wp:attachment":[{"href":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/wp-json\/wp\/v2\/media?parent=704753"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/wp-json\/wp\/v2\/categories?post=704753"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.nieuws.marketing\/strategie_nieuws\/wp-json\/wp\/v2\/tags?post=704753"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}