Zeldzame boeken vernietigd voor AI-training
In de recente discussie over de impact van artificiële intelligentie (AI) op bibliotheken en archieven, is er een zorgwekkende trend zichtbaar: antiquaren en digitaliseringsbedrijven halen steeds vaker zeldzame boeken uit elkaar om deze snel te scannen voor trainingsdoeleinden. Deze praktijk komt vooral voor in de Verenigde Staten en het Verenigd Koninkrijk, maar heeft ook gevolgen voor de Europese markt. De groeiende vraag naar tekst voor generatieve AI-systemen zoals ChatGPT, Llama en Claude zorgt voor een toename in destructief scannen, wat indruist tegen erfgoedzorg en auteursrechten.
Bij destructief scannen worden boeken vaak onherstelbaar beschadigd; de rug wordt losgesneden en pagina's gaan door een snelscanner. Handelaren richten zich op schaarse of uitverkochte titels, omdat deze veel unieke tekst bevatten die aantrekkelijk is voor AI-training. Dit leidt tot extra druk op de al beperkte markt voor erfgoedboeken. Terwijl sommige bibliotheken en musea pleiten voor het behoud van fysieke collecties, kiezen commerciële partijen vaak voor snellere, destructieve methoden. Er zijn alternatieven, zoals boekwieg-scanners die het fysieke boek sparen, maar deze zijn duurder en tijdrovender.
De behoefte aan grote hoeveelheden tekst voor training van grote taalmodellen, zoals GPT-4 en Gemini, zorgt ervoor dat boeken steeds aantrekkelijker worden als bronnen. Echter, dit brengt juridische en ethische kwesties met zich mee, vooral wanneer het gaat om datasets die zowel legale als onduidelijke rechten bevatten. De Europese wetgeving, waaronder de AI Act, verplicht aanbieders van generatieve AI-systemen tot transparantie over hun trainingsdata, wat extra druk zet op ziekenhuizen, instellingen en overheden die AI inkopen.
Om de negatieve effecten op de erfgoedzorg tegen te gaan, willen Nederlandse instellingen scherpere contracten met AI-leveranciers. Ze moeten garanties krijgen over licenties en de oorsprong van de gebruikte gegevens. Niet-destructieve scanning, het invoeren van legale licentiemodellen, en het verminderen van het aantal boeken in trainingssets zijn een aantal aanbevolen methoden om de druk op schaarse collecties te verlichten. De bestaande EU-regels geven bibliotheken en uitgevers een kans om meer controle te krijgen over hun content, met als doel om innovatie te combineren met respect voor recht en erfgoed.
Lees het volledige artikel van AI Insider.
Gerelateerde artikelen
SpaceX als nieuwe mobiele provider in de VS
SpaceX, het ruimtevaartbedrijf opgericht door Elon Musk, maakt een belangrijke sprongetje in de telecommunicatiemarkt. Volgens recente berichten heeft het bedrijf een miljardendeal gesloten om frequen...
Tech Festival
09 oktober 2026
OM stopt onderzoek naar thuisbatterijverkopers
Het Openbaar Ministerie (OM) heeft besloten om geen strafrechtelijk onderzoek in te stellen naar mogelijke oplichting met thuisbatterijen. Dit besluit komt naar voren ondanks dat er meer dan duizend s...
Tech Festival
09 oktober 2026
Google verandert 'Zoeken' in 'Vragen stellen' binnen de app
Google, de zoekmachine die lange tijd synoniem was met online zoeken, heeft een belangrijke verschuiving doorgemaakt in haar aanpak. De nadruk ligt nu op het stellen van vragen aan geavanceerde kunstm...
Tech Festival
09 oktober 2026