Exposanten login
AI Insider 25 augustus 2026

Zeldzame boeken vernietigd voor AI-training

Zeldzame boeken vernietigd voor AI-training

In de recente discussie over de impact van artificiële intelligentie (AI) op bibliotheken en archieven, is er een zorgwekkende trend zichtbaar: antiquaren en digitaliseringsbedrijven halen steeds vaker zeldzame boeken uit elkaar om deze snel te scannen voor trainingsdoeleinden. Deze praktijk komt vooral voor in de Verenigde Staten en het Verenigd Koninkrijk, maar heeft ook gevolgen voor de Europese markt. De groeiende vraag naar tekst voor generatieve AI-systemen zoals ChatGPT, Llama en Claude zorgt voor een toename in destructief scannen, wat indruist tegen erfgoedzorg en auteursrechten.

Bij destructief scannen worden boeken vaak onherstelbaar beschadigd; de rug wordt losgesneden en pagina's gaan door een snelscanner. Handelaren richten zich op schaarse of uitverkochte titels, omdat deze veel unieke tekst bevatten die aantrekkelijk is voor AI-training. Dit leidt tot extra druk op de al beperkte markt voor erfgoedboeken. Terwijl sommige bibliotheken en musea pleiten voor het behoud van fysieke collecties, kiezen commerciële partijen vaak voor snellere, destructieve methoden. Er zijn alternatieven, zoals boekwieg-scanners die het fysieke boek sparen, maar deze zijn duurder en tijdrovender.

De behoefte aan grote hoeveelheden tekst voor training van grote taalmodellen, zoals GPT-4 en Gemini, zorgt ervoor dat boeken steeds aantrekkelijker worden als bronnen. Echter, dit brengt juridische en ethische kwesties met zich mee, vooral wanneer het gaat om datasets die zowel legale als onduidelijke rechten bevatten. De Europese wetgeving, waaronder de AI Act, verplicht aanbieders van generatieve AI-systemen tot transparantie over hun trainingsdata, wat extra druk zet op ziekenhuizen, instellingen en overheden die AI inkopen.

Om de negatieve effecten op de erfgoedzorg tegen te gaan, willen Nederlandse instellingen scherpere contracten met AI-leveranciers. Ze moeten garanties krijgen over licenties en de oorsprong van de gebruikte gegevens. Niet-destructieve scanning, het invoeren van legale licentiemodellen, en het verminderen van het aantal boeken in trainingssets zijn een aantal aanbevolen methoden om de druk op schaarse collecties te verlichten. De bestaande EU-regels geven bibliotheken en uitgevers een kans om meer controle te krijgen over hun content, met als doel om innovatie te combineren met respect voor recht en erfgoed.

Lees het volledige artikel van AI Insider.