Zeldzame boeken vernietigd voor AI-training
In de recente discussie over de impact van artificiële intelligentie (AI) op bibliotheken en archieven, is er een zorgwekkende trend zichtbaar: antiquaren en digitaliseringsbedrijven halen steeds vaker zeldzame boeken uit elkaar om deze snel te scannen voor trainingsdoeleinden. Deze praktijk komt vooral voor in de Verenigde Staten en het Verenigd Koninkrijk, maar heeft ook gevolgen voor de Europese markt. De groeiende vraag naar tekst voor generatieve AI-systemen zoals ChatGPT, Llama en Claude zorgt voor een toename in destructief scannen, wat indruist tegen erfgoedzorg en auteursrechten.
Bij destructief scannen worden boeken vaak onherstelbaar beschadigd; de rug wordt losgesneden en pagina's gaan door een snelscanner. Handelaren richten zich op schaarse of uitverkochte titels, omdat deze veel unieke tekst bevatten die aantrekkelijk is voor AI-training. Dit leidt tot extra druk op de al beperkte markt voor erfgoedboeken. Terwijl sommige bibliotheken en musea pleiten voor het behoud van fysieke collecties, kiezen commerciële partijen vaak voor snellere, destructieve methoden. Er zijn alternatieven, zoals boekwieg-scanners die het fysieke boek sparen, maar deze zijn duurder en tijdrovender.
De behoefte aan grote hoeveelheden tekst voor training van grote taalmodellen, zoals GPT-4 en Gemini, zorgt ervoor dat boeken steeds aantrekkelijker worden als bronnen. Echter, dit brengt juridische en ethische kwesties met zich mee, vooral wanneer het gaat om datasets die zowel legale als onduidelijke rechten bevatten. De Europese wetgeving, waaronder de AI Act, verplicht aanbieders van generatieve AI-systemen tot transparantie over hun trainingsdata, wat extra druk zet op ziekenhuizen, instellingen en overheden die AI inkopen.
Om de negatieve effecten op de erfgoedzorg tegen te gaan, willen Nederlandse instellingen scherpere contracten met AI-leveranciers. Ze moeten garanties krijgen over licenties en de oorsprong van de gebruikte gegevens. Niet-destructieve scanning, het invoeren van legale licentiemodellen, en het verminderen van het aantal boeken in trainingssets zijn een aantal aanbevolen methoden om de druk op schaarse collecties te verlichten. De bestaande EU-regels geven bibliotheken en uitgevers een kans om meer controle te krijgen over hun content, met als doel om innovatie te combineren met respect voor recht en erfgoed.
Lees het volledige artikel van AI Insider.
Gerelateerde artikelen
Refurbished fietssloten voor e-bikes
De kosten voor het beveiligen van een e-bike kunnen oplopen, met sloten die variëren van 80 tot 120 euro. Gezien de hoge prijs van een elektrische fiets wil men vaak besparen op deze bijkomende uitgav...
Tech Festival
25 augustus 2026
India's Airbound ontvangt $37 miljoen voor dronelevering
Het Indiase bedrijf Airbound heeft een investering van $37 miljoen binnengehaald, bedoeld om hun innovatieve droneleveringstechnologie verder te ontwikkelen. Deze financiering, afkomstig van gerenomme...
Tech Festival
25 augustus 2026
AI Hedge Fund Onderzocht door SEC na Crises
Een recent opgekomen hedge fund dat gebruikmaakt van kunstmatige intelligentie, dat eerder door de financiële wereld werd bewonderd, staat nu onder intensief toezicht van de Amerikaanse Securities and...
Tech Festival
25 augustus 2026