Zeldzame boeken vernietigd voor AI-training
In de recente discussie over de impact van artificiële intelligentie (AI) op bibliotheken en archieven, is er een zorgwekkende trend zichtbaar: antiquaren en digitaliseringsbedrijven halen steeds vaker zeldzame boeken uit elkaar om deze snel te scannen voor trainingsdoeleinden. Deze praktijk komt vooral voor in de Verenigde Staten en het Verenigd Koninkrijk, maar heeft ook gevolgen voor de Europese markt. De groeiende vraag naar tekst voor generatieve AI-systemen zoals ChatGPT, Llama en Claude zorgt voor een toename in destructief scannen, wat indruist tegen erfgoedzorg en auteursrechten.
Bij destructief scannen worden boeken vaak onherstelbaar beschadigd; de rug wordt losgesneden en pagina's gaan door een snelscanner. Handelaren richten zich op schaarse of uitverkochte titels, omdat deze veel unieke tekst bevatten die aantrekkelijk is voor AI-training. Dit leidt tot extra druk op de al beperkte markt voor erfgoedboeken. Terwijl sommige bibliotheken en musea pleiten voor het behoud van fysieke collecties, kiezen commerciële partijen vaak voor snellere, destructieve methoden. Er zijn alternatieven, zoals boekwieg-scanners die het fysieke boek sparen, maar deze zijn duurder en tijdrovender.
De behoefte aan grote hoeveelheden tekst voor training van grote taalmodellen, zoals GPT-4 en Gemini, zorgt ervoor dat boeken steeds aantrekkelijker worden als bronnen. Echter, dit brengt juridische en ethische kwesties met zich mee, vooral wanneer het gaat om datasets die zowel legale als onduidelijke rechten bevatten. De Europese wetgeving, waaronder de AI Act, verplicht aanbieders van generatieve AI-systemen tot transparantie over hun trainingsdata, wat extra druk zet op ziekenhuizen, instellingen en overheden die AI inkopen.
Om de negatieve effecten op de erfgoedzorg tegen te gaan, willen Nederlandse instellingen scherpere contracten met AI-leveranciers. Ze moeten garanties krijgen over licenties en de oorsprong van de gebruikte gegevens. Niet-destructieve scanning, het invoeren van legale licentiemodellen, en het verminderen van het aantal boeken in trainingssets zijn een aantal aanbevolen methoden om de druk op schaarse collecties te verlichten. De bestaande EU-regels geven bibliotheken en uitgevers een kans om meer controle te krijgen over hun content, met als doel om innovatie te combineren met respect voor recht en erfgoed.
Lees het volledige artikel van AI Insider.
Gerelateerde artikelen
Xona's GPS alternative goes into beta
Xona, an innovative technology company, is about to launch its new precision timing and navigation service. This product is a promising alternative solution to the traditional GPS system, which is oft...
Tech Festival
09 October 2026
SpaceX as a new mobile provider in the US
SpaceX, the aerospace company founded by Elon Musk, makes a significant leap in the telecommunications market. According to recent reports, the company has secured a billion-dollar deal to acquire fre...
Tech Festival
09 October 2026
Public Prosecution Service stops investigation into home battery sellers
The Public Prosecution Service (OM) has decided not to initiate a criminal investigation into possible fraud with home batteries. This decision comes despite more than a thousand reports received rega...
Tech Festival
09 October 2026