Wat gebeurt er als onze afgeschreven boeken grondstof worden voor AI?
Anthropic, een Amerikaans bedrijf dat zich bezighoudt met kunstmatige intelligentie, haalde begin 2024 de voormalige architect van Google’s boekenscanprogramma binnen, met als opdracht alle boeken ter wereld te verwerven. Intern kreeg dat de codenaam Panama, volgens de eigen planningsdocumenten omdat men liever niet had dat bekend werd waar het bedrijf mee bezig was. De omschrijving in datzelfde stuk laat weinig aan de verbeelding over: het destructief scannen van alle boeken ter wereld.
Wil je liever naar de column luisteren? Beluister dan onderstaande podcastaflevering.
In een reeks columns over AI neemt Erik Reuvers, adviseur Digitale Geletterdheid bij Probiblio je mee in de wereld van artificiële intelligentie en wat die betekent voor bibliotheken. Niet alleen technisch, maar juist vanuit de waarden waar bibliotheken voor staan.
Wat volgde ligt inmiddels vast in rechtbankstukken. Miljoenen tweedehands boeken werden opgekocht, de ruggen er met hydraulische snijders afgehaald, de pagina’s door snelscanners gehaald en de resten weggegooid. Een Amerikaanse rechter oordeelde in juni 2025 dat dit onder fair use viel, juist omdat het origineel werd vernietigd en er dus geen tweede exemplaar ontstond.
Sindsdien is er een markt ontstaan. Tweedehandsboekverkopers krijgen bulkorders van soms een miljoen exemplaren, waarbij tussenpartijen aanbieden de identiteit van de koper geheim te houden. Gezocht wordt vooral naar werk van voor 2022, want dat bevat gegarandeerd geen machinetekst. Hoe ouder, obscuurder en minder gedigitaliseerd, hoe waardevoller. Eind juli beschreef Fortune hoe een Nederlandse boekhandelaar een verzoek voor 3.000 exemplaren binnenkreeg en dacht dat het spam of phishing was.
Dat is precies het materiaal dat in magazijnen en depots staat, en het is ook het materiaal dat bibliotheken jaarlijks afvoeren. Wat gesaneerd wordt gaat naar de kringloop, naar boekenmarkten, naar opkopers, en daarna weet niemand meer waar het heen gaat. Er is dus niets dat garandeert dat er tussen die partijen geen boeken zitten die ooit uit een Nederlandse bibliotheek zijn afgeschreven.
Op die wereldwijde opkoopmarkt heeft de Nederlandse bibliotheek geen invloed. Op wat er via de eigen achterdeur weggaat wel. En daarmee zijn we bij de vraag die onder alle discussies over AI en collectie ligt: waar wordt er beslist, en door wie.
Op dat punt gebeurt op dit moment veel, en dat is goed nieuws.
De KB, nationale bibliotheek, kondigde begin 2024 aan de toegang tot haar digitale collecties te beperken voor het trainen van commerciële AI, met als argument dat modellen die zonder toestemming websites crawlen niet het algemeen belang dienen. Anderhalf jaar later tekende diezelfde KB een overeenkomst met GPT-NL en stelde alle rechtenvrije digitale teksten uit haar collecties beschikbaar, juist omdat dat project uitsluitend met rechtmatig verkregen data werkt en afspraken maakt met rechthebbenden. Onthouden aan de een, bijdragen aan de ander. Dat is geen afweer, dat is een positie: wij bepalen zelf wat we afstaan, aan wie, en onder welke voorwaarden.
Aan de kant waar de boeken binnenkomen wordt eveneens gehandeld. NBD Biblion weerde AI-gegenereerde titels aanvankelijk uit het aanbod, en stapte in mei over op een andere aanpak: uitgevers wordt gevraagd te melden wanneer AI een dominante rol speelde, zodat bibliotheken zelf kunnen beslissen. De Koninklijke Boekverkopersbond koos in dezelfde week hetzelfde instrument. Beide vertrouwen erop dat uitgevers die informatie meegeven, en veel anders kan ook niet, want aan het boek is niet te zien hoe het gemaakt is. De hele keten hangt daarmee aan de blauwe ogen van de partij die er het meeste belang bij heeft.
Toch valt op waar de aandacht zich op richt. Het gaat over het boek dat op de plank dreigt te komen. Ondertussen wordt de informatie waarmee bibliotheken hun collectie samenstellen al sinds 2022 door software gemaakt. NBD Biblion nam toen afscheid van het merendeel van zijn recensenten en produceert metadata en aanschafinformatie met een eigen AI-platform, met menselijke eindredactie. Dat leverde destijds een flinke rel op, en daarna niets. Het is gewoon de manier waarop het werkt geworden, terwijl dit wel de teksten zijn waarop bibliotheken hun aanschafbeslissingen baseren. En het gaat om schaal: van de circa 25.000 nieuwe Nederlandstalige titels per jaar haalt ongeveer 15.000 het aanbod. Die trechter is de eerste selectie van de bibliotheekcollectie, en die verloopt in Nederland via één landelijke leverancier. Dat gebeurt in samenspraak met de sector, maar het is wel de plek waar de collectie voor het eerst smaller wordt.
Dan de vraag die er echt toe doet: Wanneer maakt het uit dat iets door AI is gemaakt?
Dat lastiger dan het lijkt. Dat een model heeft meegeholpen bij redigeren, structureren of vertalen zal niemand tegenhouden, en dat hoeft ook niet. En bij een volledig gegenereerd boek kun je zeggen: als een lezer het met plezier leest, wat is er dan mis? De waarde van een boek bepaalt de lezer, niet het productieproces. Aan het boek in je hand is bovendien nauwelijks te zien wat je zou willen weten.
Toch knaagt het, en ik denk dat de schade niet in dat ene boek zit. Eén AI-titel die iemand goed vindt is geen probleem. Duizend ervan concurreren om dezelfde plank, dezelfde aandacht en hetzelfde budget. Zo ging het bij de recensenten in 2022, en het zal niet stoppen bij illustratoren van wie de omslag door een generator wordt vervangen.
En er zit meer aan vast dan werk en inkomen. Als een model goede boeken schrijft, verandert dat wat schrijven betekent. Het vak ontleent z ijn aantrekkingskracht aan de moeite die het kost, en aan het idee dat iemand iets heeft gemaakt wat er zonder hem niet was geweest. Neem je die moeite weg, dan valt op termijn ook weg waarom iemand er nog aan begint. Dat is niet met een subsidie te repareren, en het komt niet terug. En daar zou ik van een bibliotheek verwachten dat ze er iets van vindt.
Dat is een grote vraag, en ik ga hem hier niet beslechten. Wel denk ik dat we ondertussen een kleiner ding kunnen doen. Ik kan me voorstellen dat een melding per functie meer helderheid geeft dan één label voor het hele boek: tekst, beeld, vertaling, stem. Dan zie je waar menselijk werk verdwijnt in plaats van alleen waar de tekst vandaan komt. Of dat werkbaar is, moeten de collectiespecialisten zeggen.
Er is beweging. NBD verkent een bredere klankbordgroep, Probiblio en DEN organiseren een sessie over collectie en AI. Daar hoort dit gesprek. En dan gaat het niet alleen over wat er binnenkomt, maar ook over wat er beschreven en aanbevolen wordt, en over wat er weggaat. Want ergens staat een pallet afgeschreven bibliotheekboeken te wachten op een opkoper. Ook dat is een besluit over onze collectie.