Eind 2025 beschuldigde Anthropic, het bedrijf achter chatbot Claude, in een brief aan de Amerikaanse Senaat het Chinese Alibaba ervan via 25.000 nepaccounts in zes weken tijd zo’n 28,8 miljoen gesprekken met Claude te hebben gevoerd. Niet om Claude te gebruiken, maar om de antwoorden op te slaan als trainingsmateriaal voor een eigen, goedkoper model. Die techniek heet modeldestillatie, en de Nederlandse blog De Digitale Gavel legde onlangs helder uit hoe zij technisch werkt. De juridische vraag die daarbij opduikt, beantwoorden wij hier naar Belgisch recht. Het korte antwoord: op de antwoorden van een AI-model rust in België in beginsel geen auteursrecht en doorgaans ook geen databankenrecht, zodat de aanbieder vooral moet terugvallen op zijn gebruiksvoorwaarden, op de leer van de derde-medeplichtigheid en op de eerlijke marktpraktijken. Wie met valse accounts werkt, riskeert bovendien het strafrecht op zijn pad tegen te komen.
Wat modeldestillatie is en waarom elk AI-lab het zelf doet
Modeldestillatie werkt met een leraar en een leerling. Het leraar-model is groot, duur en capabel: de ontwikkelkosten van zo’n model lopen in de honderden miljoenen dollars. Het leerling-model is klein en goedkoop. In plaats van de leerling zelf op het hele internet te trainen, stelt de ontwikkelaar het leraar-model miljoenen vragen, slaat elk antwoord op en laat de leerling die vraag-antwoordparen instuderen. Na miljoenen herhalingen begint de leerling verrassend goed op de leraar te lijken.
De techniek is volstrekt gangbaar. De grote AI-labs destilleren hun eigen topmodellen tot de goedkope “mini”-varianten die op een laptop of telefoon draaien. Sinds de opkomst van redeneermodellen, die hun denkstappen voluit in de antwoordtekst uitschrijven, is destilleren via de gewone uitvoer bovendien spectaculair goedkoper geworden. Een team van Stanford en de University of Washington trainde begin 2025 met amper duizend afgetapte vragen, zo berichtte TechCrunch, een competitief redeneermodel voor minder dan vijftig dollar aan rekenkracht; de onderzoekers beschreven hun werkwijze in de s1-paper.
Het onderscheid tussen productontwikkeling en probleem zit dus niet in de techniek, maar in de toestemming. Wie zijn eigen model destilleert, lanceert een product. Wie het model van een concurrent leegvraagt via diens publieke interface, schendt in de regel de gebruiksvoorwaarden. De vraag is wat de aanbieder daar naar Belgisch recht tegen kan beginnen.
Waarom het auteursrecht de AI-aanbieder niet helpt
De eerste reflex van een benadeelde onderneming is het auteursrecht. Die reflex loopt hier vast. Auteursrechtelijke bescherming vereist een werk dat origineel is: een eigen intellectuele schepping die tot uiting komt in vrije en creatieve keuzes van een auteur. Het Hof van Cassatie vult dat in vaste rechtspraak in als een aanwijsbare menselijke creatieve activiteit die het werk een persoonlijke stempel geeft. Een tekst die een taalmodel zonder menselijke creatieve tussenkomst genereert, is een mechanisch resultaat en dus geen werk.
Dat is geen nieuw inzicht. Zoals we eerder analyseerden in onze bijdrage over de vraag of een schilderij gemaakt door artificiële intelligentie auteursrechtelijk beschermd wordt, en later over afbeeldingen uit generatieve AI, staat of valt de bescherming met de menselijke inbreng. Bij 28,8 miljoen automatisch gegenereerde antwoorden is die menselijke inbreng per antwoord onbestaande.
Voor de aanbieder van het leraar-model betekent dat iets ongemakkelijks. Zijn kroonjuwelen, de hoogwaardige antwoorden, zijn precies het onderdeel van zijn product waarop geen exclusief recht rust. De trainingsdata, de modelgewichten en de software eromheen kunnen wél beschermd zijn, maar die kopieert de destilleerder niet. Hij kopieert enkel wat het model zegt. Meer achtergrond bij dit spanningsveld vindt u op onze overzichtspagina over artificiële intelligentie en auteursrecht.
Biedt het databankenrecht dan een uitweg?
Een tweede spoor is het databankenrecht. Het Wetboek van economisch recht (WER) kent de producent van een databank een sui generis-recht toe: hij kan de opvraging en het hergebruik verbieden van het geheel of een substantieel deel van de inhoud van zijn databank (art. XI.307 WER). Dat recht beschermt geen creativiteit maar investering, en het is ruim uitgelegd. Het Hof van Justitie oordeelde in het arrest Innoweb (HvJ 19 december 2013, C-202/12) zelfs dat een metazoekmachine die een beschermde databank realtime doorzoekbaar maakt, de volledige inhoud hergebruikt.
Toch wringt de toepassing op een AI-model op drie punten.
Ten eerste de kwalificatie. Een databank is een verzameling van zelfstandige elementen die systematisch of methodisch geordend en individueel toegankelijk zijn (art. I.13, 6° WER, omzetting van de Databankrichtlijn). Een getraind taalmodel is geen geordende verzameling opvraagbare elementen: de kennis zit versmolten in miljarden parameters, en geen enkel element kan er afzonderlijk uit worden opgeroepen. De antwoorden bestaan bovendien pas op het ogenblik dat zij worden gegenereerd. Er valt dus, vóór de destillatie-operatie begint, geen bestaande databank aan te wijzen waaruit wordt opgevraagd.
Ten tweede de investering. De bescherming vereist een substantiële investering in de verkrijging, de controle of de presentatie van de inhoud, en het Hof van Justitie sluit de investering in het creëren van de gegevens daar uitdrukkelijk van uit (o.m. het arrest British Horseracing Board, HvJ 9 november 2004, C-203/02). De honderden miljoenen die in het model zijn gestoken, zijn kosten om antwoorden te kunnen creëren. Precies die creatie-investering telt niet mee.
Ten derde, en dat wordt vaak vergeten: het sui generis-recht komt enkel toe aan producenten met een band met de Europese Unie (art. XI.315 WER). Een Amerikaanse aanbieder zonder Europese vestigingsstructuur die aan de voorwaarden voldoet, kan zich er in België hoe dan ook niet op beroepen.
Valt een gegevensverzameling buiten zowel het auteursrecht als het sui generis-recht, dan besliste het Hof van Justitie in het arrest Ryanair (HvJ 15 januari 2015, C-30/14) dat de exploitant het gebruik ervan vrij contractueel mag regelen. De bescherming verschuift dan volledig naar de gebruiksvoorwaarden. Daarover zo dadelijk meer. Wie het regime in detail wil nalezen, vindt de bouwstenen op onze pagina over het databankenrecht.
Zijn de antwoorden van een AI-model een bedrijfsgeheim?
Het derde spoor loopt via de bedrijfsgeheimen. Sinds de omzetting van de richtlijn bedrijfsgeheimen beschermt Titel 8/1 van Boek XI WER informatie die geheim is, handelswaarde heeft omdat zij geheim is, en aan redelijke geheimhoudingsmaatregelen is onderworpen (art. I.17/1, 1° WER).
Voor de modelgewichten, de trainingsmethodes en de interne waarschijnlijkheidsverdelingen van het model gaat die kwalificatie doorgaans op. Die informatie deelt geen enkele aanbieder via zijn publieke kanalen. Maar de destilleerder neemt die interne informatie niet weg. Hij verzamelt de antwoorden, en die antwoorden worden aan elke betalende klant meegedeeld. Informatie die per definitie aan derden wordt meegedeeld, verliest haar geheime karakter.
Blijft de vraag of het massaal bevragen van het model geen verboden vorm van reverse engineering is. Ook daar helpt de wet de aanbieder niet vanzelf: de observatie, het onderzoek en het testen van een product dat ter beschikking van het publiek is gesteld, is een rechtmatige wijze van verkrijging (art. XI.332/4 juncto art. XI.332/3, § 1, 2° WER), tenzij een geldige contractuele beperking anders bepaalt. En daarmee komt opnieuw alles op de gebruiksvoorwaarden aan. Een overzicht van dit beschermingsregime vindt u op onze pagina over bedrijfsgeheimen en knowhow.
De gebruiksvoorwaarden als eigenlijke verdedigingslinie
Elke grote AI-aanbieder verbiedt in zijn gebruiksvoorwaarden het gebruik van de uitvoer om concurrerende modellen te trainen. Wie een account aanmaakt, aanvaardt die voorwaarden. De destilleerder die het verbod aan zijn laars lapt, pleegt dus een contractuele wanprestatie, met alle gevolgen van dien: schadevergoeding, ontbinding en afsluiting van het account.
In de praktijk zit de destilleerder zelden zelf aan tafel. De operatie tegen Claude verliep volgens de berichtgeving via duizenden ogenschijnlijk normale accounts, elk goed voor gemiddeld 25 vragen per dag, en via tussenpersonen die in China toegang doorverkochten met kortingen tot 90 procent, de gesprekslogs bijhielden en die logs als trainingsdata verhandelden.
Het Burgerlijk Wetboek (BW) codificeerde in 2023 de leer van de derde-medeplichtigheid: een derde begaat een onrechtmatige daad wanneer hij deelneemt aan de niet-nakoming door een partij van haar contractuele verbintenissen, terwijl hij die verbintenissen kende of behoorde te kennen (art. 5.111 BW). De onderneming die trainingslogs opkoopt van een reseller, terwijl elke professionele speler in de sector weet dat de gebruiksvoorwaarden van de aanbieder dat hergebruik verbieden, stelt zich dus rechtstreeks bloot aan een vordering van de aanbieder zelf. Het contract bindt enkel de accounthouder, maar de fout van de derde die er bewust van profiteert, is buitencontractueel aansprakelijk te stellen.
Daarnaast biedt het marktpraktijkenrecht een zelfstandige grondslag tegen de concurrent-destilleerder. Art. VI.104 WER verbiedt elke met de eerlijke marktpraktijken strijdige daad waardoor een onderneming de beroepsbelangen van een andere onderneming schaadt of kan schaden; potentiële schade volstaat. Het systematisch afromen van andermans product om het tegen een fractie van de kosten na te bouwen, is het typevoorbeeld van parasitaire aanhaking. De aanbieder kan daartegen een stakingsvordering instellen voor de voorzitter van de ondernemingsrechtbank, die zetelt zoals in kort geding (art. XVII.1 WER): een snelle procedure ten gronde, zonder vereiste van hoogdringendheid. Meer over deze figuur leest u op onze pagina over oneerlijke marktpraktijken.
Waar de valse accounts het strafrecht binnenhalen
De destillatie-operatie zelf is één ding. De manier waarop zij wordt georganiseerd, is iets anders. Toen Anthropic bij het aanmaken van accounts een identiteitscontrole met live selfie invoerde, ontstond volgens de berichtgeving binnen enkele weken een schaduwmarkt van AI-gegenereerde identiteitsbewijzen en deepfake-camera’s, met accounts die voor ongeveer dertig dollar per stuk werden verhandeld.
Naar Belgisch recht schuift de kwalificatie dan op van contractbreuk naar misdrijf. Het Strafwetboek (Sw.) straft wie zich toegang verschaft tot een informaticasysteem of zich daarin handhaaft terwijl hij weet dat hij daartoe niet gerechtigd is, en wie met bedrieglijk opzet zijn toegangsbevoegdheid overschrijdt (art. 550bis, § 1 en § 2 Sw.; vanaf 1 september 2026 de externe en interne hacking van art. 524 en 525 van het nieuwe Strafwetboek). Wie zich met een vals identiteitsbewijs toegang verschaft nadat de aanbieder zijn account heeft geweigerd of afgesloten, weet dat hij niet gerechtigd is. Het aanmaken van accounts met AI-gegenereerde identiteitsdocumenten kan daarnaast valsheid in informatica opleveren: het invoeren van gegevens in een informaticasysteem waardoor hun juridische draagwijdte verandert (art. 210bis Sw.; vanaf 1 september 2026 opgenomen in de techniekneutrale valsheid in geschriften of op andere duurzame dragers van art. 451 van het nieuwe Strafwetboek). Onze pagina over hacken gaat dieper in op deze informaticamisdrijven.
De ongemakkelijke spiegel: AI-labs trainen zelf op andermans werk
Er zit een wrange kant aan de verontwaardiging van de AI-aanbieders. Dezelfde bedrijven die nu over diefstal spreken, hebben hun leraar-modellen getraind op het werk van miljoenen auteurs, fotografen en journalisten, veelal zonder toestemming. Anthropic trof daarover in 2025 een schikking van 1,5 miljard dollar met Amerikaanse auteurs, die op 20 juli 2026 definitief werd goedgekeurd door de federale rechtbank in Californië.
Naar Belgisch en Europees recht is dat trainen nochtans niet zomaar onrechtmatig. De omzetting van de DSM-richtlijn voerde een uitzondering in voor tekst- en datamining: de reproductie van rechtmatig toegankelijke werken met het oog op tekst- en datamining is toegestaan, tenzij de auteur zijn rechten op passende wijze uitdrukkelijk heeft voorbehouden, bij online content via machinaal leesbare middelen (art. XI.190, 20° WER). Voor onderzoeksorganisaties bestaat een aparte, niet-uitsluitbare uitzondering (art. XI.191/1, § 1, 7° WER). De AI-Verordening verplicht aanbieders van AI-modellen voor algemene doeleinden bovendien een beleid te voeren om die opt-outs te identificeren en te eerbiedigen (art. 53, lid 1, c) AI-Verordening).
De juridische symmetrie is dus opvallend. Het trainen op menselijk werk is toegelaten tenzij de rechthebbende zich machineleesbaar verzet. Het trainen op modeluitvoer is niet door een exclusief recht verboden, maar wel contractueel uitgesloten. In beide richtingen beslist niet het eigendomsrecht, maar de vraag wie welk voorbehoud heeft gemaakt en wie welk beding heeft aanvaard.
Wat betekent dit concreet?
Voor de aanbieder van een AI-model. Reken niet op het auteursrecht of het databankenrecht om uw uitvoer te beschermen; bouw uw verdediging rond de gebruiksvoorwaarden. Zorg dat het destillatieverbod in de gebruiksvoorwaarden ondubbelzinnig is geformuleerd, ook voor resellers en API-toegang, en dat de aanvaarding ervan bewijsbaar is per account. Documenteer de detectie: het patroon van duizenden accounts met gelijkaardige vragen is uw bewijsmateriaal voor de wanprestatie, de derde-medeplichtigheid en de vordering wegens oneerlijke marktpraktijken. Behandel de modelgewichten en interne parameters als bedrijfsgeheim, met contractuele en technische geheimhoudingsmaatregelen die u kunt aantonen.
Voor de onderneming die een model wil destilleren of afgeleide trainingsdata wil kopen. Destilleer uw eigen model of werk met uitdrukkelijke toestemming van de aanbieder; sommige aanbieders bieden destillatie als betalende dienst aan. Koopt u datasets van derden, doe dan een herkomstonderzoek: wie trainingslogs verwerft waarvan hij behoort te weten dat zij met schending van andermans gebruiksvoorwaarden zijn verzameld, riskeert een rechtstreekse aansprakelijkheidsvordering op grond van art. 5.111 BW en een stakingsvordering wegens oneerlijke marktpraktijken. Bij twijfel over de contouren van zo’n dataset-deal doet u er goed aan zich vooraf te laten bijstaan door een advocaat gespecialiseerd in intellectuele eigendom.
Veelgestelde vragen (FAQ)
Is de tekst die een chatbot genereert auteursrechtelijk beschermd?
In beginsel niet. Auteursrecht vereist een menselijke creatieve activiteit met een persoonlijke stempel. Een antwoord dat een taalmodel autonoom genereert, is een mechanisch resultaat en dus geen werk. Enkel wanneer een mens de output nadien met eigen vrije en creatieve keuzes bewerkt, kan op die bewerking auteursrecht ontstaan.
Mag ik de antwoorden van ChatGPT, Claude of Gemini gebruiken om mijn eigen AI-model te trainen?
De gebruiksvoorwaarden van de grote aanbieders verbieden dat uitdrukkelijk. Doet u het toch met uw eigen account, dan pleegt u contractbreuk. Koopt u de gegevens van een tussenpersoon, dan riskeert u als derde-medeplichtige aan die contractbreuk aansprakelijk te worden gesteld (art. 5.111 BW) en via een stakingsvordering wegens oneerlijke marktpraktijken te worden aangepakt.
Kan een AI-aanbieder in België iemand strafrechtelijk laten vervolgen voor modeldestillatie?
Niet voor de destillatie op zich, wel voor de omkadering. Wie zich met valse identiteitsgegevens of na een accountweigering toegang verschaft tot het platform, kan zich schuldig maken aan ongeoorloofde toegang tot een informaticasysteem (art. 550bis Sw.; vanaf 1 september 2026 art. 524-525 van het nieuwe Strafwetboek) en valsheid in informatica (art. 210bis Sw.; vanaf 1 september 2026 art. 451 van het nieuwe Strafwetboek).
Conclusie
Modeldestillatie legt een lacune in het intellectuele eigendomsrecht bloot: het waardevolste onderdeel van een AI-product, de antwoorden zelf, is in België noch door het auteursrecht, noch doorgaans door het databankenrecht beschermd. De werkelijke bescherming van de AI-aanbieder ligt in zijn gebruiksvoorwaarden, versterkt door de derde-medeplichtigheid van art. 5.111 BW, de stakingsvordering wegens oneerlijke marktpraktijken en, bij valse accounts, het strafrecht. Wie in België een model wil destilleren of afgeleide trainingsdata wil aankopen, toetst dus best eerst de contractuele keten, niet enkel het IE-recht.



