Gidsen

Wat is de data van uw bedrijf waard voor AI-labs?

AI-labs betalen nu voor besloten bedrijfsgegevens, omdat het openbare web modellen niet meer leert wat ze nodig hebben. Wat uw data waard is, hangt af van een paar duidelijke factoren. Deze gids legt ze uit, laat zien wat openbare deals ons vertellen en verwijst naar een schatting voor uw eigen bedrijf.

Waarom labs betalen voor bedrijfsdata

Grote taalmodellen zijn vooral getraind op openbare tekst: websites, fora, boeken en code. Het meeste daarvan is al gebruikt. Modellen kunnen een redelijke e-mail schrijven, maar met een echte taak van begin tot eind, zoals de maandafsluiting doen of een supportticket in een CRM afhandelen, gaan ze nog vaak de mist in.

De reden is eenvoudig. Modellen hebben heel weinig vastleggingen gezien van hoe professionals dat werk doen. Uw bedrijf legt die elke dag vast, in chat, e-mail, documenten, tickets en systemen. Daar betalen labs voor.

Wat openbare deals ons vertellen

Weinig prijzen voor trainingsdata zijn openbaar, en de meeste openbare deals gaan over grote platforms. Ze geven toch bruikbare ijkpunten. De bedragen hieronder staan in Amerikaanse dollars, zoals gerapporteerd.

  • Google en Reddit: naar verluidt zo'n US$60M per jaar voor toegang tot content van Reddit.
  • News Corp en OpenAI: naar verluidt tot US$250M over vijf jaar.
  • Startups die oude Slack- en e-mailarchieven verkopen: naar verluidt US$10K tot US$100K per deal (Forbes, april 2026).
  • Trainingstaken voor reinforcement learning op basis van echt werk: US$200 tot US$2.000 per stuk (Epoch AI, januari 2026).
  • Exclusieve deals: naar verluidt een veelvoud van de prijs van niet-exclusieve deals.

Hoe u die cijfers leest

Een platform met miljoenen gebruikers is een andere verkoper dan een bedrijf van 40 mensen. Toch laten de cijfers twee dingen zien. Ten eerste worden besloten werkgegevens van gewone bedrijven al verkocht, voor bedragen in de tienduizenden. Ten tweede stijgt de prijs per item sterk als de data complete, controleerbare taken laat zien, omdat labs daar trainingsoefeningen voor AI-agents van kunnen maken.

Zeven factoren die de prijs bepalen

Elke dataset wordt op dezelfde factoren gewaardeerd. Sommige kunt u niet veranderen, zoals hoe lang uw bedrijf bestaat. Andere kunt u beïnvloeden voordat u verkoopt.

  • Volume en jaren historie. Meer gegevens over meer jaren geven labs meer variatie en meer voorbeelden van dezelfde taak, goed uitgevoerd.
  • Structuur. Tickets met een duidelijke vraag, stappen en uitkomst zijn meer waard dan losse bestanden. Gegevens die naar elkaar verwijzen, zoals een ticket, de e-mailthread en het einddocument, zijn nog meer waard.
  • Specialisatie. Werk dat weinig bedrijven doen, of dat deskundig oordeel vraagt, is zeldzaam in trainingsdata. Zeldzame data levert meer op.
  • Taal. Engelse data is er volop. Nederlands, Pools, Zweeds, Tsjechisch en andere Europese talen zijn schaars, dus dezelfde gegevens in die talen zijn vaak meer waard.
  • Zuiverheid. Data met weinig dubbelingen, weinig ruis en persoonsgegevens die makkelijk te verwijderen zijn, kost minder om voor te bereiden, en daar profiteert de verkoper van.
  • Exclusiviteit. Als één lab de data krijgt en verder niemand, betaalt het meer. Niet-exclusieve licenties leveren minder op per koper, maar kunnen vaker worden verkocht.
  • Aantal kopers. Data die meerdere labs willen, kan meerdere keren op niet-exclusieve basis in licentie worden gegeven.

Welke bronnen meestal het meest waard zijn

Niet elk systeem in uw bedrijf heeft dezelfde waarde. Bronnen die werk van vraag tot resultaat laten zien, scoren meestal het hoogst, omdat labs er taken met een bekend antwoord van kunnen maken.

Support- en servicedesktickets, projectborden die aan documenten gekoppeld zijn en coderepositories met hun historie zijn vaak de sterkste bronnen. Interne chat en e-mail volgen als ze beslissingen en probleemoplossing laten zien. Procedures, checklists en draaiboeken voegen context toe die de waarde van al het andere verhoogt. Mappen met alleen definitieve documenten zonder historie zijn op zichzelf het minst waard, al tellen ze nog steeds mee.

  • Meestal hoog: tickets met een uitkomst, code met historie, spreadsheets met werkende formules, reviewcommentaar.
  • Meestal gemiddeld: interne chat en e-mail, CRM-gegevens, projectborden.
  • Op zichzelf meestal lager: eindrapporten, marketingmateriaal, gedeelde schijven met weinig structuur.

Twee bedrijven vergeleken

Neem twee bedrijven van 40 mensen. Het eerste is een algemeen kantoor dat vooral definitieve documenten op een gedeelde schijf bewaart, in het Engels, met drie jaar historie. Het tweede is een gespecialiseerd bedrijf met twaalf jaar aan tickets, een geschreven procedure voor elk type taak en gegevens in het Nederlands en Duits.

Het tweede bedrijf krijgt meestal een duidelijk hoger bod. Zijn gegevens zijn ouder, gekoppeld, gespecialiseerd en in talen waarvan labs weinig hebben. Het eerste bedrijf kan nog steeds verkopen en kan zijn waarde verhogen door bronnen met meer historie toe te voegen, zoals e-mail of een ticketsysteem.

Wat de prijs verlaagt

Sommige dingen verlagen de waarde of sluiten data uit. Gaten van meerdere jaren, gescande documenten zonder leesbare tekst, archieven vol nieuwsbrieven en automatische meldingen, en tekst die zelf door AI is geschreven, zijn allemaal minder waard. Hetzelfde geldt voor data waarvan een groot deel bestaat uit persoonsgegevens die eruit moeten.

Onduidelijke rechten verlagen de prijs het meest. Als u niet kunt aantonen dat de data van u is om in licentie te geven, kan een lab haar niet gebruiken, hoe goed ze ook is. Data die u voor klanten verwerkt, inhoud onder geheimhoudingsovereenkomsten met klanten en materiaal van derden blijven daarom buiten.

Waarom de schatting kijkt naar medewerkers, leeftijd en omzet

Voordat iemand naar uw bronnen heeft gekeken, voorspellen drie feiten de waarde redelijk goed. Het aantal medewerkers zegt hoeveel mensen gegevens produceren. Het aantal jaren dat u bestaat, zegt hoeveel historie er is. De omzet zegt iets over de schaal en complexiteit van het werk.

De schatting van Lodex gebruikt deze drie gegevens voor een eerste bandbreedte. Over alle bedrijven heen vallen schattingen binnen €10K–€600K. Het definitieve bod volgt uit de bronnen die u meeneemt, hun volume en kwaliteit, de toegangsvoorwaarden en onze controle.

Zo verhoogt u de waarde voordat u verkoopt

Een paar praktische stappen maken duidelijk verschil, en de meeste kosten weinig tijd.

  • Kies bronnen met een lange, ononderbroken historie boven bronnen die kort geleden zijn gemigreerd.
  • Neem de gegevens rond een uitkomst mee: de vraag, de discussie en het resultaat.
  • Schrijf uw procedures op. Checklists, draaiboeken en reviewnotities voegen context toe waar labs voor betalen.
  • Regel de rechten vroeg door klantcontracten en geheimhoudingsovereenkomsten na te lopen.
  • Laat ruis weg, zoals nieuwsbrieven, automatische meldingen en persoonlijke mappen.
  • Noem elke taal waarin uw team werkt. Niet-Engelse gegevens zijn vaak het waardevolste deel.

Hoe de betaling werkt

U legt de scope en prijs schriftelijk met Lodex vast voordat we koppelen. We koppelen alleen-lezen, schonen de data op, verpakken haar en voeren een kwaliteitscontrole uit. Zodra uw data door de controle is, wordt u binnen 7 dagen betaald. Kopers zien alleen geschoonde voorbeelden tot het pakket is betaald.

Vul de schatting in om een eerste bandbreedte voor uw bedrijf te zien. Dat kost ongeveer een minuut en verplicht u tot niets.

Vragen

Kan een klein bedrijf er iets aan verdienen?

Ja. We werken met bedrijven vanaf zo'n 10 medewerkers. Een klein bedrijf met een lange, gespecialiseerde historie kan meer waard zijn dan een groter bedrijf met weinig structuur.

Wordt mijn data één keer of vaker verkocht?

Dat hangt af van de licentie. Een exclusieve licentie gaat naar één koper tegen een hogere prijs. Een niet-exclusieve licentie kan naar meerdere labs. De overeenkomst vermeldt wat er geldt.

Waarom leveren niet-Engelse gegevens meer op?

Modellen hebben veel minder trainingsdata in talen zoals Nederlands, Pools of Zweeds. Gegevens in die talen vullen een echt gat, dus labs waarderen ze hoger.

Zit ik na de schatting ergens aan vast?

Nee. De schatting is een eerste bandbreedte. Er wordt niets gedeeld tot u de voorwaarden tekent en elke bron goedkeurt.

Wanneer staat de definitieve prijs vast?

Na een gesprek waarin we uw bronnen samen doorlopen. De schriftelijke overeenkomst vermeldt de prijs, de scope en hoe de betaling werkt.

Ken de prijs voordat u verkoopt.

Beantwoord drie vragen over uw bedrijf en krijg binnen een minuut een indicatie van de uitbetaling.

Bekijk uw schattingPlan een gesprek

Beantwoord alle drie de vragen om uw bandbreedte te zien en een gesprek te plannen.

  • U keurt elke bron goed
  • Klant- en persoonsgegevens verwijderd
  • Nooit verkocht aan uw concurrenten
  • Niets gedeeld voordat u tekent
Bekijk uw schatting