Ga naar hoofdinhoud
Terug naar blog
aiautomatiseringmkbdatakennis

Waarom je AI betere antwoorden geeft op jouw documenten dan op het hele internet

Hetzelfde AI-model werd deze week een derde nauwkeuriger zodra het uit een afgebakende, actuele bron mocht putten in plaats van uit een zoekopdracht. Wat dat betekent als je in het MKB met AI werkt.

19 september 20266 min leestijd

Je stelt een vraag, en het antwoord klopt net niet

Je vraagt je AI-assistent wat jullie tarief is voor spoedwerk. Er komt een net antwoord uit, in nette zinnen, met een bedrag erin. Alleen klopt dat bedrag niet. Het staat nergens in jullie administratie, het komt uit een prijslijst van een branchegenoot die toevallig hoog in Google staat.

Dat is geen storing en ook geen slecht model. Het is precies wat er gebeurt als je een AI een vraag stelt die hij alleen kan beantwoorden door op internet te gaan zoeken. Hij vindt iets dat er plausibel uitziet, en jij kunt aan het antwoord niet zien waar het vandaan komt.

Wat er deze week gemeten werd

OpenAI bracht een versie van zijn zwaarste model uit die is ingericht voor juridisch werk, met een eigen zoekindex eronder: een afgebakende verzameling wetten, uitspraken en regelgeving die dagelijks wordt bijgewerkt. Interessant is niet het product, want dat gaat over Amerikaans recht. Interessant is de vergelijking die erbij werd gepubliceerd.

Op dezelfde toets haalde het model met die eigen bron 54,0 procent goede antwoorden. Exact hetzelfde model, dat in plaats daarvan het internet afzocht, kwam uit op 38,7 procent. Zelfde model, zelfde rekenkracht, zelfde vragen. Het enige verschil was waar het zijn informatie vandaan haalde, en dat leverde ruim een derde meer goede antwoorden op.

Dat is het cijfer om te onthouden als iemand in je bedrijf voorstelt om "een beter AI-abonnement" te nemen omdat de antwoorden tegenvallen.

Waarom een kleine bron een grote zoekmachine verslaat

Het voelt tegenintuïtief. Het internet is groter, dus je zou denken dat er meer in te vinden is. In de praktijk werkt het andersom, om drie redenen.

  • Er is geen ruis. In een afgebakende bron staat alleen materiaal dat er hoort te staan. Op internet staat jouw antwoord tussen tien bijna-antwoorden van anderen, en het model moet gokken welke van jou is.
  • Het is actueel op een manier die je kunt nakijken. Een eigen bron heeft een datum en een eigenaar. Bij een zoekresultaat weet je vaak niet eens uit welk jaar het komt.
  • Je kunt het antwoord terugvolgen. Als de AI zegt "jullie spoedtarief is X", wil je kunnen zien uit welk document dat komt. Bij een webzoekopdracht krijg je een link naar iemand anders.

Er is nog een vierde reden die minder vaak genoemd wordt: wat je AI van het open web leest, kan instructies bevatten die niet voor jou bedoeld zijn. We schreven eerder over verstopte instructies in wat je AI leest. Een eigen bron heeft dat probleem niet, omdat jij bepaalt wat erin gaat.

Welke eigen bronnen in het MKB het meeste opleveren

Je hoeft hier geen groot project van te maken. In de meeste bedrijven zitten de antwoorden waar het vaakst naar gevraagd wordt in een handvol plekken:

  1. Je prijslijst en je standaardvoorwaarden. De vragen waar een verkeerd antwoord direct geld kost.
  2. Je offertes en opdrachtbevestigingen van het afgelopen jaar. Daar staat hoe jullie dingen formuleren en wat jullie normaal rekenen.
  3. Je klantcorrespondentie over terugkerende vragen. Levertijden, garantie, wat wel en niet inbegrepen is.
  4. Je interne werkafspraken. Wie tekent wat af, wat gaat er naar de klant en wat niet.
  5. Je productdocumentatie of dienstbeschrijvingen. Vooral als die op je site verouderd is en intern wel klopt.

Merk op wat hier niet staat: alles. Je hele Google Drive erin gooien maakt het slechter, niet beter, want dan bouw je precies de ruis na waar je vanaf wilde. Vijf goede documenten verslaan vijfhonderd rommelige.

Hoe je zo'n bron in de praktijk aansluit

Technisch zijn er grofweg drie routes, en welke je kiest hangt af van waar je informatie nu staat.

Koppel de software waar het al in staat. Staat je informatie in een boekhoudpakket, CRM of projecttool, dan wil je dat de AI daar rechtstreeks in kan kijken in plaats van in een kopie. Dat gaat tegenwoordig via een standaardkoppeling. We legden dat uit in MCP: je bedrijfssoftware verbinden met AI.

Zet een aparte kennismap op. Hebben jullie de informatie vooral in documenten staan, dan maak je één map waar de actuele versies in gaan, en je spreekt af dat die map leidend is. De AI leest alleen daaruit. Simpel, en verrassend effectief.

Bouw een automatisering die de bron bijwerkt. Verandert er regelmatig iets, dan wil je niet dat iemand handmatig moet onthouden om de map te verversen. Dan laat je een workflow dat doen, bijvoorbeeld met n8n.

In alle drie de gevallen is de afspraak belangrijker dan de techniek: er is één plek die klopt, en de AI kijkt daar.

De vraag die je vooraf moet beantwoorden

Voor je een bron aansluit, moet je bepalen wie er wat uit mag halen. Een AI die jullie complete offertehistorie kan lezen, kan ook een offerte van klant A aanhalen in een gesprek over klant B. Dat is geen theoretisch risico, dat gebeurt gewoon als je het niet afbakent.

Spreek daarom per bron af wie hem mag bevragen en wat er niet in mag. Bij persoonsgegevens en klantendossiers is dat geen luxe maar een AVG-verplichting. Het scheelt bovendien in kwaliteit: hoe scherper je afbakent, hoe beter het antwoord.

Begin met één vraag

De valkuil is dat dit als een datavraagstuk gaat voelen waar eerst een project voor moet komen. Dat hoeft niet. Pak de vraag die in jullie bedrijf het vaakst gesteld wordt en waar een fout het meest kost. Vaak is dat iets over prijs of levertijd.

Zoek de twee of drie documenten waar het juiste antwoord in staat. Zet die op één plek. Laat de AI alleen daaruit antwoorden en stel dezelfde vraag tien keer, ook een beetje anders geformuleerd. Klopt het antwoord tien van de tien keer, dan heb je je eerste betrouwbare bron en weet je meteen hoe het werkt. Klopt het zeven van de tien keer, dan weet je dat het aan je documenten ligt en niet aan het model, en dat is ook winst.

Daarna breid je uit, één vraag tegelijk. Dat is trager dan alles in één keer aansluiten, en het is de enige manier waarop je onderweg merkt wat er niet klopt.

Benieuwd welke bronnen in jouw bedrijf het eerst aan de beurt zijn? We kijken het graag samen met je door.

KC

Kyan Cordes

Oprichter NOVAITEC