Kennisbank

Nederlandstalige chatbot-antwoorden beoordelen met echte klantvragen

Beoordeel Nederlandse chatbot-antwoorden op juistheid, volledigheid, taal, grenzen en bruikbare overdracht.

Correct Nederlands is niet hetzelfde als een correct antwoord. Een chatbot kan vloeiend schrijven en toch een voorwaarde missen, een bron verkeerd toepassen of geen menselijke route bieden. Beoordeel elke reactie naast de goedgekeurde bron en de taak van de klant.

Download het invulbare werkblad in CSV. Open het lokaal als UTF-8 met een komma als scheidingsteken en vervang de voorbeeldwaarden door je eigen gegevens.

1. Verzamel representatieve formuleringen

Gebruik geanonimiseerde patronen uit echte contactredenen en herschrijf ze met synthetische gegevens. Neem korte vragen, typefouten, spreektaal, samengestelde vragen en regionale woordkeuze op. Bewaar geen namen, ordernummers of chatlogs in het werkblad.

Maak van één contactreden meerdere formuleringen zonder het verwachte antwoord te veranderen. Zo test je taalvariatie afzonderlijk van bronkennis. Neem ook een vraag op waarin een noodzakelijke voorwaarde ontbreekt; het verwachte gedrag kan dan een verduidelijkende vraag zijn.

2. Leg bron en verwacht gedrag vast

Wijs per vraag één actuele bron of een bewuste onbekend-regel aan. Schrijf vooraf wat minimaal in het antwoord moet staan, wat niet gezegd mag worden en wanneer overdracht nodig is.

3. Scoor juistheid en volledigheid apart

Juist betekent dat feiten overeenkomen met de bron. Volledig betekent dat noodzakelijke voorwaarden en uitzonderingen meekomen. Een antwoord kan dus juist maar onvolledig zijn. Noteer het ontbrekende element, niet alleen een totaalcijfer.

3. Scoor juistheid en volledigheid apart
OnderdeelAkkoordAfgekeurd
JuistheidAlle feiten zijn herleidbaarMinstens één onjuist of verzonnen feit
VolledigheidVereiste grens en stap staan erinNoodzakelijke voorwaarde ontbreekt
TaalBegrijpelijk voor de doelgroepLetterlijke vertaling of onduidelijke vaktaal
OverdrachtJuiste route met contextGeen mensroute of alles opnieuw vertellen

4. Beoordeel natuurlijk Nederlands

Controleer aanspreekvorm, vakwoorden, lange zinnen en letterlijke vertalingen. Vraag of een klant de volgende stap begrijpt. Taalverbetering mag nooit een feit veranderen of een onzeker antwoord stelliger maken.

Laat bij twijfel een inhoudelijk eigenaar en een Nederlandstalige lezer onafhankelijk beoordelen. Bespreek verschillen aan de hand van bron en vooraf vastgelegde regel. Een gemiddelde score mag een kritisch fout feit niet compenseren.

5. Test onbekende vragen en overdracht

Een bruikbaar onbekend-antwoord noemt de grens, verzint niets en biedt een passende route. Test ook expliciet een klacht en een verzoek om een medewerker. De gids AI-klantenservice helpt de taakverdeling af te bakenen.

6. Werkvoorbeeld met rubric

Een fictieve set bevat twaalf vragen. Zeven antwoorden zijn juist en volledig, drie zijn juist maar onvolledig en twee bevatten een onjuist feit. Zeven plus drie plus twee is twaalf. De vooraf afgesproken regel staat geen onjuist feit toe, dus de ronde is no-go, ongeacht de nette taal.

In het werkblad staan voorbeelden voor een onbekende prijs, klacht, taalvariant en werkgebied. De spoedkosten zijn afgekeurd omdat een antwoord zonder bron wordt gegeven; de klacht slaagt pas wanneer de medewerker de oorspronkelijke vraag en reden van overdracht ontvangt.

7. Hertest en beheer de set

Vul bron en verwacht minimum vóór uitvoering in. Noteer daarna juistheid, volledigheid, taal en overdracht apart. Houd een fout open totdat zowel de oorspronkelijke vraag als minimaal één nieuwe parafrase slaagt; zo test je de regel en niet alleen één zin.

Herstel de bron of instructie, test de twee fouten opnieuw en voeg varianten toe die dezelfde grens raken. Stop als bronnen geen eigenaar hebben of kritieke fouten terugkomen. Voor de bredere proceskeuze is bedrijfsprocessen automatiseren de bestaande route. De rubric bewijst alleen de geteste set op dat moment.