Waar hij van kan leren
| Bron | Wat hij leest |
|---|---|
| Je website | Elke pagina die de crawler bereikt via je links, of precies de pagina's in je sitemap, of één pagina tegelijk |
| PDF's op je site | De PDF's waarnaar je pagina's linken, gelezen tijdens de crawl, zodat de agent ernaar kan linken |
| Bestanden | PDF-, Word- (DOCX), TXT- en Markdown-bestanden die je uploadt |
| Tekst | Alles wat je typt of plakt: openingsuren, een beleid, een prijslijst |
| Vraag & antwoord | Een vraag en het exacte antwoord dat je erop wilt geven |
Je hoeft niets voor te bereiden. De tekst wordt eruit gehaald, in passages geknipt en doorzoekbaar gemaakt, meestal binnen enkele seconden. Een crawl volgt je robots.txt, leest één pagina tegelijk en voert geen JavaScript uit, dus een pagina waarvan de tekst pas na een script verschijnt, wordt zonder die tekst gelezen. Websites en Bestanden hebben de details.
Trainen zonder fine-tuning
"Trainen" verandert hier het model niet. Stelt een bezoeker een vraag, dan zoekt de agent in je bronnen de passages die erop antwoorden, op betekenis en op de exacte woorden (een productcode, een naam), en het model schrijft het antwoord alleen uit die passages. Dat heeft drie gevolgen die ertoe doen:
- Wijzigingen tellen meteen. Pas een pagina aan en laat ze opnieuw lezen, en het volgende antwoord gebruikt de nieuwe tekst.
- Hij verzint niets. Staat het antwoord niet in je content, dan zegt de agent dat, of vraagt hij wat de bezoeker bedoelt, in plaats van te gokken.
- Je kunt elk antwoord controleren. In Activiteit en de Testomgeving toont elk antwoord de pagina's waarop het steunt. Je bezoekers zien het antwoord, met een link als het uit een PDF op je site komt.
Op het Agency-abonnement wordt je site elke 7 dagen vanzelf opnieuw gelezen, zodat prijzen, openingsuren en nieuwe PDF's bij de agent komen zonder dat je eraan hoeft te denken.
Weten wat hij niet weet
Elk antwoord heeft een betrouwbaarheidsscore: hoe zeker de zoekopdracht was dat je content het antwoord bevatte, gemeten voordat er één woord geschreven is. Zekere antwoorden krijgen ook een onderbouwingscontrole, een tweede mening die het antwoord naast de passages legt en zegt of ze het ondersteunen. De antwoorden die laag scoorden, staan in het Overzicht met wat er ontbrak, en vanuit die lijst voeg je het juiste antwoord toe als vraag-antwoordpaar. Die lijst is de snelste weg naar een betere chatbot: het is een lijst van wat je bezoekers vroegen en je content niet zei. Zwakke antwoorden verbeteren.
Waarom niet gewoon ChatGPT op je eigen data?
Een custom GPT leeft in ChatGPT: je kunt hem niet op je eigen website zetten, en wie hem gebruikt, heeft een ChatGPT-account nodig. Zelf een chatbot bouwen op de API van een model kan, en betekent dat je de zoekfunctie, de widget, de talen en het bijhouden van gesprekken zelf schrijft. ChatterLab is dat werk, al gedaan: je bronnen erin, een widget eruit, met de bronnen en de betrouwbaarheid van elk antwoord voor je neus, en de gegevens in de EU.
Vragen over een chatbot trainen
Hoe lang duurt het om een chatbot op mijn website te trainen?
Voor de meeste sites een paar minuten. De crawler leest één pagina tegelijk met een korte pauze ertussen, dus een site van een paar honderd pagina's duurt iets langer. Bestanden zijn meestal binnen enkele seconden klaar.
Kan hij gescande PDF's lezen?
Nee. Een scan is een foto van tekst, en bronnen worden niet met tekstherkenning gelezen. Zo'n bestand wordt als mislukt gemarkeerd. Haal het eerst door OCR, of plak de tekst erin als tekstbron.
Moet ik kunnen programmeren?
Nee. Bronnen toevoegen, testen en de stijl kiezen doe je in het dashboard. De chat op je site zetten is één scripttag die je kopieert en plakt.
Worden mijn gegevens gebruikt om AI-modellen te trainen?
Nee. Wij trainen geen modellen op je content of de gesprekken van je bezoekers, en ook OpenAI, dat je tekst omzet naar zoekvectoren, traint er niet op.
Wat als mijn content in een andere taal is dan die van mijn bezoekers?
De zoekfunctie werkt op betekenis, dus een Franse vraag vindt een Nederlandse pagina, en de agent antwoordt in het Frans. Voor een markt die ertoe doet, geven bronnen in de taal van die markt nog altijd de beste antwoorden.