Rotterdam · 51°55′N · 4°28′O · Atelier nr. 004
1 plek · start Q4 2026Klantportaal →MMXXVI
Geheugen · RAG op jouw bronnenUitleg

Een AI-assistent die antwoord geeft
uit jouw eigen documenten.

Een taalmodel weet niets over jouw retourbeleid of dossiers, dus zoekt een retrieval-laag (RAG, bij ons “Geheugen”) bij elke vraag de juiste stukken uit jouw bronnen op en geeft die aan het model mee. Een assistent op jouw bronnen antwoordt uit jouw documenten en zet de bron erbij. Dat maakt fouten zeldzaam en controleerbaar, niet onmogelijk.

OnderdelenOp jouw accounts
Index
Postgres met pgvector, EU-regio
Model
Claude of GPT via API. Wat de leverancier bewaart, leggen we per opdracht vast
Bronnen
PDF, website, FAQ, supportarchief, database
Kosten
Enkele tientjes per maand aan API bij gemiddeld volume
Doorloop
2–6 weken
Valt onder B-01 · AI-integratie · vaste prijs na gesprek
Hoe het werkt

Drie stappen, elke keer dat iemand een vraag stelt.

  1. Eenmalig, en bij elke wijziging

    Bronnen worden geïndexeerd

    Documenten, FAQ-pagina's, catalogi en supportarchieven worden opgeknipt in fragmenten en omgezet naar vectoren, een soort betekeniscoördinaten. Die staan in Postgres met pgvector op jouw account. Schaalt van honderd tot honderdduizend documenten zonder herbouw.

  2. Per vraag, in milliseconden

    De vraag wordt opgezocht

    De vraag van de klant wordt ook omgezet naar een vector en vergeleken met alle fragmenten. De paar meest relevante gaan mee als context naar het model. Niet je hele bibliotheek: dat is sneller, goedkoper, en er gaat zo min mogelijk tekst de deur uit.

  3. Per vraag, in seconden

    Het model antwoordt, met bron

    Het model krijgt de instructie om alleen uit die fragmenten te antwoorden. Bij elk antwoord staat de bron, klikbaar. Is er niets gevonden, dan zegt de assistent dat en verwijst hij door naar een mens.

Voorbeeld

Twee vragen aan dezelfde assistent.

De eerste staat in het retourbeleid, de tweede niet. Je wil van tevoren weten hoe het er in beide gevallen uitziet.

Klantenservice-assistent · vraag met dekkingBronnen: retourbeleid.pdf · verzending.md
VraagKan ik een aanbiedingsartikel na 30 dagen nog retourneren?
Zoekt2 fragmenten gevondenretourbeleid.pdf §2.1 (score 0,91) · retourbeleid.pdf §4 (score 0,84)
AntwoordRetourneren kan binnen 30 dagen na ontvangst, ook voor aanbiedingsartikelen. Na die termijn geldt alleen de wettelijke garantie bij een gebrek. Wil je dat ik een retourlabel aanmaak of je doorverbind met een collega?Bron: Retourbeleid §2.1, herzien maart 2026
NietGeen uitspraak over uitzonderingen die niet in het beleid staan.
Dezelfde assistent · vraag zonder dekkingBeste fragment onder de drempel
VraagKunnen jullie met spoed naar Curaçao sturen als ik vandaag bestel?
ZoektBeste fragment: verzending.md §1, score 0,41Onder de drempel van 0,70. Dit fragment gaat over Nederland en België.
AntwoordDat weet ik niet. Over verzending buiten Nederland en België staat niets in de documenten die ik mag gebruiken. Ik zet je vraag door naar een collega.
DoorzetVraag naar support, met de vraag en de gevonden fragmenten erbij.
LogVastgelegd als vraag zonder dekking. Komt die vaker terug, dan hoort er een bron bij.

Een assistent die bij twijfel doorzet is bruikbaarder dan een die altijd iets zegt. Waar de drempel ligt en wat er bij twijfel gebeurt, spreken we vooraf af.

Beide platen zijn voorbeelddialogen om de werking te tonen. De scores en de drempel zijn voorbeelddata, geen gemeten waarden.

1 plek · start Q4 2026

Twijfel je welke route past? In 45 minuten weet je het.

Waarom dit werkt

Vier eigenschappen die het verschil maken met 'even ChatGPT erbij'.

Antwoord uit jouw bronnen

Het model krijgt alleen fragmenten uit jouw documentatie en de instructie om daarbuiten niets te beweren. Bij elk antwoord staat de bron, zodat je het kunt nalezen.

Bronnen blijven op jouw infrastructuur

De documenten, de index en de embeddings staan in Postgres in een EU-regio, op jouw eigen account. Naar het model gaat de vraag plus de fragmenten die nodig zijn om hem te beantwoorden.

Altijd actueel

Beleid gewijzigd of voorraad veranderd? De bron wordt opnieuw geïndexeerd, in minuten. Geen hertraining van een model.

Meetbaar

Elke vraag en elk antwoord wordt gelogd met de gebruikte bronnen. Een testset met echte vragen bepaalt of het goed genoeg is voordat het live gaat.

Kwaliteit

Wat we beloven over de antwoorden, en wat niet.

Bronbinding, een testset en escalatie maken fouten zeldzaam en controleerbaar. Ze sluiten ze niet uit, en dat hoor je liever nu dan na livegang.

AfspraakWat er in de offerte komt te staan
TakenWe schrijven op welke vragen de assistent mag beantwoorden en welke niet.
TestsetEen set echte vragen uit je praktijk, met het goede antwoord erbij, beoordeeld door iemand uit je team.
OndergrensEen acceptatiegrens die vooraf vaststaat. Haalt de assistent die niet, dan gaat hij niet live.
BronnenElk antwoord wijst naar het fragment waar het vandaan komt, zodat je het kunt nalezen.
EscalatieBij twijfel of bij een vraag buiten de scope zegt de assistent dat hij het niet weet en zet hij de vraag door naar een mens.
LoggingElke vraag en elk antwoord blijft terug te zoeken, zodat je ziet waar het misging en we het kunnen bijstellen.
Wat er alsnog mis kan gaan

Waar je bij een assistent op je eigen bronnen op moet rekenen.

  • Een model kan een goed gevonden fragment nog steeds verkeerd samenvatten. Daarom de testset en de bronverwijzing.
  • Staat het antwoord niet in je documenten, dan kan de assistent het niet weten. Dan hoort er 'dat weet ik niet' te komen, geen gok.
  • Verouderde documenten geven verouderde antwoorden. Wie de bron bijwerkt, bepaalt wat de assistent zegt.
  • Juridisch, medisch of fiscaal advies laten we een mens doen. De assistent zoekt op, hij beslist niet.
Datastroom

Waar je data langskomt.

Zo loopt je data door een assistent die we bouwen. Per stap: waar het draait, wie het ziet en hoe lang het blijft staan.

StapWaar het draaitWat er heen gaatHoe lang het blijft staan
BronopslagJouw Supabase- of Postgres-project, EU-regio, op jouw eigen accountDe documenten zelfZolang jij ze bewaart. Verwijderen doe je zelf.
IndexeringEmbedding-API van OpenAI of Anthropic, EU-endpoint waar beschikbaarDe tekst van je documenten, in stukken gekniptBij een zero-retention-configuratie niet bewaard. Is die voor jouw endpoint niet beschikbaar, dan staat dat in de verwerkersovereenkomst.
Embeddingspgvector in dezelfde database als de bronopslagGetallenreeksen per fragment, geen leesbare tekstZolang de index bestaat
Vraag en antwoordClaude of GPT via APIDe vraag van de gebruiker plus de gevonden fragmentenBij zero retention niet bewaard en niet gebruikt voor training. Dit hangt af van je contract, endpoint en instellingen; we leggen de gekozen variant vast.
LoggingJouw eigen databaseVraag, antwoord, gebruikte bronnen en tijdstipStandaard 90 dagen, aanpasbaar
VerwijderenJouw accountBron, index en logsEén handeling verwijdert document, fragmenten en logregels

Zero retention, niet trainen op je data en opslag binnen de EU zijn drie verschillende dingen. Welke je krijgt, hangt af van de leverancier, het contract en het endpoint. We zetten per opdracht op papier wat er geldt.

Wil je dat er helemaal niets naar een externe API gaat, dan kan dat met een model dat op eigen infrastructuur draait. Dat is een andere opzet, met eigen kosten en een lagere antwoordkwaliteit. We noemen het apart in de offerte, niet als standaard.

Kosten

Wat het per maand kost, en waarvan dat afhangt.

VolumeAPI-kosten per maandHosting
Tot 1.000 vragenEnkele euro'sGratis of laagste tarief Supabase en Vercel
1.000 tot 10.000 vragenEnkele tientjesLaagste betaalde tarief
Meer dan 10.000 vragenOp maat, met caching en een kleiner model waar dat kanOp maat

De bouw valt onder AI-integratie: 2–6 weken, vaste prijs na een gratis gesprek. De kostenraming per maand krijg je vooraf, in de haalbaarheidscheck.

Eerst zien

Neem een echte vraag mee.
Dan laten we zien wat de assistent ermee doet.

Een map met documenten en drie vragen die je klanten echt stellen zijn genoeg voor een eerste indruk. 45 minuten, gratis. Eerstvolgende start: Q4 2026.

01Reactie binnen 24 uur
02Vaste offerte binnen 48 uur
031 plek · start Q4 2026

Laatst herzien september 2026. Kosten zijn indicaties bij gemiddeld volume; de raming voor jouw situatie volgt uit de haalbaarheidscheck.