Betrouwbare antwoorden
De assistent is op zijn scherpst in een kort, gericht gesprek over één onderwerp. Hoe langer en voller een chat wordt — veel vragen, veel documenten, meerdere onderwerpen door elkaar — hoe meer de assistent tegelijk moet overzien. Op een gegeven moment kan hij daardoor details door elkaar halen of een passage “aanvullen” die er niet letterlijk staat. Dit is geen eigenaardigheid van PrudAI: het geldt voor alle huidige AI-modellen en is meetbaar — hoe langer het gesprek, hoe groter de kans op zulke fouten.
Het goede nieuws: je hebt dit grotendeels zelf in de hand.
Start een nieuwe chat per onderwerp
Section titled “Start een nieuwe chat per onderwerp”Dit is verreweg het effectiefst. Begin een nieuwe chat voor elk nieuw onderwerp of dossieronderdeel. Een korte, gefocuste chat houdt de assistent verankerd aan precies de stukken die er voor díe vraag toe doen — en juist dat voorkomt dat hij bronnen door elkaar gaat halen.
Vuistregels:
- Nieuw onderwerp? Nieuwe chat. Ga niet in dezelfde chat door van de aansprakelijkheidsvraag naar de proceskosten naar de dagvaarding.
- Houd het aantal documenten per chat gericht — alleen wat voor die vraag relevant is, niet je hele dossier in één doorlopend gesprek.
- Merk je dat een chat “moe” wordt (antwoorden worden vager, of de assistent verwijst naar iets dat je niet herkent)? Begin opnieuw in een verse chat. Je verliest niets: je documenten en projecten blijven gewoon staan.
Controleer altijd de bron
Section titled “Controleer altijd de bron”Behandel elk antwoord als een concept. Klik op de bronvermelding onder een antwoord en lees de brontekst zelf na vóór je iets overneemt in je advies of processtuk. Zie je een verwijzing naar een document of passage die je niet herkent? Vertrouw hem niet — start een nieuwe chat en stel de vraag opnieuw met alleen het relevante stuk erbij. Meer hierover: Citaten & bronbeschikbaarheid en Chat.
Wat de assistent hoort te doen
Section titled “Wat de assistent hoort te doen”Als de assistent een document niet daadwerkelijk heeft opgehaald, hoort hij dat te zeggen — niet de inhoud ervan te raden. Merk je dat hij toch een passage citeert die niet klopt? Geef het bericht dan een 👎 met een korte toelichting. Dat signaal komt bij ons binnen en helpt ons de assistent verder aan te scherpen.
Wat het onderzoek laat zien
Section titled “Wat het onderzoek laat zien”Dit is geen PrudAI-eigenaardigheid maar een breed gedocumenteerd kenmerk van álle huidige AI-modellen:
- Lange invoer wordt minder betrouwbaar. Onafhankelijk onderzoek testte 18 toonaangevende modellen van verschillende aanbieders en vond dat de prestaties stelselmatig teruglopen naarmate de invoer langer wordt — óók bij eenvoudige taken.
- Informatie in het “midden” wordt slechter benut. Modellen gebruiken informatie aan het begin en eind van een lange context beter dan informatie die in het midden verstopt zit.
- Lange gesprekken versterken dit. Over meerdere beurten zakt de nauwkeurigheid gemiddeld met ongeveer 39% vergeleken met één gerichte vraag. Een belangrijke oorzaak: als een model iets mist, “vult” het dat soms in met een aanname en houdt het daar daarna aan vast — precies het patroon dat je wilt voorkomen.
Dit is meteen waaróm “nieuwe chat per onderwerp” werkt: je houdt de context kort, zodat het model niet in dit patroon terechtkomt.
Verder lezen
Section titled “Verder lezen”- Kelly Hong, Anton Troynikov, Jeff Huber — Context Rot: How Increasing Input Tokens Impacts LLM Performance (Chroma, 2025).
- Nelson F. Liu e.a. — Lost in the Middle: How Language Models Use Long Contexts (TACL, 2024).
- Philippe Laban, Hiroaki Hayashi, Yingbo Zhou, Jennifer Neville — LLMs Get Lost in Multi-Turn Conversation (2025).
- Lei Huang e.a. — A Survey on Hallucination in Large Language Models (2023).