NL
Taal · dezelfde pagina NLNederlands/ai-geheugen-tussen-chats/ ENEnglish (UK)nog niet vertaald ESEspañolnog niet vertaald We onthouden je keuze niet en sturen je nooit automatisch door.
DOC.K · KENNISBANK

AI die niets vergeet tussen chats: hoe een AI-brein werkt.

Iedereen die dagelijks met AI werkt kent het: je legt vanochtend in ChatGPT uit hoe je bedrijf werkt, en vanmiddag begint Claude gewoon weer bij nul. Elke chat start leeg, je context is kwijt en jij typt dezelfde uitleg voor de derde keer. Dit artikel legt uit waarom dat zo is, wat de geheugenfuncties van ChatGPT en Claude inmiddels wel kunnen, waar ze ophouden, en hoe een extern AI-brein het geheugen buiten de tools zet zodat elke AI uit dezelfde kennis werkt. Met aan het slot wat Jarvis, ons eigen AI bedrijfsbrein, daar concreet in doet.

Begin gratis met het sjabloon Bekijk Jarvis het sjabloon is een bestand, geen account
Gianluca, die het AI-brein bouwt waar ChatGPT, Claude en Codex uit werken
beeld · wie het brein bouwt, typt zijn uitleg ook niet drie keer
Download de sessie-geheugen skill ↓2.9 KB · zip met SKILL.md · MIT-licentie · geen account nodig · geeft je AI een werkgeheugen tussen sessies via een geheugenbestand met statussen, datums en eigenaren
CLAUDE CODE
  1. Pak de zip uit in ~/.claude/skills/ (of .claude/skills/ in je project).
  2. Claude herkent de skill daarna vanzelf zodra je vraagt om iets te onthouden of op te slaan.
  3. Direct aanroepen kan ook, met /sessie-geheugen.
CLAUDE.AI
  1. Ga naar Customize en dan Skills.
  2. Upload de zip daar als skill.
  3. Of plak de inhoud van SKILL.md in de projectinstructies van een Project.
CODEX
  1. Open AGENTS.md in je repo.
  2. Plak de inhoud van SKILL.md erin, of zet SKILL.md er als los bestand naast en verwijs ernaar vanuit AGENTS.md.
  3. Codex leest dat bij elke sessie mee.
Sectie 01 · Het probleem

Elke chat begint leeg, en dat is het ontwerp

Een taalmodel voelt als een gesprekspartner met een geheugen, maar technisch is het een rekenmachine zonder verleden. Wat het model lijkt te onthouden, staat in het gesprek zelf: bij elke beurt stuurt de tool de hele chat opnieuw mee, en het model leest alles vanaf nul. Het onderstaande logboek laat zien wat dat betekent, beurt voor beurt.

FIG.01: Wat het model elke beurt werkelijk leestblad 1/4
context.log · een gesprek van binnenschematisch voorbeeld, geen meting
BEURT 01Het model leest de systeeminstructies plus je eerste vraag, antwoordt, en onthoudt daarna niets. Het antwoord staat alleen nog in de chat.enkele honderden tokens
BEURT 08De tool stuurt het hele gesprek tot nu toe opnieuw mee, plus je nieuwe vraag. Het model leest alles weer vanaf nul, elke beurt opnieuw.duizenden tokens
BEURT 25Het contextvenster raakt vol. De oudste berichten vallen er stil uit, en het model spreekt zichzelf tegen over iets van een uur geleden.venster loopt vol
NIEUWE CHATNiets van gisteren, niets van je collega, niets van je andere tool. Alles wat niet opnieuw wordt aangeleverd, bestaat niet.0 kennis van jouw bedrijf
Dit is geen fout maar het ontwerp. Een taalmodel is staatloos: het venster is werkgeheugen voor één gesprek, geen archief. Elke oplossing voor het geheugenprobleem draait er daarom om wat je buiten de chat bewaart en hoe dat er per beurt weer in komt.
0G.01 · wat een nieuwe AI-sessie standaard van jouw bedrijf weet
3G.02 · grenzen waar je kennis op stukloopt: sessie, tool en collega
18G.03 · modellen in het Chroma-onderzoek, allemaal minder precies bij langere invoer
10MG.04 · tokens in de grootste geadverteerde contextvensters van 2026, en nog steeds geen geheugen
G.01 en G.02 beschrijven het ontwerp van taalmodellen. G.03 komt uit het onderzoek Context Rot van Chroma, juli 2025. G.04 is een publiek gedocumenteerde eigenschap van de grootste modellen van dit moment. Geen van de vier is een klantresultaat van ons.
$ cat 01-contextvenster.md # waarom groter niet genoeg is
DOC.01

Waarom een groter contextvenster het niet oplost

De eerste reflex is begrijpelijk: als het venster te klein is, maak het dan groter. En dat is precies wat er gebeurd is. Gangbare modellen zitten rond de 200.000 tokens, een groeiende groep haalt een miljoen en de grootste geadverteerde vensters van 2026 staan op tien miljoen. Dat is ruwweg een boekenplank aan tekst in één gesprek. Probleem opgelost, zou je denken.

Toch niet, om drie redenen

Om te beginnen: een venster start leeg, hoe groot het ook is. Een miljoen tokens capaciteit betekent niet dat er iets in staat: jij moet die context nog steeds elke nieuwe chat aanleveren, en je collega ook, en morgen weer. Een groter venster maakt het opnieuw uitleggen ruimer, niet overbodig. Ruimte is geen geheugen.

De tweede reden is dat modellen aantoonbaar slechter worden naarmate je er meer in stopt

Onderzoekers van Chroma testten in de zomer van 2025 achttien bekende modellen, waaronder versies van GPT, Claude en Gemini, en zagen bij allemaal hetzelfde patroon: hoe langer de invoer, hoe lager de betrouwbaarheid, zelfs bij simpele opdrachten als iets terugzoeken in de tekst. Die verslechtering begint ruim voordat het venster vol is. Zij noemen het context rot, en het is de reden dat alles in de chat proppen een slechtere strategie is dan gericht ophalen wat relevant is.

De derde reden is nuchter: kosten en snelheid

Het model leest bij elke beurt de volledige meegezonden context opnieuw. Wie standaard honderdduizenden tokens meestuurt, betaalt daarvoor in wachttijd en, bij gebruik via een koppeling, letterlijk per token. Een gesprek dat alles bevat wordt traag en duur, en het antwoord wordt er dus niet beter van.

De conclusie staat haaks op de reflex: het geheugenprobleem los je niet op met een groter venster, maar met een kleinere, slimmere aanvoer

Bewaar de kennis buiten de chat, en haal per vraag alleen de stukken op die ertoe doen. Dat principe heet retrieval, en het is de basis onder elk serieus AI-geheugen, van de eenvoudigste tot de werking van een volwaardig organisatiebrein. Hoe wij die machinekamer breder inzetten, staat op de AI-hoofdpagina.

venster · schematisch, geen meting
theseo ~ %
meer tokens: dezelfde chat, alleen langer
na de sessie: alles weg, ook het grote venster
grootte lost geen geheugen op
geheugen buiten de chat: blijft staan
Sectie 02 · De eerlijke tussenstand

Wat ChatGPT en Claude zelf al onthouden

De makers zitten niet stil, en wie beweert dat AI-tools niets onthouden is niet eerlijk. ChatGPT en Claude hebben allebei een geheugenfunctie gekregen die voor persoonlijk gebruik echt werkt. De vraag is niet of die functies deugen, maar wat ze dekken. Dat verschil staat hieronder, per behoefte.

FIG.02: Wat gedekt is, en door wieblad 2/4
geheugen-dekking.logtussenstand medio 2026
BEHOEFTETOOLGEHEUGENEXTERN BREIN
Jouw voorkeuren en stijltoon, vaste instructies, hoe jij aangesproken wilt wordenJAJA
Wat er eerder is besprokenterugverwijzen naar eerdere chats in dezelfde toolDEELSJA
Zelfde kennis in ChatGPT én Claudeéén waarheid, welke tool je ook opentNEEJA
Gedeeld met je collega'swat jij vastlegt, weet het hele teamNEEJA
Wie keurde wat goedstatus, versie, eigenaar en datum per afspraakNEEJA
Zo lees je dit. De JA in de linkerkolom is echt: voor één persoon in één tool is het ingebouwde geheugen goed geworden. De drie keer NEE eronder zijn geen achterstand die de makers nog even wegwerken, maar een grens van het model: het geheugen van een tool hoort bij een account, en jouw bedrijf is geen account.
DOC.02
Sectie 03 · De oplossing

Draai het om: het geheugen buiten de tools

De structurele oplossing is verrassend simpel te tekenen. Haal het geheugen weg uit de losse tools en zet het op één plek ernaast, in een vorm die elke AI kan lezen. De tools blijven wat ze zijn, jouw abonnementen blijven staan, maar de kennis heeft nog maar één huis. Zo ziet dat eruit.

FIG.03: Eén brein, drie tools, dezelfde waarheidblad 3/4
TOOL · CHATGPTVraagt per opdracht de relevante context op en werkt daarmee, in plaats van met een eigen half geheugen.
TOOL · CLAUDELeest dezelfde items als ChatGPT. Wisselen van model betekent niet langer opnieuw beginnen.
TOOL · CODEXOok je code-AI kent de klantnamen, afspraken en conventies die in het brein staan.
HET BREINelk stuk kennis met status · versie · eigenaar · scope · geldigheid, leesbaar voor mens en machine
MENSENLeggen kennis vast en geven akkoord. Zonder akkoord wordt een voorstel nooit geheugen.
BRONNENDocumenten en systemen waar kennis vandaan komt, met herkomst per item.
LOGBOEKWie legde wat vast, wie keurde het goed, wat verving het. Alles terug te lezen.
De pijlen lopen twee kanten op. Tools lezen context uit het brein, en goedgekeurde uitkomsten worden er weer in vastgelegd. Zo groeit het geheugen met het werk mee, in plaats van in tientallen losse chats te verdampen.
DOC.03

Hoe een extern AI-brein technisch werkt

Onder de motorkap rust dit op twee bouwstenen die allebei volwassen zijn. De eerste is retrieval: in plaats van alle kennis in de chat te zetten, wordt per vraag opgezocht welke stukken relevant zijn, en gaan alleen die stukken het contextvenster in. Dit patroon, bekend als retrieval augmented generation, werd in 2020 door onderzoekers beschreven en is sindsdien de standaardmanier om taalmodellen met externe kennis te laten werken. Het lost twee problemen tegelijk op: het venster blijft klein en scherp, wat context rot vermijdt, en de kennis kan worden bijgewerkt zonder dat er een model voor hoeft te worden hertraind.

De tweede bouwsteen is de gedeelde stekker

Jarenlang was de praktische horde dat elke AI-tool zijn eigen koppelingen had: wat je voor de ene bouwde, werkte niet in de andere. Dat is gekanteld. In november 2024 bracht Anthropic het Model Context Protocol uit als open standaard voor het verbinden van AI-tools met externe bronnen. OpenAI nam het in maart 2025 over, Google volgde in april 2025, en eind 2025 is het beheer ondergebracht bij de Linux Foundation. Voor het geheugenvraagstuk betekent dit iets wezenlijks: één brein kan nu via één standaard door ChatGPT, Claude en Codex tegelijk worden gelezen. Wij draaien er zelf ook een: de MCP-server van TheSEO.

Maar techniek is maar de helft van het verhaal, en de minst spannende helft

Het verschil tussen een doorzoekbare berg tekst en een geheugen dat je kunt vertrouwen, zit in metadata. Een zoekmachine over je documenten vindt elke versie van je tarieven, inclusief de drie verouderde. Een brein hoort te weten welke versie geldt, sinds wanneer, voor wie, en wie dat heeft bepaald.

Daarom heeft in een goed ingericht organisatiebrein elk stuk kennis een status, zoals voorstel, besluit of blijvende kennis, plus een eigenaar, een herkomst, een geldigheid en een versie. En daarom is er een grens aan wat er zichtbaar is: kennis hoort bij een scope, en een rol die er niets mee te maken heeft, krijgt hem ook niet te zien. Ophalen is bij een serieus brein dus ook autoriseren.

Wil je dit principe eerst voelen zonder er iets voor te installeren, begin dan bij het gratis bedrijfsbrein-sjabloon

Één invulbaar bestand dat je aan elke AI-tool meegeeft, de handmatige voorloper van alles hierboven. En de skill bij dit artikel bouwt daar een werkgeheugen omheen dat tussen sessies blijft staan. Allebei gratis, allebei zonder account, en allebei met dezelfde eerlijke grens: zodra meerdere mensen erin gaan schrijven, heb je geen bestand meer nodig maar een systeem.

retrieval · schematisch voorbeeld
theseo ~ %
gevonden: 1 item · bron: voorwaarden v3
scope: projecten · eigenaar: de eigenaar
meegegeven: dit item, niet het hele brein
hetzelfde antwoord in ChatGPT, Claude en Codex
Sectie 04 · De uitvoering

Wat Jarvis daar concreet in doet

Jarvis is onze uitvoering van het externe brein: de ene plek waar kennis, taken en besluiten van je organisatie blijven staan, waaruit ChatGPT, Claude en Codex allemaal gaan werken, en waar een mens akkoord geeft voordat er iets naar buiten gaat. De figuur hieronder volgt één stuk kennis door dat systeem, van vastleggen tot vervallen.

FIG.04: De levensloop van één geheugenitemblad 4/4
FASE 01 · VASTLEGGEN Kennis komt binnen met paspoort Een afspraak, tarief of werkwijze wordt een item met bron, eigenaar, versie en scope. Geen los tekstje in een chat, maar een controleerbaar stuk geheugen.
FASE 02 · GELDEN Een mens maakt er waarheid van Een voorstel blijft voorstel tot iemand met de juiste rol akkoord geeft. Pas dan wordt het een besluit waar AI mee mag werken, en het akkoord staat in het logboek.
FASE 03 · VOEDEN Elke AI leest dezelfde versie ChatGPT, Claude en Codex halen per opdracht de context op die bij hun rol en scope past. Retrieval is ook autorisatie: wat er niet toe doet, blijft buiten beeld.
FASE 04 · VERVALLEN Niets verdwijnt stilletjes Verandert een afspraak, dan vervangt een nieuw item het oude. Het oude blijft terug te lezen, met de reden erbij. Zo weet je altijd waarom iets ooit anders was.
Eerlijk over de stand: Jarvis staat online als preview met fictieve voorbeelddata. De interactieve demo werkt zonder account, betaling en productieprovisioning staan achter release gates en gaan open zodra alles end-to-end getest is. Wat er al te zien is, vind je op de Jarvis-hub.
DOC.04
$ cat 05-zelf-beginnen.md # vandaag, zonder software
DOC.05

Zelf beginnen, vandaag, in vier stappen

Je hoeft niet te wachten op software om het geheugenprobleem kleiner te maken. Stap één: zet de basiskennis van je bedrijf in één bestand. Wat je levert, voor wie, je toon, je tarieven voor zover die vast zijn, je vaste werkwijze. Het bedrijfsbrein-sjabloon is daar de gratis, invulbare vorm van. Geef dat bestand mee aan elke AI-sessie, en het domste heruitleggen is voorbij.

Stap twee: zet de geheugenfuncties van je tools bewust aan of uit, in plaats van ze te laten aanstaan zonder plan

Vul de vaste instructies serieus in, gebruik projecten om klanten te scheiden, en gebruik de tijdelijke of incognito-chat voor wat nergens mag landen. Het toolgeheugen is een prima laag voor persoonlijke voorkeuren, zolang je er geen bedrijfswaarheid aan toevertrouwt die je collega ook nodig heeft.

Stap drie: geef je sessies een werkgeheugen met de skill bij dit artikel

Die laat je AI bij elke afronding vastleggen wat er is besloten, met datum, eigenaar en status, en bij elke start teruglezen waar je was gebleven. Het is de handmatige versie van de cyclus die Jarvis automatiseert, en je merkt binnen een week of het principe je bevalt.

Stap vier: loop je tegen de grens aan waar meerdere mensen in hetzelfde geheugen moeten schrijven, kijk dan naar Jarvis of plan een gesprek via de contactpagina. Meer lezen kan ook: in de kennisbank staat alles wat we weten, met als logische vervolgstappen gevonden worden in AI-antwoorden en agentic commerce, waar hetzelfde thema terugkomt: de AI kan alleen werken met wat hij kan lezen.

DOC.06 · FAQ

Veelgestelde vragen

Waarom begint elke chat met ChatGPT of Claude leeg?

Omdat een taalmodel staatloos is. Het model onthoudt zelf niets tussen twee gesprekken: alles wat het lijkt te weten staat in de chat zelf, en die wordt elke beurt opnieuw meegestuurd. Sluit je het gesprek af of open je een andere tool, dan is die context weg. Wat je vanochtend aan ChatGPT uitlegde, bestaat voor Claude vanmiddag niet. Dat is geen fout van de tools maar het ontwerp van de techniek, en precies daarom is een geheugen buiten de tools nodig.

ChatGPT heeft toch al een geheugen?

Klopt, en dat werkt voor persoonlijk gebruik best goed. ChatGPT kan herinneringen opslaan en verwijst sinds april 2025 ook naar je eerdere chats; sinds juni 2025 heeft de gratis versie daar een lichte variant van. Claude kreeg in 2025 vergelijkbare functies. Maar dat geheugen leeft per account en per tool. Het verhuist niet mee naar Claude of Codex, je collega heeft er niets aan, en niemand kan nazien welke versie van een afspraak geldt. Voor een bedrijf met meerdere mensen en meerdere tools is dat de kern van het probleem.

Is een groter contextvenster niet gewoon de oplossing?

Nee. Een miljoen tokens is in 2026 de brede middenmoot en de grootste geadverteerde vensters staan op tien miljoen, maar een vol venster is geen geheugen: het is een langere aanloop die je bij elke nieuwe chat opnieuw moet aanleveren. Bovendien blijkt uit het Context Rot onderzoek van Chroma uit 2025, over achttien bekende modellen, dat de prestaties dalen naarmate de invoer langer wordt, ook bij simpele taken en ruim voordat het venster vol is. Meer tekst in de chat proppen maakt het antwoord dus niet beter. Gericht de juiste stukken kennis ophalen werkt wel.

Wat is een extern AI-brein of organisatiebrein?

Een vaste plek buiten je AI-tools waar de kennis van je bedrijf staat: hoe je werkt, wat je afspreekt, welke besluiten er zijn genomen en wie ze heeft goedgekeurd. Elke AI-tool haalt daar per vraag de relevante context op, in plaats van dat jij alles opnieuw uitlegt. Het verschil met een map documenten zit in de metadata: elk item heeft een status, een versie, een eigenaar en een geldigheid, zodat een AI niet alleen tekst vindt maar ook weet wat er nu geldt. Jarvis is onze uitvoering van dat idee.

Werkt zo'n brein echt met ChatGPT, Claude en Codex tegelijk?

Ja, en dat is technisch geen kunstgreep meer. Sinds Anthropic in november 2024 het Model Context Protocol als open standaard uitbracht, en OpenAI en Google het in 2025 overnamen, bestaat er een gedeelde stekker waarmee AI-tools externe bronnen kunnen lezen. Eind 2025 is het beheer ondergebracht bij de Linux Foundation. Een brein dat die standaard spreekt, kan dus dezelfde kennis aan ChatGPT, Claude en Codex geven. Je wisselt van model wanneer je wilt, en je geheugen verhuist gewoon mee.

Wat kost dit, en kan ik klein beginnen?

Klein beginnen is gratis. Het bedrijfsbrein-sjabloon is een invulbaar bestand dat je aan elke AI-tool meegeeft, en de skill bij dit artikel geeft je AI een werkgeheugen tussen sessies, zonder account. De interactieve demo van Jarvis werkt ook zonder registratie. Jarvis zelf heeft vaste plannen per organisatie: je betaalt voor je brein, niet per AI-vraag of per gebruiker een meter. De actuele plannen staan op de prijzenpagina van Jarvis. En wil je het liever laten inrichten, dan zet onze AI-medewerker het voor je neer.

DOC.07 · Volgende stap

Stop met heruitleggen, begin met vastleggen

Het geheugenprobleem van AI is geen gebrek aan slimheid maar een gebrek aan plek: er is in de standaardopstelling simpelweg nergens waar jouw bedrijfskennis thuishoort. Wie die plek maakt, met een sjabloon, een skill of een volwaardig brein, merkt het verschil in elke sessie daarna. Begin klein en gratis, en groei pas door als de grens zich meldt. En wil je liever eerst hardop denken over wat dit voor jouw organisatie betekent, dan doen we dat gewoon in een gesprek. Meer over wie dit bouwt lees je bij over ons.

Sectie · Volgende stap24/7 bereikbaar · sales@theseo.nl
Plan een gesprek
Geschreven door GianlucaOprichter. Bouwt sinds 2017 aan vindbaarheid voor Nederlandse bedrijven, in Google en in AI-antwoorden. Meer over het instituut.