Een kennisbank die agents onderhouden, overleeft zodra u stopt de bibliothecaris te zijn. Mijn LLM-wiki bereikte in 3 maanden 490 pagina's, en dat houdt stand dankzij drie beslissingen: agents beheren de gecompileerde laag, elke interactie loopt via een van zes benoemde operaties, en een linter met 20 controles blokkeert elke commit die onder de lat blijft. Vrijwel geen van die pagina's schreef ik met de hand.
Handmatig gebouwde second brains sterven steeds dezelfde dood: de waarde zit in het onderhoud, en dat onderhoud stopt net na week drie. Wie een kerkhof vol verlaten Notion-werkruimtes bezit, kent het patroon. Coding agents halen die kost weg, want ze vervelen zich nooit en repareren op een dinsdagavond zonder klagen 40 kapotte links. De gids voor de AI-kennislaag beschrijft hoe u er een bouwt in 20 minuten; dit is het rapport over het draaien ervan op 490 pagina's, met 3 maanden wekelijkse statusdata en de mislukkingen inbegrepen.
- Scheid eigenaarschap als eerste. Eén laag houdt u zelf bij voor bronnen, één laag beheren agents voor gecompileerde pagina's, kennis stroomt één kant op. Deze ene beslissing maakt onderhoud overdraagbaar.
- Een gesloten set operaties wint van improvisatie. Zes benoemde operaties (Ingest, Update, Query, Lint, Enrich, Reorganize) voorkomen dat agents elke sessie een nieuwe workflow verzinnen.
- Deterministische poorten verslaan geschreven richtlijnen. Agents respecteren een falende controle en glijden weg van regels in lopende tekst. Een linter van 1.671 regels met 20 controles draait bij elke commit.
- Een gezonde kennisbank krimpt soms. De twee weken waarin het aantal pagina's daalde waren consolidatieslagen, en het waren de gezondste weken in het logboek.
- Elke regel moet herleidbaar zijn tot een mislukking. Het regelboek van 246 regels groeide als een changelog van dingen die misgingen, en daarom volgen agents het op.
Eigenaarschap scheiden gaat voor alles
De vault staat in Obsidian, opgesplitst in twee lagen, en alles hier is toepasbaar op elke map met markdown. De laag raw is van mij: 341 opgeslagen artikelen, 20 transcripten, notities en dagboekaantekeningen die agents lezen maar nooit herschrijven. De laag wiki is van de agents: elke pagina wordt door hen gegenereerd en onderhouden, en correcties verlopen via een gesprek in plaats van met de hand. Kennis stroomt één kant op, van raw naar wiki, nooit terug.
Deze scheiding maakt onderhoud overdraagbaar. Wanneer menselijke notities en agentnotities hetzelfde bestand delen, kan elke bewerking van een agent iets overschrijven dat u bedoelde, waardoor u alles moet controleren, oftewel opnieuw de bibliothecaris spelen. Scheid de lagen en de controle krimpt tot één vraag: is het gecompileerde begrip trouw aan de bronnen?
Diezelfde eigenaarschapsvraag bepaalt of een bedrijfskennisbank werkt. Uitzoeken welke pagina welk feit bezit, is ook de eerste oefening in de AI-audit- en adviessprint van webvise, want een automatisering gebouwd op tegenstrijdige documenten automatiseert de tegenstrijdigheid.
De regels staan in bestanden, en elke regel is herleidbaar tot een mislukking
Alles wat de agents over de vault weten, komt uit bestanden die erin staan. AGENTS.md in de root is de grondwet: 246 regels die de mappenstructuur, de paginasjabloon, de bronregels en het indexsysteem beschrijven. CLAUDE.md ernaast is één regel, een shim die ervoor zorgt dat Claude Code hetzelfde bestand laadt dat Codex en elke andere AGENTS.md-bewuste tool leest.
- Geen verzinsels. Elke bewering is herleidbaar tot een bron of wordt gemarkeerd als niet-geverifieerd.
- Een chat is geen bron. Een opgeschoond fragment wordt eerst als bestand opgeslagen, en dat bestand wordt vervolgens geciteerd. "De gebruiker zei het in de chat" is een citaat dat u nooit meer kunt heropenen.
- Eén eigenaarpagina per vluchtig feit. Elke andere pagina linkt ernaar in plaats van het te kopiëren.
- Elke vermelding van een bekende entiteit is een link. Een feit zonder link is onzichtbaar voor de graaf en voor retrieval.
Niets hiervan kwam uit een van tevoren ontworpen governance-model. Op een ochtend bleken instructiebestanden leeggeveegd tot 0 bytes, dus verhuisde de vault van bestandssynchronisatie naar een git-repo met een commit-poort. Onherleidbare chat-citaten bleven opduiken in bronlijsten, dus chats werden verbannen als bron, en CRM-achtige records begonnen kennispagina's te vervuilen, dus records verhuisden volledig uit de vault. Schrijf de regel in de week dat het ontbreken ervan u iets kost, en sla de 50 speculatieve regels over.
Zes operaties en verder niets
Een agent met een vault en zonder gedefinieerde operaties verzint elke sessie een nieuwe workflow. De ene dag voegt het duplicaten samen, de volgende dag maakt het ze juist aan, en beide keren kan het zich verantwoorden. Daarom loopt elke interactie via een van zes operaties, elk vastgelegd als een skill-bestand dat elke agent-tool laadt.
| Operatie | Trigger | Wat het doet |
|---|---|---|
| Ingest | Nieuwe bestanden komen in de raw-laag terecht | Compileert bronnen tot wiki-pagina's, dedupliceert tegen bestaande pagina's |
| Update | "File this" | Past een genoemd feit toe op zijn ene eigenaarpagina |
| Query | "What is in the wiki on X" | Zoekt eerst in de index, antwoordt met bronvermeldingen |
| Lint | Wekelijks, of op aanvraag | Tweelaagse integriteitscontrole, mechanisch plus semantisch |
| Enrich | "Complete this page" | Vult hiaten aan met bronnen, repo's en webonderzoek |
| Reorganize | "Split this", "merge these" | Structurele verplaatsingen met een uitgewerkt plan en bevestiging |
De vangrails binnen de operaties doen meer dan de lijst zelf. Ingest behandelt instructies die in opgeslagen artikelen zijn ingebed als onvertrouwde inhoud, want een leeslijst is een aanvalsoppervlak: een artikel dat zegt "negeer uw vorige instructies" wordt opgeslagen als een artikel dat dat zegt, en niets van wat een artikel zegt kan in dezelfde stap schemawijzigingen autoriseren. Query kent een harde ondergrens: de agent mag pas beweren dat de vault informatie mist nadat een volledige tekstzoekopdracht niets oplevert, want anders wordt "de index toonde het niet" "het bestaat niet". Reorganize vereist een volledige oud-naar-nieuw bestandsmapping en expliciete bevestiging voordat er iets verplaatst wordt.
Een deterministische poort onder het model
Agents respecteren een falende poort en glijden weg van een geschreven richtlijn. U kunt "houd indexen synchroon" in een regelboek schrijven en zien hoe dat binnen een week vervalt, of u kunt een niet-gesynchroniseerde index een controle laten falen die de commit blokkeert, waarna het probleem permanent verdwijnt.
Mijn poort is een Python-linter van 1.671 regels, uitsluitend standaardbibliotheek, 20 controles, ongeveer 2 seconden per volledige run. Structurele problemen zijn fouten: kapotte wikilinks, misvormde frontmatter, indexvermeldingen die naar niet meer bestaande bestanden verwijzen. Driftproblemen zijn waarschuwingen: verweesde pagina's, indextellingen die niet meer kloppen met de werkelijkheid, pagina's die 90 dagen onaangeroerd bleven. Een pre-commit hook van 13 regels draait de linter in strikte modus, waarin ook waarschuwingen de commit blokkeren, zodat niets onder de lat de git-geschiedenis binnenkomt.
De poort leest alles, ook teksten over de poort zelf. Tijdens het schrijven van de lange versie van dit rapport op 2026-07-21 schreef ik als voorbeeld een Duitse deadline-uitdrukking voluit, en de linter interpreteerde die als een verstreken deadline in het artikel. Een voorbeeldcitaatstempel werd geregistreerd als een bron die in de bronlijst ontbrak. Beide passages moesten herschreven worden voordat de commit doorging.
| Taak | Zit in |
|---|---|
| Links, aantallen, naamgeving, datums, bestaan | Script |
| Tegenstrijdigheden, oordeel over veroudering, samenvoegbeslissingen | Model |
| Smaak, prioriteiten, wat sneuvelt | Ik |
Drie maanden bijstellen liepen uit op één richting: zodra een oordeel een controle kon worden, werd het een controle. Bij elke stap daalden de kosten en steeg de betrouwbaarheid. Het model is de duurste en minst herhaalbare component in het systeem, dus wordt het uitsluitend ingezet voor oordeelsvorming.
Wat de cijfers zeggen na 3 maanden
De wekelijkse rapporten tonen 188 pagina's half april, 279 begin mei, een daling naar 263 na een consolidatieslag, een stijging naar 479 begin juli, en dan een daling naar 430 voordat eind juli de 490 werd bereikt. De twee krimpmomenten waren de gezondste weken in het logboek, omdat ze dunne en dubbele pagina's samenvoegden bij hun eigenaars. Een kennisbank zonder onderhoud groeit alleen maar. Als uw paginatelling nooit is gedaald, onderhoudt niemand de tuin.
Een volledige vault-audit op 2026-06-22 vond één prijstabel die op 4 verschillende pagina's herhaald stond en het verhaal van één project dat 3 keer op alineahoogte verteld werd. Elke kopie klopte op het moment van schrijven, en elke kopie werd een toekomstige leugen, omdat de volgende wijziging er één zou raken en de rest zou missen. De oplossing lag in eigenaarschap in plaats van samenvoegen: een register wijst precies één eigenaarpagina aan per vluchtig feit, en kleine pagina's met één onderwerp blijven klein omdat die vorm het best presteert bij retrieval. Dezelfde audit vond nul harde feitelijke tegenstrijdigheden over ruim 400 pagina's, omdat de structuur tegenstrijdigheden nergens een plek geeft.
De evaluatiemethode die het overnemen waard is, is een scorekaart in plaats van een grafiekweergave. Schrijf de 15 vragen op die de kennisbank het meest moet kunnen beantwoorden, stel ze onvoorbereid, en beoordeel elk antwoord als eenduidig-helder of verspreid. Bij mij kwamen er 13 eenduidig-helder uit, en de 2 die verspreid waren gingen beide over smaak, die leeft in beslissingen die nooit zijn opgeschreven. Of het systeem echte vragen in één stap beantwoordt, is de metriek.
De lopende kost bedraagt 5 minuten per dag plus één agentsessie van 30 tot 45 minuten op zondag, en de repo telt 880 commits sinds mei.
Wat nog steeds kapot is
Retrievalkwaliteit is een gok, en die blijft open. De agent vindt altijd wel een aannemelijke pagina, en fout-maar-aannemelijk is erger dan een misser, want niets oogt kapot. Mijn werkstandpunt: onder ruwweg 10.000 pagina's is trefwoordzoeken over goed gestructureerde markdown de juiste maat, en bij 490 pagina's is die drempel nog lang niet getest.
Tag-wildgroei ontstond toch: 662 losse tags, één voor één toegevoegd, want agents genereren aannemelijke tags voor niets. Veroudering blijft kosten met zich meebrengen: ongeveer 30 pagina's staan gemarkeerd als gezaghebbend maar verouderd, ondanks gedateerde as-of-markeringen en een 90-dagen-lintwaarschuwing. En in april lag de vault op 0,68 raw-bronnen per gecompileerde pagina, wat betekent dat het systeem sneller schreef dan het las. Wanneer schrijven niets kost, worden bronloze pagina's de weg van de minste weerstand, en de regel tegen verzinsels is het enige dat een kennisbank scheidt van een zeer geordende stapel beweringen.
Toegewijde geheugenproducten beloven retrieval voorbij de grens van 10.000 pagina's op te lossen, en het eerlijke antwoord is dat deze vault ver onder die grens zit. De tweedeling in die markt staat in Context-substraten voor langlopende agents.
Hetzelfde patroon binnen een bedrijf
Karpathy schetste het LLM-wiki-patroon in een gist, en Google bracht in juni 2026 een vergelijkbaar open kennisformaat uit, markdown-bundels met getypeerde frontmatter die deze indeling bijna veld voor veld weerspiegelen. Ik lees die convergentie als bewijs dat de vorm klopt. De bedrijfsversie compileert positionering, prijzen, SOP's, beslissingslogboeken en klantcontext in plaats van persoonlijke notities, en faalt op dezelfde manier: een wiki die iemand met enthousiasme bouwde en die niemand onderhoudt. Voor een bedrijfskennisbank van 200 documenten is de machinerie hierboven al meer dan nodig, en De meeste bedrijfskennisbanken hebben geen RAG nodig legt uit waarom.
Het oordeelswerk zit in de opzet: welke feiten een eigenaarpagina krijgen, waar reviewpoorten staan, en waar agents wel of niet naar mogen schrijven. Die indeling is de vorm van webvise's AI-audit- en adviestraject: kies één workflow, breng inputs, uitzonderingen en reviewpunten in kaart, en vertrek met een werkend prototype en een bouwplan. De kennislaag blijkt meestal de voorwaarde te zijn voor elke automatisering die daarna komt.
webvise bouwt agent-onderhouden kennissystemen en de automatiseringen daarbovenop, met in elke workflow een menselijke reviewpoort. Wilt u weten hoe dat er op uw documenten uitziet, gebruik dan het contactformulier.
De werkwijzen van webvise zijn afgestemd op de ISO 27001- en ISO 42001-normen.