P5, P6 en P7: het systeem
dat zichzelf verbetert
De eerste vier niveaus van de procedurele ladder (P0 t/m P4) zijn grotendeels een menselijk traject. Een mens of team beslist welke patronen de moeite waard zijn om te proceduraliseren, en implementeert de procedures. Het systeem voert uit; de architectuurbeslissing ligt buiten het systeem.
Op P5 begint dat te verschuiven. Het systeem draagt zelf bij aan het identificeren van verbeterkansen. Op P6 en P7 neemt het een actieve rol in het ontwerpen, bouwen en bewaken van zijn eigen capaciteiten. Het wordt, in de letterlijke zin van het woord, een lerend systeem.
Maar meer autonomie betekent niet minder governance. Juist op deze niveaus zijn de veiligheidsgrens en de menselijke gate het meest cruciaal.
P5 · Het systeem herkent zelf kansen om te proceduraliseren
Op P5 observeert het systeem zijn eigen gedrag. Het houdt bij welke redeneersequenties het heeft uitgevoerd, over sessies heen. Wanneer dezelfde sequentie drie of meer keer voorkomt, genereert het een voorstel in de trant van: “Ik heb dit patroon drie keer gezien. Hier is een mogelijke procedure die het omzet in stap X of mechanisme Y. Wil je dat ik dit als voorstel uitwerk?”
Wat P5 technisch vereist:
- Logging van redeneersequenties per taaktype, persistent over sessies heen.
- Patroonherkenning die frequentie, stabiliteit en kosten van de herhaling weegt.
- Een gedefinieerd kanaal voor proceduraliseervoorstellen: een apart task-type op het board, een label, of een wekelijkse digest.
Het cruciale punt: P5 is detectie, geen uitvoering. Het systeem herkent de kans en rapporteert. De beslissing om te proceduraliseren blijft bij een mens. Geen enkel patroon wordt automatisch omgezet zonder menselijke beoordeling.
Wanneer is een patroon P5-rijp? De volgende signalen helpen bij die beoordeling:
| Signaal | Drempelwaarde |
|---|---|
| Hoe vaak | Drie of meer keer in twee weken |
| Hoe stabiel | Dezelfde input leidt consistent tot dezelfde output |
| Hoe kostbaar | Meer dan vijf minuten LLM-redenering per herhaling |
| Hoe riskant bij fout | Laag tot middel · hogere risico’s vragen eerst meer P4-regels |
P6 · Het systeem stelt nieuwe capaciteiten voor en bouwt ze
Op P6 gaat het systeem verder dan detectie. Waar het op P5 zegt “hier zit een patroon”, zegt het op P6: “hier zit een patroon, en hier is de implementatie die het aanpakt, klaar voor review.”
Een P6-cyclus ziet er zo uit:
Een concreet voorbeeld: het systeem detecteert dat het bij elke deployment van een nieuwe dienst handmatig DNS-validatie uitvoert. Op P6 schrijft het een validatie-script, test het op de laatste vijf deployments, en levert een pull request op met een “klaar wanneer”-criterium en de testresultaten als bewijs. De engineer beoordeelt, merget of geeft feedback.
Wat dit oplevert: het systeem versnelt zijn eigen verbetering. Elke week dat het op P6 opereert, wordt de kloof tussen P0-redenering en geautomatiseerde capaciteit kleiner. Taken die vorig kwartaal LLM-tijd kostten, zijn dit kwartaal deterministische functies.
P6 is waardevol, maar ook het niveau waarop de governance-grens het meest zichtbaar is. Het systeem bouwt nu zijn eigen tools en procedures. Die moeten door dezelfde gates als alle andere code: branch, PR, CI, review door een mens. Een systeem dat zijn eigen procedures direct kan activeren zonder review, heeft geen governance · het heeft een gevaarlijke shortcut.
P7 · Het systeem valideert, deployt en monitort zijn eigen procedures
Op P7 beheert het systeem de volledige lifecycle van zijn eigen procedures: van validatie en deployment tot monitoring en terugschalen bij regressie. Het verschil met P6 is formeel maar wezenlijk. Op P6 levert het systeem de PR; een mens besluit of die gemerged wordt. Op P7 is er een mechanisme waarbinnen het systeem, na menselijke goedkeuring van de procedure-klasse, de verdere levenscyclus zelfstandig beheert.
Hoe dat werkt in de praktijk:
- Shadow-run: de nieuwe procedure draait parallel aan de bestaande LLM-redenering; output wordt vergeleken op een representatieve set historische gevallen.
- Validatie: bij voldoende overeenkomst en geen gevallen waarbij de procedure faalt maar het LLM slaagt, wordt de procedure automatisch gepromoveerd.
- Monitoring: de procedure heeft een eigen health-metric; afwijkingen worden gedetecteerd en gelogd.
- Terugschalen: bij regressie schakelt het systeem automatisch terug naar LLM-redenering en escaleert naar een mens.
“P7 is een hoog ambitieniveau en voor de meeste teams geen korte-termijndoel. Maar het is de richting. Elke stap op de ladder is een stap naar een systeem dat zijn eigen capaciteiten beheert en zijn eigen intelligentie concentreert op wat nog niet automatisch kan.”
De veiligheidsgrens · ook op P5, P6 en P7
Ook op de hoogste niveaus van de procedurele ladder geldt een fundamenteel principe: autonomie is niet hetzelfde als bevoegdheid.
Het systeem mag zelfstandig bedenken welke procedures wenselijk zijn. Het heeft niet automatisch de bevoegdheid om die procedures ook te activeren. Een procedure die een menselijk gedragspatroon vervangt, is net zo impactvol als een code-wijziging in een kritiek systeem. Dezelfde gate die geldt voor productiecode, geldt ook voor nieuw aangeleerde procedures.
Dit is geen beperking die voortkomt uit wantrouwen jegens het systeem. Het is architecturele discipline: de mens behoudt zicht op wat het systeem aan het worden is, niet alleen op wat het vandaag doet.
De vier kwadranten van autonomie en procedurele rijpheid, naast elkaar:
Laag autonoom · Laag procedureel
Handmatige prompts, sessiegebonden. De meeste teams beginnen hier.
Hoog autonoom · Laag procedureel
Agent werkt zelfstandig maar lost elk probleem opnieuw op. Hoge kosten, beperkte schaal.
Laag autonoom · Hoog procedureel
Veel geautomatiseerde tooling maar mens-gestuurd. Solide basis voor schaling.
Hoog autonoom · Hoog procedureel
Zelfstandig systeem dat zijn eigen routinewerk omzet in automatisering. Intelligentie geconcentreerd op het nieuwe.
Conclusie · de ladder als richting
De procedurele ladder is geen einddoel maar een richting. Elk team begint op P0 en beweegt in zijn eigen tempo, afhankelijk van het domein, de beschikbare tooling en de bereidheid om governance mee te laten groeien met autonomie.
Wat telt, is dat routinewerk continu krimpt. Dat elke herhaling die het systeem herkent een kans is om die herhaling te elimineren. En dat algemene intelligentie vrij blijft voor wat nog niet automatisch kan: het nieuwe, het complexe, het onverwachte.
“Het doel is niet een systeem dat alles zelf beslist. Het is een systeem dat zijn eigen routines beheert, zodat de mens en de AI samen aandacht kunnen besteden aan wat er werkelijk toe doet.”
Dat is het verschil tussen een AI die elke dag opnieuw leert rijden, en een systeem dat rijdt.
Terug naar overzicht