# 02 — Drie fases: Conventioneel · AI-prompting · Agentic AI

> Per fase wordt het *werk* (functioneel) eerst beschreven los van techniek, daarna de allocatie aan rollen (mens/agent), dan pas de techniek. Volgorde is bewust: functie → rolverdeling → realisatie. Voor elke fase: wie doet wat, hoe lopen de stromen, wat is de meetbare verbetering t.o.v. de vorige fase.

## 0. Gedeelde basis — wat het werk WERKELIJK is

De vraag van Peter, gestript van oplossing:

> *Ik wil dat (a) de kennis die alleen in Gerbens hoofd zit toegankelijk wordt voor anderen, (b) anderen die kennis daadwerkelijk kunnen toepassen, en (c) Gerben daardoor wordt ontlast — zonder dat de kwaliteit of het tempo van het werk daalt.*

Drie onderliggende werkstromen die hieruit volgen:

| Werkstroom | Wat | Wie heeft baat |
|---|---|---|
| **W1. Eliciteren** | Kennis uit Gerbens hoofd naar buiten halen | Organisatie (continuïteit) |
| **W2. Structureren** | Die kennis ordenen in herbruikbare vorm | Team-leden (vinden + toepassen) |
| **W3. Distribueren + toepassen** | Anderen kennis daadwerkelijk laten gebruiken | Klant (zelfde kwaliteit, breder beschikbaar) |
| **W4. Onderhouden** | Kennis aktueel houden naarmate werk verandert | Iedereen (anders veroudert het direct) |

De drie fases verschillen **niet** in welke werkstromen er zijn — die zijn constant. Ze verschillen in **wie/wat** elke werkstroom uitvoert.

## Fase 1 — Conventioneel (geen AI)

### Werkverdeling — "stel: alleen mensen"

| Rol | Wie | Werkstroom-bijdrage |
|---|---|---|
| **Kennis-ontlokker** | Business analyst / process engineer (intern of extern) | W1: gestructureerde interviews, observatie, document-archeologie |
| **Domein-expert** | Gerben (en evt. andere senioren) | W1: kennis-bron; W4: review-rol bij wijzigingen |
| **Kennis-architect** | Doc-owner / wiki-beheerder | W2: ordening, structuur, vindbaarheid |
| **Buddy/coach** | Senior team-lid | W3: nieuwe mensen onboarden, vragen beantwoorden, escalatie filter |
| **Consument** | Junior team-lid / nieuwe medewerker | W3: kennis toepassen op klantvraag |
| **Onderhouder** | Owner per kennisdomein (rotatie) | W4: signaleren wijzigingen, updates initiëren |

### Methodes (verifieerbaar uit literatuur)

- **Knowledge elicitation interviews** — Hoffman & Lintern, *Eliciting and representing the knowledge of experts*, in Ericsson et al. *Cambridge Handbook of Expertise*, 2006.
- **Cognitive Task Analysis (CTA)** — Crandall, Klein, Hoffman, *Working Minds*, 2006.
- **Critical Incident Technique** — Flanagan, *The Critical Incident Technique*, Psychological Bulletin, 1954.
- **Standard Operating Procedures (SOP)** — gestructureerde vastlegging; ISO 9001-praktijk.
- **SECI-model** (Socialization → Externalization → Combination → Internalization) — Nonaka & Takeuchi, *The Knowledge-Creating Company*, 1995. Beschrijft precies hoe tacit-knowledge (Gerben) wordt omgezet in expliciete kennis (SOP) en weer wordt opgenomen door anderen.

### Concrete deliverables

| # | Artefact | Vorm |
|---|---|---|
| D1.1 | Domein-decompositie | Hiërarchische lijst van kennisgebieden Gerben |
| D1.2 | SOPs per workflow | Gestructureerde markdown / wiki-pagina |
| D1.3 | Beslisbomen voor terugkerende afwegingen | Visueel (Mermaid / flowchart) |
| D1.4 | FAQ + glossary | Wiki |
| D1.5 | Video-walkthroughs van complexe taken | Korte schermopnames |
| D1.6 | Onboarding-pad nieuwe medewerker | Checklist met SOP-verwijzingen |
| D1.7 | Escalatie-protocol | Wanneer wel/niet naar Gerben |

### Customer journey (fase 1)

*Casus: klant belt met vraag die normaal alleen Gerben kan beantwoorden.*

1. Klant stelt vraag aan junior team-lid
2. Junior raadpleegt SOP / FAQ / beslisboom
3. Antwoord direct → klant tevreden (geen Gerben-tussenkomst)
4. Onbekende casus → junior raadpleegt buddy/senior → samen via SOP-template-aanpassing
5. Echte uitzondering → escalatie naar Gerben (gedocumenteerd → groeit kennisbank)

### Meetbare verbetering

- % vragen beantwoord zonder Gerben (target stijgt over tijd)
- Tijd-tot-antwoord (initieel ↑ door SOP-zoeken, daarna ↓)
- Aantal SOPs in gebruik
- Onboarding-tijd nieuwe medewerker

### Wat fase 1 NIET oplost

- Vinden in grote kennisbank wordt lastig (zoekprobleem)
- Tacit knowledge die zich niet laat externaliseren ("ervaringsgevoel") blijft bij Gerben
- Onderhoud kost continu menstijd

## Fase 2 — AI als intelligente prompting (RAG + Q&A + samenvatting)

### Wat verandert t.o.v. fase 1

**Niet:** de werkstromen, rollen of het primaat van mensen.
**Wel:** twee specifieke pijnpunten van fase 1 worden geadresseerd:
- *Zoekprobleem:* vinden in kennisbank wordt natuurlijke-taal-vraag.
- *Toegankelijkheid:* drempel om vraag te stellen daalt (chat-interface vs. wiki-doorploegen).

### Rolverdeling — wat AI hier doet

| AI-functie | Wat het wel doet | Wat het niet doet |
|---|---|---|
| **Retrieval** | Relevante SOP/FAQ-fragmenten ophalen op natuurlijke-taal-vraag | Beslissingen nemen |
| **Synthese** | Fragmenten samenvatten naar bondig antwoord | Nieuwe kennis creëren |
| **Bronvermelding** | Bij elk antwoord: welke SOP/document, welk fragment | Antwoord geven zonder bron |
| **Confidence-signalering** | "Dit weet ik niet zeker" / "geen bron gevonden" | Hallucineren |
| **Samenvatten** | Klantgesprek → actiepunten | Beslissen welke acties |

### Methodes en bronnen

- **Retrieval-Augmented Generation (RAG)** — Lewis et al., *Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks*, NeurIPS 2020.
- **Grounded generation** — Google Research / Microsoft Research; LLM-output gekoppeld aan verifieerbare bronnen.
- **Anthropic Building Effective Agents** (dec 2024) — sectie *Workflows*: "Prompt chaining" en "Routing" — beide passen in fase 2, geen autonomie nodig.

### Concrete deliverables (bovenop fase 1)

| # | Artefact | Vorm |
|---|---|---|
| D2.1 | Kennisbank in machine-leesbaar formaat | Markdown + frontmatter / structured docs |
| D2.2 | Vector-index over kennisbank | Embedding-DB |
| D2.3 | Q&A-app | Chat-interface, verplicht bronvermelding |
| D2.4 | Samenvattings-tool | Klantgesprek-input → actiepunten + verantwoordelijken |
| D2.5 | Confidence-protocol | Wanneer "weet ik niet" terug naar mens |
| D2.6 | Evaluatie-set | Gouden vragen + verwachte antwoorden; regressie-test |

### Customer journey (fase 2)

1. Klant stelt vraag aan junior team-lid (zoals fase 1)
2. Junior typt vraag in Q&A-app
3. App retourneert antwoord + 2-3 bronnen + confidence-score
4. *Hoge confidence:* junior controleert bron → bevestigt naar klant
5. *Lage confidence / geen bron:* app stuurt naar buddy/senior, niet rechtstreeks naar Gerben
6. Senior valideert → antwoord wordt toegevoegd aan kennisbank (feedback-loop)

### Meetbare verbetering t.o.v. fase 1

- Tijd-tot-antwoord daalt (geen wiki-doorzoeken)
- % vragen waar SOP gevonden wordt stijgt (retrieval beter dan keyword-search)
- Drempel om kennisbank te raadplegen daalt (chat > navigeren)
- Junior-kwaliteit stijgt sneller (impliciete training door antwoorden)

### Risico's eigen aan fase 2

- **Hallucinatie:** model verzint antwoord als geen bron gevonden. Mitigatie: harde regel "geen bron = geen antwoord, alleen escalatie".
- **Valse zekerheid:** medewerkers geloven AI-output zonder bron te checken. Mitigatie: bron *altijd* tonen, audit-steekproeven.
- **Kennisbank-rot:** als kennisbank niet up-to-date is, geeft AI verouderd antwoord met overtuiging. Mitigatie: doc-owner-rotatie uit fase 1 blijft kritiek.

### Wat fase 2 NIET oplost

- Multi-step workflows (planning, uitvoering, controle)
- Proactief monitoren (alleen reactief op vraag)
- Beslissingen die context buiten kennisbank vereisen

## Fase 3 — Agentic AI (autonome workflows, met human-in-the-loop)

### Wanneer waardevol — strikte voorwaarden

Fase 3 is **alleen** verantwoord als alle drie waar zijn:
1. Werkstroom is **repetitief én volume-significant** (anders is de overhead niet terugverdiend)
2. SOPs uit fase 1 zijn **scherp en stabiel genoeg** om uitvoering te dragen
3. **Reviewer-capaciteit** bij mensen is georganiseerd (anders ontstaat blackbox-uitvoering)

Als één van deze drie ontbreekt: blijf in fase 2.

### Rolverdeling — agents als "junior-medewerkers onder review"

Mens-equivalent (S3-heuristiek toegepast):

| Mens-rol | Agent-equivalent | Wat doet het | Wie reviewt |
|---|---|---|---|
| Triagist | Routing-agent | Inkomende vraag classificeren → juiste afhandeling | Steekproef + outlier-flag |
| Uitvoerder van SOP | Executor-agent | SOP-stappen uitvoeren met tools (mail, DB, API) | Mens-reviewer per N taken |
| Monitor | Observer-agent | Patronen signaleren, afwijking detecteren | Senior bij flag |
| Samensteller | Reporter-agent | Periodieke samenvatting/dashboard | Mens leest, accepteert |
| Coördinator | Orchestrator-agent | Subtaken verdelen, voortgang bewaken | Mens bij escalatie |

**Geen** agent voor: beoordeling, klantcontact onder onzekerheid, beslissingen met juridische of financiële consequenties — daar blijft mens primair.

### Methodes en bronnen

- **Anthropic, Building Effective Agents** (dec 2024) — definieert *workflows* (deterministisch) vs. *agents* (autonoom). Adviseert: workflows waar mogelijk, agents waar noodzakelijk.
- **Human-in-the-loop (HITL)** — standaard praktijk in machine learning sinds Settles, *Active Learning Literature Survey*, 2009. In agent-context: agents pauzeren bij onzekerheid en vragen mens.
- **Tool use** — Anthropic, OpenAI, Google function-calling APIs (2023-2024).
- **Evaluatie van agent-uitkomsten** — OpenAI Evals, Anthropic agent evaluations.

### Concrete deliverables (bovenop fase 1+2)

| # | Artefact | Vorm |
|---|---|---|
| D3.1 | Agent-catalogus | Per agent: doel, tools, escalatieregels, eval-set |
| D3.2 | Orchestrator-architectuur | Hoe agents samenwerken |
| D3.3 | Tool-belt | Aanroep-specs naar externe systemen (mail, ERP, etc.) |
| D3.4 | Review-protocol | Wie reviewt wat, op welke frequentie |
| D3.5 | Eval-pijplijn | Continue meting agent-kwaliteit, regressie-detectie |
| D3.6 | Kill-switch + audit-log | Elke agent-actie traceerbaar en stopzetbaar |

### Customer journey (fase 3)

1. Klant stelt vraag (kan via mail, chat, telefoon)
2. Routing-agent classificeert: standaard / complex / onbekend
3. *Standaard:* executor-agent voert SOP uit, bron-onderbouwd antwoord naar klant, audit-log
4. *Complex:* orchestrator-agent verdeelt subtaken, mens-reviewer keurt eindresultaat
5. *Onbekend:* directe escalatie naar mens, casus wordt toegevoegd aan trainingsset
6. Observer-agent monitort patronen → maandelijks rapport: welke SOPs werken, welke niet, welke nieuwe categorieën ontstaan
7. Gerben's rol: nog steeds alleen escalatie + maandelijkse review nieuwe categorieën (echt ontlast)

### Meetbare verbetering t.o.v. fase 2

- % vragen volledig autonoom afgehandeld (target: 30-60% afhankelijk van domein)
- Doorlooptijd standaard-vraag (van uren naar minuten)
- Schaalbaarheid: 10× volume zonder 10× headcount
- Gerben-belasting (concrete telling: aantal escalaties per week)

### Risico's eigen aan fase 3 (groter dan fase 2)

- **Compound errors:** agent maakt fout, vervolg-agent neemt fout aan als waar → fout schaalt. Mitigatie: checkpoints met validatie tussen stappen.
- **Verlies van oversight:** mens reviewt steekproef, mist systematische bias. Mitigatie: outlier-detectie, periodieke audit.
- **Schaduwen van expertise:** als agents alles afhandelen, leren juniors niet meer en wordt nieuwe Gerben niet opgebouwd. Mitigatie: rotatie waarin juniors agent-output reviewen + zelf afhandelen.
- **Tool-misbruik:** agent met DB-write-rechten kan schade veroorzaken. Mitigatie: scoped permissions, dry-run mode, append-only waar mogelijk.

### Wat fase 3 NIET oplost

- Strategische keuzes (wat moet de afdeling doen?)
- Relationele complexiteit (vertrouwen, conflict, cultuur)
- Wettelijke aansprakelijkheid (mens blijft aansprakelijk voor agent-uitkomsten)

## Synthese — wanneer welke fase

| Situatie | Fase | Rationale |
|---|---|---|
| Kennis is niet geëxternaliseerd | **Fase 1 verplicht** | Zonder SOPs heeft AI geen voeding |
| Kennisbank bestaat, zoeken is pijnlijk | Fase 1 → **fase 2** | Toegankelijkheid wordt sprongmaker |
| Workflows zijn repetitief én vraag is hoog | Fase 2 → **fase 3** | Schaalvoordeel rechtvaardigt complexiteit |
| Werk is eenmalig of laagvolume | **Blijf fase 1/2** | Agent-overhead onverdedigbaar |
| Hoge juridische/financiële stakes | **Niet voorbij fase 2** | Aansprakelijkheid eist menselijke beslissing |

## Hoofdpunt voor de Gerben-casus

Voor de specifieke situatie bij Staff geldt — **op basis van wat in de prompt staat**, dus zonder verdere inwinning — vrijwel zeker:

> **Begin in fase 1.** De kennisbank bestaat (nog) niet of bestaat als hoofd-inhoud Gerben. Zonder fase 1 is fase 2 onmogelijk (RAG op niets) en is fase 3 onverantwoord (agents zonder SOPs).
>
> **Plan fase 2 als horizon** zodra de eerste 5-10 SOPs bestaan en in gebruik zijn. Dan is het meerwerk klein en de waarde groot.
>
> **Spreek fase 3 alleen uit als gewenste eindbeeld**, niet als startpunt. Het ERP+DB+AI+mail-voorstel uit de prompt slaat fase 1 en 2 over — daarom voelde Christian terecht "ik ben de weg kwijt".
