VerkenningDit scherm is een idee-uitwerking, geen onderdeel van het kernverhaal. Beoordeel het opnieuw zodra er echte data is.

Experimenten & varianten

Een nieuwe instructieversie is een aanname tot je hem naast de oude legt. Hier staat welke variant meetbaar beter is — en welke nog te weinig runs heeft.

Lopend
2
Beslisbaar
1
Genoeg runs voor een uitspraak
Wacht op data
3
Uitgerold
1
Gestopt
1

Briefing-template: korte context vs. volledige context

loopttemplateKosten per sessie (€)Te weinig data01 aug 202631 aug 2026

Samenvattingen in plaats van volledige agenda-dumps halveren de inputtokens.

onderwerp: rt-briefingagents: Hermes
A — volledige contextcontrole
€ 0.44
17 runs · spreiding ±0.08 · versie 2.3.0
17 van 15 benodigde runs
B — samenvatting vooraf
€ 0.27
9 runs · spreiding ±0.06 · versie 2.4.0-rc
9 van 15 benodigde runs
Uitspraak

Nog 6 run(s) nodig voordat het verschil betekenis heeft (norm 15 per variant).

verschil: +0.17relatief: +39%effectgrootte: 2.40

Cadans acquisitie: 3 vs. 5 contactmomenten

beslistsequenceSlagingskans (%)Variant wint15 jun 202627 jul 2026

Twee extra contactmomenten verhogen de conversie naar de voorstel-stage.

onderwerp: seq-acquisitieagents: OpenClaw, Pitchsmith
A — 3 stappencontrole
22%
41 runs · spreiding ±6 · versie 1.2.0
41 van 30 benodigde runs
B — 5 stappenwint
31%
38 runs · spreiding ±7 · versie 1.3.0
38 van 30 benodigde runs
Uitspraak

B — 5 stappen scoort 41% beter met effectgrootte 1.38.

verschil: +9.00relatief: +41%effectgrootte: 1.38
besluit B uitgerold als 1.3.0; A blijft beschikbaar voor bestaande klanten.

soul.md v4.3: altijd duiden

looptinstructieReviewscore (1-5)Variant wint05 aug 202602 sep 2026

Een expliciete duidingssectie verhoogt de reviewscore op onderbouwing zonder de sessie duurder te maken.

onderwerp: soul.mdagents: Dijkstra, Grokbot
A — v4.2 (huidig)controle
3.40
24 runs · spreiding ±0.6 · versie v4.2
24 van 20 benodigde runs
B — v4.3 duidenwint
4.10
22 runs · spreiding ±0.5 · versie v4.3
22 van 20 benodigde runs
Uitspraak

B — v4.3 duiden scoort 21% beter met effectgrootte 1.27.

verschil: +0.70relatief: +21%effectgrootte: 1.27

Harnas 2.5.0: strakker bestandscontract

gestoptharnasDoorlooptijd (min)Te weinig data10 jul 202607 aug 2026

Een strakker contract voorkomt herstelwerk en verkort de sessie.

onderwerp: agent-runtimeagents: Sable, Ledger
A — 2.4.1controle
18 min
26 runs · spreiding ±5 · versie 2.4.1
26 van 20 benodigde runs
B — 2.5.0-rc1
24 min
7 runs · spreiding ±9 · versie 2.5.0-rc1
7 van 20 benodigde runs
Uitspraak

Nog 13 run(s) nodig voordat het verschil betekenis heeft (norm 20 per variant).

verschil: -6.00relatief: -33%effectgrootte: -0.82
besluit Gestopt: variant B blokkeerde legitieme paden; eerst het contract verbreden.

Offerteprompt: prijsmotivatie vooraan

conceptpromptReviewscore (1-5)Te weinig data20 aug 202620 sep 2026

Als de prijsonderbouwing bovenaan staat, hoeft de accountmanager minder te corrigeren.

onderwerp: pr-offerteagents: Quotient
A — huidige volgordecontrole
0.00
0 runs · spreiding ±0 · versie v3.1
0 van 15 benodigde runs
B — motivatie vooraan
0.00
0 runs · spreiding ±0 · versie v3.2-draft
0 van 15 benodigde runs
Uitspraak

Nog 30 run(s) nodig voordat het verschil betekenis heeft (norm 15 per variant).

verschil: +0.00relatief: +0%effectgrootte: 0.00