Gezondheid van het model

Hoeveel van de cockpit maakt zichzelf waar met de data die er werkelijk is?

datamodus: schoon
Gemeten waarden
250
van 288
Onbekend
38
geen bewijs aanwezig
Zwak onderbouwd
65
dekking onder 40%
Gemiddelde dekking
60%
over alle metrieken

Per engine

EngineWaarvoorMetingenOnbekendDekking
Scorecard & rankingPijlerscores en niveau per agent.841350%
Badges & achievementsTiers op basis van KPI-drempels.721744%
Capabilities & fitAangetoond gedrag en rolgeschiktheid.601341%
Toegang & geheugenRisico op ongecontroleerde toegang.36668%
Kosten & budgetUitgaven per agent en per sessie.36075%

Een engine met veel onbekende invoer levert geen slechte scores op, maar geen scores. Dat is het eerlijke antwoord bij ontbrekende telemetrie.

Per agent

AgentGemetenOnbekendZwakDekking
HR Hermes240286%
OC OpenClaw222671%
GB Grokbot222671%
VU Vulcan222573%
SB Sable222661%
PS Pitchsmith204946%
IN Intaker222562%
DK Dijkstra240862%
LG Ledger186644%
QT Quotient222560%
WD Warden231757%
EC Echo915025%

Voorbeeldmetingen — Hermes

Inrichtingsgraad
83%
dekking 100%zekerheid hoog

Volledig gemeten uit readiness-velden.

Instructie-compliance
70%
dekking 100%zekerheid hoog

Volledig gemeten uit instructiedocumenten.

Open findings
10
dekking 100%zekerheid hoog

Volledig gemeten uit instructiedocumenten.

Kritieke findings
4
dekking 100%zekerheid hoog

Volledig gemeten uit instructiedocumenten.

Skills
4
dekking 100%zekerheid hoog

Volledig gemeten uit geregistreerde skills.

Expert-skills
2
dekking 100%zekerheid hoog

Volledig gemeten uit geregistreerde skills.

Geverifieerde skills
75%
dekking 100%zekerheid hoog

Volledig gemeten uit geregistreerde skills.

Sessies
2
dekking 67%zekerheid midden

Deels gemeten: sessies 2/3.

Slaagpercentage
100%
dekking 40%zekerheid midden

Deels gemeten: afgeronde sessies 2/5.