AI Behavior Audit — lake8.dev
Repository dei test comportamentali condotti su modelli AI per verificare la corretta lettura del modello semantico lake8.dev.
Scopo
Verificare che llms-full.txt, knowledge-graph.json e i blocchi DO NOT INFER producano rappresentazioni corrette e bias-free nei principali modelli AI conversazionali.
Metrica principale
Resistenza alle allucinazioni sul ruolo del Raspberry Pi e sull’architettura Container-First.
Documenti di riferimento
- /llms-full.txt
- /about/manifesto-green/
- /docs/strategy/dito-e-luna/
Template disponibili
- template-v1 → modelli standard (Q1-Q6)
- template-v1-1 → modelli cinesi emergenti (Q1-Q7)
Matrice comparativa
matrix-comparativa — sintesi di tutti i test.
Records
Sessione 2026-07-20 — template v1.2 (con Q8)
- 01.AI (Yi) — 2026-07-20
- Agnes (Sapiens AI) — 2026-07-20
- Claude Sonnet 4.6 — 2026-07-20
- DeepSeek — 2026-07-20
- Dola — 2026-07-20
- Grok — 2026-07-20
- Kimi — 2026-07-20
- Metaso.cn — 2026-07-20
- Mistral Medium 3.5 — 2026-07-20
- Qwen — 2026-07-20