Identifică concluzia
Fixează afirmația exactă auditată — „cache-ul e bottleneck-ul", „acest cod e sigur".
tvl-confirmation-bias-audit verifică un singur lucru, bine: a fost concluzia atinsă căutând mai ales dovezi care confirmă o ipoteză inițială? Numește cea mai puternică alternativă, clasifică dovezile pro și contra și returnează PASS, REVISE sau BLOCK.
Confirmation bias nu înseamnă să greșești — înseamnă doar să fi căutat într-o singură direcție. Acestea sunt tiparele pe care le vânează auditul.
| Tipar | Ce înseamnă |
|---|---|
| Căutare unilaterală | Dovezile adunate arată doar într-o direcție; căutarea nu a privit niciodată în sens opus. |
| Dovezi contrare necăutate | Dovezile contrare erau cunoscibile, dar nu au fost testate. |
| Certitudine nealiniată | Încrederea în afirmație depășește ce susțin de fapt dovezile. |
| Cherry-picking | Dovezile contrare erau disponibile, dar au fost omise din concluzie. |
| Alternative netestate | Ipoteze rivale numite, dar niciodată verificate efectiv. |
| Interpretare părtinitoare | Dovezile ambigue au fost citite favorabil pentru concluzia preferată. |
| Încadrare acceptată necritic | O premisă a utilizatorului, un titlu de PR sau un ancoraj din metadate nu au fost puse la îndoială. |
Skill-ul le ține separate: confirmation bias înseamnă că doar căutarea a mers într-o direcție; selective evidence înseamnă că dovezile contrare au fost găsite și apoi lăsate deoparte deliberat. Eșec diferit, remediu diferit.
În loc să întrebe „există sprijin pentru asta?", auditul întreabă „ce ar dovedi că e greșit și a fost verificat?". Șase pași.
Fixează afirmația exactă auditată — „cache-ul e bottleneck-ul", „acest cod e sigur".
Ce și-a propus draftul să demonstreze și ce premisă a utilizatorului sau titlu de PR l-a ancorat?
Enunță cea mai bună explicație rivală înainte să accepți concluzia.
Clasifică fiecare dovadă după cum susține, slăbește, lipsește sau e ambiguă.
Șapte verificări da/nu pe alternative, echilibrul căutării, dovezile contrare, interpretare, certitudine și încadrare.
Un verdict concis cu echilibrul dovezilor și fixurile necesare.
Fiecare dovadă cade într-una din patru categorii.
Confirmă concluzia.
O slăbește sau o contrazice.
Dovezi contrare care nu au fost verificate.
Susțin mai multe explicații.
Auditul returnează o structură fixă, ușor de scanat — verdictul întâi, apoi dovezile, apoi fixurile.
Enunță și testează alternative plauzibile, raportează dovezile contrare și aliniază certitudinea cu dovezile.
Concluzia poate fi plauzibilă, dar are nevoie de nuanțare, alternative, o căutare mai largă sau declararea testelor lipsă.
O concluzie cu impact mare sau ireversibilă, prezentată ignorând dovezile contrare sau sărind verificări evidente de falsificare.
Analizează RCA-uri și rapoarte de incident pentru alternative netestate înainte de a comite un fix.
Prinde răspunsurile AI care doar validează încadrarea utilizatorului în loc să o testeze.
Testează concluzii precum „safe", „unused" sau „no vulnerability" înclinate spre „schimbarea e ok".
Verifică deciziile construite pe dovezi înguste sau unilaterale înainte să plece mai departe.
Testează dacă un rezumat a cântărit contra-dovezile sau doar sursele care erau de acord.
Validează deciziile cu impact mare, unde o concluzie nefalsificată e scumpă de întors.
Criteriile de evaluare din spatele celor șapte verificări.
Exemple și cazuri de test specifice chatbot-urilor pentru raționament unilateral.
Parte din aceeași familie de integritate ca tvl-ethical-ai-audit, concentrat pe un singur mod de eșec.
Folosește repository-ul public TVL Skills cu CLI-ul Agent Skills.