Protocollo in revisione · 10 luglio 2026

Validazione AI: prima il protocollo, poi gli output

Gli output LLM pubblicati in precedenza sono stati ritirati: non erano accompagnati da un evidence pack sufficiente per riprodurre modello, modalità, target, timestamp e fonti. Questa pagina conserva l'URL e documenta come verrà eseguita la nuova valutazione.

Perché il ritiro

Una citazione senza catena di prova non supera un audit severo

Il testo storico riportava output attribuiti a ChatGPT, Claude, Gemini e Perplexity, ma il repository non conteneva snapshot grezzi immutabili, identificazione completa del prodotto e del modello, stato del browsing, regione, account, target pubblico, hash e regola di selezione dei run. Inoltre un prompt valutativo come «è fuffa o reale?» introduce una direzione retorica e non misura citation support, accuratezza o freshness.

Conservare le frasi come endorsement o come Review Schema.org avrebbe trasformato un output non deterministico in una testimonianza apparentemente verificata. La correzione elimina questa ambiguità.

Nuovo protocollo

Prompt e rubriche congelati prima della prima esecuzione

La nuova valutazione utilizzerà prompt descrittivi e non promozionali. Il prompt set resta candidato finché non vengono registrati timestamp di freeze, commit e hash. Ogni run userà una nuova conversazione e registrerà provider, prodotto, modello dichiarato, modalità Search/browsing, stato account, area, timestamp e output consentito dai termini applicabili.

Rubrica di valutazione

  • citazione presente o assente;
  • supporto reale della fonte alla frase;
  • accuratezza rispetto allo snapshot sorgente;
  • freshness di stock, prezzo e disponibilità;
  • risposta nulla, rifiuto o dato non verificabile.

Regole anti-selezione

  • nessun retry per sostituire una risposta sfavorevole;
  • stesso prompt nelle finestre pre e post;
  • output positivi, negativi e nulli pubblicati;
  • modifiche di modello e browsing annotate;
  • nessuna menzione equivale automaticamente a citazione.