Una citazione senza catena di prova non supera un audit severo
Il testo storico riportava output attribuiti a ChatGPT, Claude, Gemini e Perplexity, ma il repository non conteneva snapshot grezzi immutabili, identificazione completa del prodotto e del modello, stato del browsing, regione, account, target pubblico, hash e regola di selezione dei run. Inoltre un prompt valutativo come «è fuffa o reale?» introduce una direzione retorica e non misura citation support, accuratezza o freshness.
Conservare le frasi come endorsement o come Review Schema.org avrebbe trasformato un output non deterministico in una testimonianza apparentemente verificata. La correzione elimina questa ambiguità.
Prompt e rubriche congelati prima della prima esecuzione
La nuova valutazione utilizzerà prompt descrittivi e non promozionali. Il prompt set resta candidato finché non vengono registrati timestamp di freeze, commit e hash. Ogni run userà una nuova conversazione e registrerà provider, prodotto, modello dichiarato, modalità Search/browsing, stato account, area, timestamp e output consentito dai termini applicabili.
Rubrica di valutazione
- citazione presente o assente;
- supporto reale della fonte alla frase;
- accuratezza rispetto allo snapshot sorgente;
- freshness di stock, prezzo e disponibilità;
- risposta nulla, rifiuto o dato non verificabile.
Regole anti-selezione
- nessun retry per sostituire una risposta sfavorevole;
- stesso prompt nelle finestre pre e post;
- output positivi, negativi e nulli pubblicati;
- modifiche di modello e browsing annotate;
- nessuna menzione equivale automaticamente a citazione.
Stato machine-readable del lavoro
Il prompt set candidato e il correction log sono statici e versionati. Al momento dichiarano zero run completati e nessun output pubblicato.






