Facciamo una piccola prova: due persone analizzano lo stesso questionario e arrivano a due conclusioni diverse. Il questionario non è formulato male. Semplicemente non è obiettivo.
I criteri di qualità rispondono a domande diverse, e la psicometria italiana ne mette due al centro, mentre l’obiettività rientra di norma nella standardizzazione. L’attendibilità, chiamata anche fedeltà, indica che uno strumento misura con precisione, cioè con il minor errore di misurazione possibile; la validità indica che misura davvero la caratteristica per cui è stato costruito e non un’altra; l’obiettività indica che il risultato non dipende da chi somministra, corregge e interpreta la rilevazione. Alla fine di questa guida sai motivare, per la tua indagine, quale criterio soddisfi e quale lasci consapevolmente aperto.
📌 In breve
- L’attendibilità indica quanto piccolo è l’errore di misurazione.
- La validità dice che misuri davvero la caratteristica voluta.
- In Italia i criteri generali di un test sono due, non tre.
- Fedeltà e attendibilità sono due nomi per la stessa proprietà.
- Il CNOP richiama l’articolo 7 del Codice Deontologico.
Crea un sondaggio gratis
Con empirio.ai crei un moderno sondaggio online in pochi minuti — con hosting nell'UE.
- Sondaggio creato con IA
- Modifica con drag & drop
- Analisi in tempo reale
Obiettività, attendibilità, validità: quali criteri valgono in Italia
Le caratteristiche generali di un test, nella psicometria italiana, sono due: la fedeltà, chiamata anche attendibilità, e la validità. La prima riguarda la precisione della misura, la seconda il fatto che venga misurata davvero la caratteristica voluta.
Nelle sue Lezioni di Psicometria per l’Università degli Studi di Milano-Bicocca, Giovanni Battista Flebus (2020) elenca le due proprietà una di seguito all’altra: la fedeltà come proprietà di fornire misurazioni prive di errori di misurazione, la validità come proprietà di misurare realmente la caratteristica per cui il test è stato costruito. Le slide sulla fedeltà di un test sono liberamente accessibili e mostrano anche come si ricava il coefficiente.
La manualistica in lingua tedesca segue invece una convenzione diversa e arriva a dieci criteri, con l’obiettività come terza proprietà principale. Helfried Moosbrugger e Augustin Kelava elencano nel manuale Testtheorie und Fragebogenkonstruktion (Springer, 2012), accanto alla triade, scalatura, taratura, economicità, utilità, sostenibilità, non falsificabilità ed equità, come si legge nel capitolo 2 del volume. Sapere che quella lista è una convenzione nazionale ti evita di presentarla come universale in una tesi italiana.
| Criterio | La domanda dietro | Come lo verifichi |
|---|---|---|
| Fedeltà o attendibilità | La ripetizione dà lo stesso punteggio? | coefficiente di fedeltà tra 0 e 1 |
| Validità | Viene misurata la caratteristica voluta? | prove di contenuto, di costrutto, di criterio |
| Obiettività | Il risultato dipende da chi somministra? | regole fisse di somministrazione e di scoring |
Per una tesi di laurea la scelta ragionevole è partire dalle due proprietà che il tuo ateneo si aspetta e nominare l’obiettività come aspetto della standardizzazione. Chi vuole vedere come i criteri si inseriscono nell’impianto complessivo trova il quadro nella guida alla ricerca quantitativa.
Attendibilità o fedeltà: perché i manuali italiani usano due nomi
Nei manuali italiani la stessa proprietà compare sotto due etichette. Fedeltà è il termine classico della psicometria, attendibilità quello oggi più diffuso, e Flebus (2020) li mette sullo stesso piano scrivendo «Fedeltà (o Attendibilità)» nell’elenco delle caratteristiche generali di un test. In circolazione trovi anche affidabilità e precisione come sinonimi, mentre coerenza interna indica in senso stretto soltanto uno dei modi per stimarla. Nella tua tesi scegli un termine e mantienilo dalla prima all’ultima pagina, perché alternarli fa sembrare che tu stia parlando di due proprietà diverse.
In Italia non esiste un ente che recensisce i test
Un elenco nazionale di test recensiti, in Italia, non esiste. La qualità dei reattivi viene regolata per via deontologica: il Consiglio Nazionale dell’Ordine degli Psicologi (CNOP), nel documento Garantire criteri indispensabili nell’uso dei test psicometrici del 27 febbraio 2024, richiama l’articolo 7 del Codice Deontologico, secondo cui lo psicologo valuta attentamente il grado di validità e di attendibilità di informazioni, dati e fonti su cui basa le conclusioni raggiunte, insieme agli articoli 5 e 6 su competenza e autonomia professionale.
Nello stesso documento il CNOP contesta che alcuni editori offrano lo scoring solo a pagamento, esclusivamente online e «completamente in cieco rispetto ai dati normativi», con la conseguenza che chi lavora con quei test non può più valutarne da sé validità e attendibilità, e per questo ha istituito un tavolo di lavoro. Per la tua tesi la conseguenza è semplice: il criterio non arriva da un bollino esterno, ma dalla motivazione che scrivi tu.

Obiettività: il risultato dipende da chi somministra il questionario?
L’obiettività è la proprietà per cui il risultato di una rilevazione non dipende dalla persona che la conduce, la corregge e la interpreta. In pratica significa che chi somministra il questionario non ha margini di manovra.
Nella tradizione di lingua tedesca l’obiettività è un criterio autonomo, e i tre aspetti in cui viene distinta risalgono a Gustav Lienert e Ulrich Raatz (1998), ripresi in quella forma da Moosbrugger e Kelava. In Italia la stessa esigenza rientra nella standardizzazione della somministrazione, ma i tre aspetti restano una griglia utile, perché indicano tre punti diversi in cui il tuo margine di arbitrio può entrare nei dati. In un sondaggio online il primo dei tre è quasi automatico, dato che tra chi conduce la ricerca e chi risponde non avviene alcun colloquio. La definizione di obiettività con esempi sta in una scheda a parte.
Obiettività nella somministrazione: stesse condizioni per tutti
La somministrazione è obiettiva quando il risultato non dipende da chi conduce la rilevazione. La leva si chiama standardizzazione: istruzioni, ordine delle domande, tempi e formati di risposta sono fissati prima e non cambiano tra un rispondente e l’altro. L’obiettivo ideale è che la persona che risponde resti l’unica fonte di variazione nella situazione. Un questionario distribuito con un link, identico per tutti, soddisfa questa condizione quasi da solo.
Obiettività nello scoring: stesse risposte, stessa codifica
Lo scoring è obiettivo quando, a parità di risposte, persone diverse arrivano allo stesso punteggio. Con le domande chiuse e le loro alternative già date il problema quasi non si pone, perché non c’è nulla da interpretare. Appena inserisci domande aperte, invece, lo scoring perde obiettività, dato che i testi liberi vanno categorizzati. Non è un motivo per rinunciarvi, ma richiede uno schema di categorie documentato.
Obiettività nell’interpretazione: stessi punteggi, stessa conclusione
L’interpretazione è obiettiva quando persone competenti traggono dallo stesso punteggio la stessa conclusione. Nella pratica è l’aspetto più debole dei tre, perché servirebbero dati normativi o soglie chiare, cioè una taratura su un campione di riferimento. In una rilevazione condotta per una tesi quella taratura non esiste. Quello che puoi fare è fissare le regole di lettura prima di guardare i dati e dichiararle nel capitolo di metodo, invece di ritagliarle sul risultato ottenuto.
💡 Consiglio
Scrivi le regole di codifica delle domande aperte prima di leggere la prima risposta. Chi costruisce lo schema di categorie sul materiale già raccolto non può più escludere che le categorie siano state ritagliate sul risultato desiderato. In sede di discussione è la domanda più scomoda che ti possa arrivare.
Attendibilità: una ripetizione porta allo stesso punteggio?
L’attendibilità, o fedeltà, è la proprietà di un test di fornire misurazioni prive di errori di misurazione. La grandezza che la esprime è il coefficiente di fedeltà, che va da 0 a 1.
Un coefficiente pari a 1 descrive una misurazione perfettamente fedele, un coefficiente pari a 0 un punteggio dovuto interamente all’errore, e nella realtà, come nota Flebus (2020), il valore sta quasi sempre in una posizione intermedia. Una soglia fissata da una norma italiana non esiste. Lo 0,70 che circola nelle tesi viene dal manuale di Moosbrugger e Kelava, dove figura come valore auspicato e non come soglia sotto la quale una scala diventerebbe inutilizzabile, quindi conta più il modo in cui commenti il valore che il valore stesso.
Per stimare l’attendibilità la teoria classica dei test usa quattro procedure. Quale sia praticabile nella tua tesi dipende meno dalla statistica che dalla possibilità di raggiungere una seconda volta le persone che hanno risposto.
| Procedura | Come funziona | Praticabile in una tesi? |
|---|---|---|
| Test-retest | stesso test in due momenti diversi | di rado, i rispondenti non si ritrovano |
| Forme parallele | due forme con stesse medie e varianze | quasi mai, servono troppi item |
| Metà del test (split-half) | correlazione tra le due metà | sì, con la formula di Spearman-Brown |
| Coerenza interna | ogni item come parte a sé del test | sì, è il caso normale |
Le forme parallele sono considerate la via maestra, perché eliminano gli effetti di memoria e di esercizio, ma richiedono due versioni con gli stessi punteggi veri e la stessa varianza di errore. Per una tesi triennale o magistrale la strada realistica resta quasi sempre la coerenza interna.
Alfa di Cronbach: che cosa dimostra e che cosa no
L’alfa di Cronbach misura quanto gli item di una scala vanno d’accordo tra loro ed è oggi il modo più diffuso per stimare la fedeltà di una misurazione psicologica. Il valore viene però sovrainterpretato con una certa regolarità: un alfa alto non dimostra che la scala misuri una sola dimensione e cresce già solo perché la scala contiene più item. Quando gli item non pesano allo stesso modo sulla caratteristica, l’alfa sottostima la fedeltà reale. Klaas Sijtsma ha esposto in dettaglio questi limiti nel 2009 sulla rivista Psychometrika, e da allora l’omega di McDonald viene spesso indicato come alternativa.
Per una tesi di laurea non significa che tu debba calcolare l’omega. Significa che l’alfa va accompagnato da mezza frase di commento invece di essere presentato come una prova, ed è esattamente il genere di precisazione che distingue un capitolo di metodo buono da uno nella media.

Validità: il questionario misura davvero la caratteristica voluta?
La validità è la proprietà di un test di misurare realmente la caratteristica per cui è stato costruito, e non un’altra. Nessun numero singolo la dimostra, a differenza di quanto accade con il coefficiente di fedeltà.
Le prove di validità si mettono insieme da fonti diverse, e quali siano verificabili dipende dal caso concreto. Quattro aspetti compaiono in quasi tutti i capitoli di metodo, e conviene chiamarli con il loro nome anche nella tua tesi.
- Validità di contenuto: gli item coprono la caratteristica in modo rappresentativo? Una domanda che si argomenta, non si calcola.
- Validità apparente: il test sembra plausibile a chi lo compila? Riguarda l’accettazione, non la capacità informativa.
- Validità di costrutto: il passaggio dalle risposte alla caratteristica è fondato sulla teoria? Si mostra con le correlazioni attese.
- Validità di criterio: dal punteggio si risale a un comportamento esterno? Concorrente se il criterio è simultaneo, predittiva se è futuro.
L’errore più frequente: contenuto e apparenza non sono la stessa cosa
Capita spesso di leggere che validità di contenuto e validità apparente siano due nomi per la stessa proprietà. Non è così, e la differenza sta in chi giudica e in base a che cosa. La validità di contenuto è un giudizio esperto sulla copertura della caratteristica, la validità apparente è l’impressione di plausibilità che il test dà a chi lo compila. Un questionario può sembrare del tutto sensato e misurare comunque un’altra cosa, e viceversa uno strumento impeccabile può risultare incomprensibile a chi risponde.
⚠️ Attenzione
Evita nella tesi la formula «validità di contenuto ovvero apparente». Equiparare i due termini apre un fianco alla prima domanda di metodo in sede di discussione. Argomenta la validità di contenuto come giudizio motivato e cita la validità apparente al massimo come argomento sull’accettazione da parte di chi risponde.
Una seconda imprecisione riguarda la validità interna ed esterna. I due termini valutano il disegno della ricerca e rispondono alle domande se il nesso causale regga dentro lo studio e se i risultati valgano oltre il campione osservato. Non sono sottotipi della validità di contenuto o di costrutto, anche se molti riassunti li sistemano lì, e mescolare i due impianti costa proprio la precisione che viene valutata.

Crea un sondaggio gratis
Con empirio.ai crei un moderno sondaggio online in pochi minuti — con hosting nell'UE.
- Sondaggio creato con IA
- Modifica con drag & drop
- Analisi in tempo reale
Come si legano tra loro obiettività, attendibilità e validità
L’attendibilità è la condizione della validità, e il legame vale in una sola direzione. Moosbrugger e Kelava scrivono che obiettività e attendibilità forniscono soltanto le condizioni favorevoli a una validità elevata e che un test poco fedele non può raggiungere una validità elevata.
La frase citata dal manuale sembra tecnica e regge invece tutto l’impianto: una misura fedele può comunque mancare il bersaglio, mentre una misura infedele non può centrarlo. Nella teoria classica dei test vale lo stesso principio in termini di varianza, perché quanta più varianza è dovuta all’errore, tanto meno ne resta da spiegare con la caratteristica vera. La standardizzazione viene prima nella pratica, dato che una rilevazione che cambia esito a seconda di chi la conduce difficilmente produce valori stabili, ma come condizione formale il manuale non la enuncia, a differenza del legame tra attendibilità e validità.
Una bilancia che segna sempre due chili in più rende concreta la differenza. Funziona per tutti allo stesso modo, quindi è standardizzata. Ripetendo la pesata restituisce tre volte lo stesso numero, quindi è fedele. Valida non lo è, perché sbaglia in modo sistematico, ed è il caso più frequente nei questionari: valori alti di attendibilità e una caratteristica colpita solo di striscio.
Che cosa ne segue per l’ordine del capitolo di metodo
- Chiarisci per prima cosa che la rilevazione è uguale per tutti.
- Verifica poi la coerenza interna delle tue scale.
- Argomenta solo alla fine la copertura della caratteristica.
- Riporta anche un valore basso, invece di ometterlo.
Un questionario fedele misura in modo preciso. Se misuri la cosa giusta, resta una domanda aperta.
I criteri valgono anche nella ricerca qualitativa?
Attendibilità e validità nascono per le misurazioni standardizzate e non si trasferiscono immutate alle procedure qualitative. Un’intervista con traccia non deve dare lo stesso esito a ogni ripetizione, proprio perché segue la singola persona.
Nella ricerca qualitativa sono nati per questo cataloghi di criteri autonomi. Il più citato resta la proposta di Yvonna Lincoln ed Egon Guba in Naturalistic Inquiry (Sage, 1985), con credibilità, trasferibilità, dipendibilità e confermabilità al posto della coppia classica. Occhio al termine dipendibilità, reso a volte con affidabilità: nella ricerca qualitativa indica la tracciabilità del percorso, non la precisione di una misura.
Per la tua tesi la conseguenza pratica è contenuta. Se conduci un’indagine qualitativa, non scrivere di alfa di Cronbach, ma documenta selezione, svolgimento e analisi in modo che un’altra persona possa ripercorrere la strada. Quali criteri stiano affiancati nelle due logiche di ricerca lo trovi nella guida ai criteri di qualità della ricerca quantitativa e qualitativa.
Dove inserire i criteri di qualità nella tesi di laurea
I criteri di qualità non hanno una collocazione fissa nell’indice di una tesi di laurea. Due soluzioni sono diffuse ed entrambe difendibili: un paragrafo dedicato dentro il capitolo sul disegno della ricerca, oppure una sezione nella riflessione sul procedimento.
Quale delle due sia adatta dipende da quanto vada motivata la scelta metodologica rispetto alla tua domanda di ricerca. Se il metodo è al centro, i criteri stanno bene in apertura, dentro il disegno. Se contano soprattutto i risultati di contenuto, funzionano meglio in coda. Nel dubbio chiedi a chi ti segue: alcuni corsi di laurea hanno un’aspettativa precisa e la comunicano solo su richiesta.
Prima soluzione: i criteri di qualità nel capitolo sul disegno della ricerca
La collocazione in apertura conviene quando motivi a lungo la scelta del metodo e i criteri di qualità fanno parte di quella motivazione. Il vantaggio è che chi legge ha già chiarita la questione della qualità prima di vedere i risultati, e in sede di discussione la relatrice o il relatore trova la risposta dove se la aspetta. Il prezzo è che a quel punto non sai ancora quali scale risulteranno deboli, quindi metti in conto di tornarci più avanti.
- Introduzione con la domanda di ricerca
- Teoria e stato della ricerca
- Disegno della ricerca, con ipotesi, scelta del metodo, popolazione e campione, variabili, questionario, criteri di qualità
- Rilevazione dei dati
- Analisi dei dati
- Risultati
- Riflessione sul procedimento
- Conclusioni
Seconda soluzione: i criteri di qualità nella riflessione sul procedimento
La collocazione in coda conviene quando i limiti della rilevazione si lasciano nominare con precisione solo alla luce dei risultati. La struttura resta la stessa, cambia soltanto il punto: i criteri di qualità si spostano al punto 7 e vengono discussi insieme ai limiti del lavoro. Il vantaggio sta nell’onestà, perché scrivi di valori davvero ottenuti e non di intenzioni. Il prezzo è che la critica metodologica arriva molto tardi e viene letta in fretta.
Le due soluzioni vengono valutate con lo stesso metro: non viene valutato se la rilevazione soddisfa tutti i criteri, ma se risulta chiaro quali siano soddisfatti e dove stiano i limiti.

Errori tipici sui criteri di qualità
La maggior parte delle osservazioni sul capitolo di metodo non nasce da valori bassi, ma da affermazioni che pretendono più di quanto i dati concedano. Tre errori tornano con particolare frequenza.
Tutti e tre gli errori hanno la stessa origine: un criterio di qualità viene chiamato a rispondere di qualcosa per cui non è fatto. Tenendo separate le proprietà si evitano quasi da sé, e il capitolo di metodo ne esce più corto invece che più lungo.
Primo errore: presentare un alfa alto come prova di validità
Un alfa di Cronbach pari a 0,89 dice che gli item di una scala sono strettamente collegati tra loro. Non dice nulla sul fatto che quegli item colgano la caratteristica voluta. Chi dopo il valore dell’alfa scrive che la scala è quindi valida trae proprio la conclusione che la teoria dei test esclude. La via d’uscita è un paragrafo in più sulla validità di contenuto, in cui motivi perché gli item coprono l’ambito.
Secondo errore: considerare chiusa la standardizzazione perché il sondaggio è online
Un sondaggio online mette al sicuro le condizioni di somministrazione, perché tutte le persone vedono la stessa cosa. Lo scoring e l’interpretazione restano però scoperti. Appena compaiono domande aperte o soglie scelte liberamente, il margine di arbitrio rientra dalla finestra. La via d’uscita è nominare i tre aspetti separatamente, invece di archiviare la questione in blocco.
Terzo errore: non riportare i valori deboli
Un coefficiente di fedeltà pari a 0,58 non è un motivo per togliere una scala dal lavoro o per tacere il numero. Viene valutato il confronto con il dato, non il dato in sé. Chi riporta il valore, spiega da che cosa dipende con ogni probabilità e formula l’interpretazione con la prudenza necessaria mostra proprio la maturità metodologica che viene chiesta. I valori taciuti, invece, saltano fuori al più tardi in sede di discussione.
Conclusione
Attendibilità e validità non sono ostacoli da superare, ma due domande a cui rispondi. Una soddisfazione piena è rara anche negli studi professionali e nessuno la pretende in una tesi di laurea. Viene chiesto di tenere distinte le proprietà e di dire apertamente dove la tua rilevazione arriva al limite.
Come proseguire
- Vuoi costruire il questionario da zero? Come creare un questionario: passaggi e struttura
- Ti serve la definizione di un singolo termine? Che cosa significa validità? e Che cosa significa affidabilità?
- Cerchi la procedura di analisi adatta? Metodi di analisi dei dati: quale scegliere
- Vuoi tenere sotto controllo l’intero percorso? Fondamenti della ricerca empirica
Il nostro consiglio di lettura: Flebus, Giovanni Battista (2020): La fedeltà di un test. Lezioni di Psicometria, Università degli Studi di Milano-Bicocca. Le slide ricavano passo per passo il coefficiente di fedeltà, spiegano la formula profetica di Spearman-Brown con un esempio numerico e sono liberamente accessibili.
Vuoi che la tua rilevazione sia standardizzata fin dal primo giorno?
Con empirio.ai, uno strumento per sondaggi online realizzato in Germania, tutte le persone vedono lo stesso questionario nello stesso ordine, e la parte di somministrazione è così ampiamente al sicuro. Lo scoring e l’interpretazione restano compito tuo, perché dipendono dalle regole che scrivi e non dallo strumento.
