«Quanto sei soddisfatto del tuo corso di laurea?» Sotto la domanda cinque caselle, da «per niente» a «moltissimo». Il formato compare in quasi ogni questionario e ha un nome preciso: scala di valutazione.
Una scala di valutazione è un formato di risposta graduato con cui chi risponde indica quanto è forte una caratteristica, di solito su cinque o sette gradini fra due estremi. Dopo questo articolo saprai quanti gradini scegliere, come etichettarli e quale indicatore puoi riportare.
📌 I punti chiave
- Una scala di valutazione misura gradazioni, non risposte secche.
- Le linee guida GESIS consigliano da cinque a sette gradini.
- In senso stretto una scala di valutazione misura a livello ordinale.
- Ogni gradino riceve una parola, non solo i due estremi.
- «Non so» non è un gradino e sta a parte.
Crea un sondaggio gratis
Con empirio.ai crei un moderno sondaggio online in pochi minuti — con hosting nell'UE.
- Sondaggio creato con IA
- Modifica con drag & drop
- Analisi in tempo reale
Che cos’è una scala di valutazione?
Una scala di valutazione è un formato di risposta chiuso e graduato, con più categorie ordinate, con cui una persona intervistata dichiara quanto una certa caratteristica vale per lei, per esempio da «per niente soddisfatto» a «molto soddisfatto». Il termine viene dall’inglese rating, cioè valutazione o giudizio. Nella metodologia italiana le singole caselle hanno anche un nome tecnico: modalità di risposta.
Il vantaggio si vede nel confronto con una domanda secca. Una domanda a cui si risponde sì o no separa due gruppi e basta, mentre una scala di valutazione mostra quanto una persona si sposta verso uno dei due estremi. Fra i tipi di domande di un questionario è quindi il formato standard per atteggiamenti, soddisfazione e autovalutazioni, tanto in un sondaggio online quanto su carta.
Le scale di valutazione compaiono in due ruoli molto diversi. Nell’autovalutazione una persona giudica sé stessa, per esempio quanto si sente preparata prima di un esame. Nell’eterovalutazione qualcun altro giudica quella stessa persona, per esempio un allenatore che valuta l’impegno di chi gioca. La scala ha lo stesso aspetto nei due casi, ma le fonti di errore cambiano parecchio.
Una scala di valutazione non misura come stanno le cose, ma come vengono percepite.
Serve infine una distinzione che online crea confusione di continuo. In finanza la parola rating indica le classi di merito creditizio con cui banche e agenzie ordinano il rischio di insolvenza, e con i questionari non ha nulla a che vedere. Qui parliamo soltanto del formato di risposta.
Che livello di misurazione ha una scala di valutazione?
In senso stretto una scala di valutazione misura a livello ordinale. I gradini stanno in un ordine chiaro, ma nessuno può dimostrare che la distanza fra «poco» e «abbastanza» sia la stessa che separa «abbastanza» da «molto».
Nei manuali trovi per questo due risposte diverse. I materiali di metodologia della TU Dresda registrano apertamente che è dibattuto se queste scale misurino a livello ordinale oppure a intervalli (TU Dresda, metodi della psicologia). Per la tua tesi la questione si risolve però con una domanda sola: hai davanti un singolo item oppure più item che confluiscono in un punteggio unico?
Scala di valutazione e scala Likert: dove sta la differenza
Una scala Likert è una forma particolare di scala di valutazione, non un’alternativa. La riconosci da tre cose: una dimensione di accordo, più item sullo stesso concetto e un punteggio complessivo calcolato su tutti gli item. Un item preso da solo si chiama più correttamente item Likert e resta ordinale. Che cosa serva in più lo trovi nell’articolo sulla scala Likert.
Il punteggio costruito su più item viene invece trattato quasi sempre come una scala a intervalli. Sommare non alza il livello di misurazione. Regge piuttosto un altro argomento: un punteggio del genere ha molte gradazioni e le procedure abituali si sono dimostrate robuste rispetto a questa violazione. Resta comunque un’assunzione.
Per il capitolo metodologico
Aggiungi una riga ogni volta che calcoli una media sulle modalità di risposta: «Le modalità di risposta sono state trattate come equidistanti.» Quella riga toglie alla commissione la domanda prima che arrivi. Senza, l’analisi rivendica un livello di misurazione che i dati non hanno.
Quali tipi di scale di valutazione esistono?
Le scale di valutazione non si distinguono soltanto per la lunghezza. Cambiano lungo due decisioni di progetto: la direzione che la scala copre e il modo in cui i gradini sono marcati.
Una terza differenza è più tecnica. La quasi totalità delle scale è a gradini discreti, cioè offre un numero fisso di caselle e in mezzo non c’è nulla. Le scale continue usano invece un cursore da spostare lungo una linea e hanno senso quasi solo online.
Unipolare o bipolare: quante direzioni copre la scala
Un avvertimento va messo prima degli esempi. Le linee guida GESIS annotano che in letteratura non esiste una definizione unitaria della polarità. Chi in una tesi definisce una scala unipolare o bipolare fa quindi bene a scrivere a quale definizione si attiene, altrimenti la parola vale poco.
Una scala unipolare rappresenta l’intensità di una caratteristica sola, da zero fino al massimo. Esempio: «Quanto ti disturba il rumore in biblioteca?», con gradini che vanno da «per niente» a «moltissimo». Non esiste un polo opposto, esiste solo più o meno della stessa cosa.
Una scala bipolare mette due caratteristiche opposte alle due estremità. Esempio: «Il clima nella tua squadra di pallavolo è…», con gradini che dal «teso» arrivano al «disteso» passando per il centro. I due poli si definiscono a vicenda, ed è questo a rendere la forma impegnativa, perché il centro deve voler dire qualcosa.
Parole, numeri o simboli: come sono marcati i gradini
Le marche sono ciò che le persone vedono davvero sullo schermo, e cambiano il modo in cui rispondono. I materiali della TU Dresda ne distinguono quattro forme: verbale, numerica, simbolica e grafica. Ognuna ha il suo terreno e nessuna funziona ovunque.
| Forma della marca | Come si presenta | A che cosa serve |
|---|---|---|
| Verbale | una parola per ogni gradino | caso standard, meno equivoci |
| Numerica | numeri, per esempio da 1 a 10 | sistemi già noti come i voti |
| Simbolica | faccine, stelle, pollici | bambini, feedback rapidi |
| Grafica | un punto scelto su una linea | gradazioni fini online |
Il caso italiano: lo stesso numero su due scale diverse
I numeri sembrano inequivocabili e in Italia non lo sono affatto, perché il paese usa due sistemi di voto uno accanto all’altro. A scuola si vota in decimi: la valutazione periodica e finale nel primo ciclo «è espressa con votazioni in decimi che indicano differenti livelli di apprendimento» (decreto legislativo 62/2017, articolo 2), e la soglia che tutti hanno in testa è il 6.
All’università la scala cambia del tutto. Il regolamento carriera studente dell’Università di Trieste lo scrive così: «La valutazione degli esami viene espressa in trentesimi con la possibilità della lode. L’esame si intende superato con una votazione minima di 18/30» (UniTS, articolo 27). Una scala che parte da 18, arriva a 30, tiene la lode come gradino in più e convive con il voto di laurea, contato in centodecimi.
Un numero da solo, quindi, non dice niente. Un 18 all’università è una promozione, mentre nella scala scolastica in decimi quel numero non esiste nemmeno. Nel tuo questionario vale la stessa regola: se offri una scala numerica nuda, etichetta almeno i due estremi, come fa il Net Promoter Score con la sua scala da 0 a 10.

Quanti gradini deve avere una scala di valutazione?
Da cinque a sette gradini è la raccomandazione corrente. Le linee guida GESIS riassumono così la letteratura: la misurazione risulta ottimale quanto ad attendibilità, validità e capacità di distinguere con un numero di categorie compreso fra cinque e sette, ed è anche l’intervallo che le persone intervistate preferiscono (Menold e Bogner 2015, GESIS Survey Guidelines).
La questione però non è chiusa. La stessa guida cita lavori più recenti in cui la qualità della misura continua a crescere con il numero di categorie, provato fino a 10, a 11 e persino a 100 gradini. La regola pratica di cinque o sette gradini ha comunque vinto, per un motivo concreto: oltre quel numero non riesci più a dare una parola a ogni gradino.
Per il tuo questionario la traduzione è semplice. Resta su cinque se etichetti ogni gradino, sali a sette se ti servono differenze più fini.
Numero pari o dispari: la questione del centro
Un numero dispari di gradini ha un centro, un numero pari costringe a sbilanciarsi. Le due scelte sono entrambe difendibili e dipendono da una domanda sola: una posizione intermedia esiste davvero nel merito? Per «Quanto sei soddisfatto della mensa?» l’indecisione è reale, per «Rifaresti questo laboratorio?» molto meno.
Le linee guida GESIS riassumono che la maggior parte di chi fa ricerca consiglia di offrire la categoria centrale. Il motivo non è la comodità ma la qualità del dato: senza centro, chi ha davvero una posizione neutra ripiega su un gradino vicino e sposta il risultato in una direzione che non esiste. Il prezzo da pagare è la tendenza al centro.
Una particolarità riguarda le scale bipolari. Al centro possono convivere due significati diversi: indifferenza, nel senso di «né l’uno né l’altro», oppure ambivalenza, nel senso di «un po’ e un po’». L’unico modo per separarli è aggiungere una categoria staccata come «non saprei giudicare».
Attenzione
«Non so» e «preferisco non rispondere» non sono gradini della scala e non vanno messi al centro. Il loro posto è staccato, in fondo all’elenco, e in analisi contano come valore mancante. Se convenga offrirli dipende, secondo le linee guida GESIS, dal tema, dalla modalità di rilevazione e dal pubblico. La stessa fonte rimanda ai lavori di Sturgis e colleghi: senza quella opzione le persone usano la categoria centrale come sostituto, i cosiddetti «face saving don’t knows».
Crea un sondaggio gratis
Con empirio.ai crei un moderno sondaggio online in pochi minuti — con hosting nell'UE.
- Sondaggio creato con IA
- Modifica con drag & drop
- Analisi in tempo reale
Etichettare i gradini: quali parole usare in italiano
Dai una parola a ogni gradino, non soltanto ai due estremi. Le linee guida GESIS si esprimono a favore delle scale interamente verbalizzate, perché alzano attendibilità e validità e perché sono quelle che le persone preferiscono. La differenza si vede soprattutto con chi ha un titolo di studio più basso.
Le parole buone rispettano quattro condizioni: sono precise, si distribuiscono in modo simmetrico fra il lato positivo e quello negativo, le capisce chiunque e le distanze fra l’una e l’altra sembrano uguali. L’ultima è di gran lunga la più difficile, perché «spesso» e «qualche volta» non stanno alla stessa distanza per tutti.
Proprio l’ultima condizione porta al punto che quasi nessuno dice: quelle distanze sono legate alla lingua e non si traducono. In area tedesca esiste una taratura empirica famosa, quella di Bernd Rohrmann del 1978, che propose serie di parole con passi il più possibile regolari. Le sue serie sono calibrate sul tedesco e restano lì: tradotte in italiano perderebbero la proprietà per cui erano nate.
Formulazioni italiane già collaudate sul campo
L’Istat, nella rilevazione sulla soddisfazione dei propri utenti, descrive la scelta per esteso: «una scala a parziale autonomia semantica basata su quattro categorie di affermazioni che esprimono un giudizio da negativo a positivo: “per niente”, “poco”, “mediamente” e “molto” soddisfatto» (Istat, soddisfazione degli utenti, anno 2023). Due serie pronte da riusare:
- Soddisfazione: per niente, poco, mediamente, molto soddisfatto
- Fiducia: quattro gradini da «nessuna fiducia» a «piena fiducia»
L’espressione «autonomia semantica» non è un vezzo da manuale. La metodologia italiana la usa per dire quanto una categoria significhi qualcosa da sola: «l’autonomia semantica è una proprietà di una categoria», si legge nella lezione di Amalia Caputo per il corso di tecniche di ricerca sociale dell’Università di Napoli Federico II (Federica, Federico II). «Molto soddisfatto» si capisce da solo, «abbastanza» solo guardando gli altri gradini.
Consiglio
Chiedi della cosa, non dell’accordo. Invece di «Uso spesso i sondaggi» con una scala di accordo, chiedi «Quanto spesso usi i sondaggi?» con una scala di frequenza. Le linee guida GESIS sconsigliano le scale di accordo, perché producono più adesione delle scale che chiedono direttamente della caratteristica.
Analizzare una scala di valutazione: quale indicatore puoi riportare
Riporta sempre per prima la distribuzione delle frequenze, cioè quante persone hanno scelto ciascun gradino. Quel dato è ammesso a qualunque livello di misurazione, non si perde nel riassunto e mostra cose che ogni singolo indicatore nasconde.
Un esempio con numeri veri aiuta più di qualunque regola. Due laboratori vengono valutati su una scala da 1 a 7 e in ciascuno rispondono venti persone. Nel laboratorio A tutte e venti scelgono il 5. Nel laboratorio B dieci scelgono il 3 e dieci scelgono il 7. La media vale 5,0 in entrambi i casi e anche la mediana vale 5 in entrambi. La differenza salta fuori solo guardando la distribuzione.
| Indicatore | Quando va bene | Che cosa mostra |
|---|---|---|
| Distribuzione delle frequenze | sempre | quante persone per ogni gradino |
| Moda | sempre | il gradino scelto più spesso |
| Mediana | su un singolo item | la risposta centrale |
| Media | su un punteggio di scala | il valore medio su più item |
| Deviazione standard | su un punteggio di scala | quanto le risposte si disperdono |
| Top-two box | per report e presentazioni | quota dei due gradini più alti |
Media o mediana: da che cosa dipende la scelta
La media non è vietata, ma va motivata. Su un singolo item la mediana è la scelta più prudente, perché presuppone soltanto un ordine fra i gradini. Su un punteggio costruito con più item che misurano lo stesso concetto la media è abituale e difendibile, a patto che nel capitolo metodologico l’equidistanza compaia come assunzione dichiarata.
Per i confronti fra gruppi vale la stessa divisione. I singoli item si confrontano con procedure basate sui ranghi, i punteggi di scala anche con procedure che poggiano su media e dispersione, come spiega l’articolo su statistica descrittiva e statistica inferenziale.
La top-two box e quello che nasconde
Torniamo ai due laboratori, perché lì la media non basta proprio. La quota di chi ha scelto uno dei due gradini più alti, la cosiddetta top-two box, vale 0 per cento nel laboratorio A e 50 per cento nel laboratorio B, a parità di media e di mediana. Un indicatore del genere è legittimo e costa informazione: chi lo riporta mette la distribuzione completa in appendice.
Errori tipici nelle scale di valutazione
La maggior parte dei difetti di una scala di valutazione nasce quando la scrivi, non quando la calcoli. Con tendenze di risposta si indica la propensione a spostare le risposte in una direzione fissa, a prescindere dal contenuto della domanda. Non riguardano tutti, ma in chi ne è toccato vanno in una direzione prevedibile.
I quattro schemi seguenti sono ben documentati e riassunti nelle linee guida GESIS dedicate alle tendenze di risposta (Bogner e Landrock 2015). Contro nessuno di questi serve un campione più grande, mentre serve un questionario migliore.
La tendenza al centro tira le risposte verso la metà
Alcune persone scelgono i gradini centrali a prescindere dal contenuto, perché costa meno fatica che prendere posizione. Ne esce una distribuzione più equilibrata di quanto siano gli atteggiamenti reali. Aiuta una scala interamente verbalizzata, e quando una posizione intermedia non esiste nel merito la soluzione più semplice è un numero pari di gradini.
L’acquiescenza porta a dire di sì a tutto
Acquiescenza è il nome della propensione ad approvare qualunque affermazione, barrando ovunque «d’accordo», «vero» o «sì». Le linee guida GESIS indicano un solo rimedio davvero efficace: rinunciare alle scale di accordo e chiedere direttamente della caratteristica. Chi resta sull’accordo può invertire metà degli item, il che rende visibile la tendenza ma non salva correlazioni e struttura fattoriale.
La desiderabilità sociale abbellisce le domande scomode
Sui temi che chi risponde percepisce come delicati arriva la risposta attesa al posto di quella vera. I comportamenti fuori norma vengono ridimensionati, quelli conformi gonfiati. Buona notizia per i sondaggi online: le linee guida GESIS registrano che la tendenza è più debole quando non c’è una persona che intervista.
Le risposte estreme non dipendono solo dal tema
Le risposte estreme sono il rovescio della tendenza al centro, cioè la propensione a scegliere i gradini più esterni a prescindere dal contenuto. Se dietro ci sia un tratto stabile della persona la ricerca non lo ha ancora deciso. Documentato è invece che, secondo le stesse linee guida, questionari scritti e online ne risentono meno delle interviste telefoniche.
Un ultimo errore riguarda l’aspetto grafico e passa quasi sempre inosservato. I gradini devono risultare equidistanti anche a vedersi, altrimenti il centro visivo della scala non coincide più con quello logico. Altre viti da stringere le trovi nei consigli per i sondaggi online.
Conclusione
Una scala di valutazione si inserisce in un minuto e si rovina altrettanto in fretta. Cinque gradini interamente etichettati, una decisione consapevole sul centro e una altrettanto consapevole sul «non so» portano più qualità di qualunque persona intervistata in più. In fase di analisi vale una regola sola: la distribuzione entra sempre nel report, la media soltanto con una motivazione.
Resta una cosa sola da fare prima di mandare il questionario: rileggere la scala ad alta voce, gradino per gradino. Se una parola ti fa esitare mentre la leggi, farà esitare anche chi risponde, e quella esitazione finirà dritta nei tuoi dati.
Come proseguire
- Vuoi vedere tutti i livelli di misurazione insieme? Determinare il livello di misurazione
- Lavori con item di accordo? Scala Likert
- Cerchi il formato di risposta giusto? Tipi di domande nel questionario
- Vuoi misurare la soddisfazione del tuo team? Sondaggio sulla soddisfazione dei dipendenti
Vuoi provare la tua scala prima di mandarla in giro?
Con empirio.ai, uno strumento per sondaggi online dalla Germania, crei una scala graduata in pochi minuti e dopo qualche risposta di prova vedi se la distribuzione regge quello che vuoi raccontare.
