empirio.ai

Che cos'è una scala di valutazione? Definizione ed esempio

Quali tipi di scala di valutazione esistono, quanti gradini servono davvero e quale indicatore puoi riportare alla fine: te lo mostriamo con esempi italiani.

Autrice presso empirio.ai - Maria Malzewda Maria MalzewAggiornato il 18 settembre 2026Tempo di lettura 15 min

«Quanto sei soddisfatto del tuo corso di laurea?» Sotto la domanda cinque caselle, da «per niente» a «moltissimo». Il formato compare in quasi ogni questionario e ha un nome preciso: scala di valutazione.

Una scala di valutazione è un formato di risposta graduato con cui chi risponde indica quanto è forte una caratteristica, di solito su cinque o sette gradini fra due estremi. Dopo questo articolo saprai quanti gradini scegliere, come etichettarli e quale indicatore puoi riportare.


📌 I punti chiave

  • Una scala di valutazione misura gradazioni, non risposte secche.
  • Le linee guida GESIS consigliano da cinque a sette gradini.
  • In senso stretto una scala di valutazione misura a livello ordinale.
  • Ogni gradino riceve una parola, non solo i due estremi.
  • «Non so» non è un gradino e sta a parte.

Crea un sondaggio gratis

Con empirio.ai crei un moderno sondaggio online in pochi minuti — con hosting nell'UE.

  • Sondaggio creato con IA
  • Modifica con drag & drop
  • Analisi in tempo reale
Inizia gratis

Che cos’è una scala di valutazione?

Una scala di valutazione è un formato di risposta chiuso e graduato, con più categorie ordinate, con cui una persona intervistata dichiara quanto una certa caratteristica vale per lei, per esempio da «per niente soddisfatto» a «molto soddisfatto». Il termine viene dall’inglese rating, cioè valutazione o giudizio. Nella metodologia italiana le singole caselle hanno anche un nome tecnico: modalità di risposta.

Il vantaggio si vede nel confronto con una domanda secca. Una domanda a cui si risponde sì o no separa due gruppi e basta, mentre una scala di valutazione mostra quanto una persona si sposta verso uno dei due estremi. Fra i tipi di domande di un questionario è quindi il formato standard per atteggiamenti, soddisfazione e autovalutazioni, tanto in un sondaggio online quanto su carta.

Le scale di valutazione compaiono in due ruoli molto diversi. Nell’autovalutazione una persona giudica sé stessa, per esempio quanto si sente preparata prima di un esame. Nell’eterovalutazione qualcun altro giudica quella stessa persona, per esempio un allenatore che valuta l’impegno di chi gioca. La scala ha lo stesso aspetto nei due casi, ma le fonti di errore cambiano parecchio.

Una scala di valutazione non misura come stanno le cose, ma come vengono percepite.

Serve infine una distinzione che online crea confusione di continuo. In finanza la parola rating indica le classi di merito creditizio con cui banche e agenzie ordinano il rischio di insolvenza, e con i questionari non ha nulla a che vedere. Qui parliamo soltanto del formato di risposta.

Che livello di misurazione ha una scala di valutazione?

In senso stretto una scala di valutazione misura a livello ordinale. I gradini stanno in un ordine chiaro, ma nessuno può dimostrare che la distanza fra «poco» e «abbastanza» sia la stessa che separa «abbastanza» da «molto».

Nei manuali trovi per questo due risposte diverse. I materiali di metodologia della TU Dresda registrano apertamente che è dibattuto se queste scale misurino a livello ordinale oppure a intervalli (TU Dresda, metodi della psicologia). Per la tua tesi la questione si risolve però con una domanda sola: hai davanti un singolo item oppure più item che confluiscono in un punteggio unico?

Scala di valutazione e scala Likert: dove sta la differenza

Una scala Likert è una forma particolare di scala di valutazione, non un’alternativa. La riconosci da tre cose: una dimensione di accordo, più item sullo stesso concetto e un punteggio complessivo calcolato su tutti gli item. Un item preso da solo si chiama più correttamente item Likert e resta ordinale. Che cosa serva in più lo trovi nell’articolo sulla scala Likert.

Il punteggio costruito su più item viene invece trattato quasi sempre come una scala a intervalli. Sommare non alza il livello di misurazione. Regge piuttosto un altro argomento: un punteggio del genere ha molte gradazioni e le procedure abituali si sono dimostrate robuste rispetto a questa violazione. Resta comunque un’assunzione.

Per il capitolo metodologico

Aggiungi una riga ogni volta che calcoli una media sulle modalità di risposta: «Le modalità di risposta sono state trattate come equidistanti.» Quella riga toglie alla commissione la domanda prima che arrivi. Senza, l’analisi rivendica un livello di misurazione che i dati non hanno.

Quali tipi di scale di valutazione esistono?

Le scale di valutazione non si distinguono soltanto per la lunghezza. Cambiano lungo due decisioni di progetto: la direzione che la scala copre e il modo in cui i gradini sono marcati.

Una terza differenza è più tecnica. La quasi totalità delle scale è a gradini discreti, cioè offre un numero fisso di caselle e in mezzo non c’è nulla. Le scale continue usano invece un cursore da spostare lungo una linea e hanno senso quasi solo online.

Unipolare o bipolare: quante direzioni copre la scala

Un avvertimento va messo prima degli esempi. Le linee guida GESIS annotano che in letteratura non esiste una definizione unitaria della polarità. Chi in una tesi definisce una scala unipolare o bipolare fa quindi bene a scrivere a quale definizione si attiene, altrimenti la parola vale poco.

Una scala unipolare rappresenta l’intensità di una caratteristica sola, da zero fino al massimo. Esempio: «Quanto ti disturba il rumore in biblioteca?», con gradini che vanno da «per niente» a «moltissimo». Non esiste un polo opposto, esiste solo più o meno della stessa cosa.

Una scala bipolare mette due caratteristiche opposte alle due estremità. Esempio: «Il clima nella tua squadra di pallavolo è…», con gradini che dal «teso» arrivano al «disteso» passando per il centro. I due poli si definiscono a vicenda, ed è questo a rendere la forma impegnativa, perché il centro deve voler dire qualcosa.

Parole, numeri o simboli: come sono marcati i gradini

Le marche sono ciò che le persone vedono davvero sullo schermo, e cambiano il modo in cui rispondono. I materiali della TU Dresda ne distinguono quattro forme: verbale, numerica, simbolica e grafica. Ognuna ha il suo terreno e nessuna funziona ovunque.

Forma della marcaCome si presentaA che cosa serve
Verbaleuna parola per ogni gradinocaso standard, meno equivoci
Numericanumeri, per esempio da 1 a 10sistemi già noti come i voti
Simbolicafaccine, stelle, pollicibambini, feedback rapidi
Graficaun punto scelto su una lineagradazioni fini online

Il caso italiano: lo stesso numero su due scale diverse

I numeri sembrano inequivocabili e in Italia non lo sono affatto, perché il paese usa due sistemi di voto uno accanto all’altro. A scuola si vota in decimi: la valutazione periodica e finale nel primo ciclo «è espressa con votazioni in decimi che indicano differenti livelli di apprendimento» (decreto legislativo 62/2017, articolo 2), e la soglia che tutti hanno in testa è il 6.

All’università la scala cambia del tutto. Il regolamento carriera studente dell’Università di Trieste lo scrive così: «La valutazione degli esami viene espressa in trentesimi con la possibilità della lode. L’esame si intende superato con una votazione minima di 18/30» (UniTS, articolo 27). Una scala che parte da 18, arriva a 30, tiene la lode come gradino in più e convive con il voto di laurea, contato in centodecimi.

Un numero da solo, quindi, non dice niente. Un 18 all’università è una promozione, mentre nella scala scolastica in decimi quel numero non esiste nemmeno. Nel tuo questionario vale la stessa regola: se offri una scala numerica nuda, etichetta almeno i due estremi, come fa il Net Promoter Score con la sua scala da 0 a 10.

Scala di valutazione in un questionario di un sondaggio online con cinque gradini di risposta

Quanti gradini deve avere una scala di valutazione?

Da cinque a sette gradini è la raccomandazione corrente. Le linee guida GESIS riassumono così la letteratura: la misurazione risulta ottimale quanto ad attendibilità, validità e capacità di distinguere con un numero di categorie compreso fra cinque e sette, ed è anche l’intervallo che le persone intervistate preferiscono (Menold e Bogner 2015, GESIS Survey Guidelines).

La questione però non è chiusa. La stessa guida cita lavori più recenti in cui la qualità della misura continua a crescere con il numero di categorie, provato fino a 10, a 11 e persino a 100 gradini. La regola pratica di cinque o sette gradini ha comunque vinto, per un motivo concreto: oltre quel numero non riesci più a dare una parola a ogni gradino.

Per il tuo questionario la traduzione è semplice. Resta su cinque se etichetti ogni gradino, sali a sette se ti servono differenze più fini.

Numero pari o dispari: la questione del centro

Un numero dispari di gradini ha un centro, un numero pari costringe a sbilanciarsi. Le due scelte sono entrambe difendibili e dipendono da una domanda sola: una posizione intermedia esiste davvero nel merito? Per «Quanto sei soddisfatto della mensa?» l’indecisione è reale, per «Rifaresti questo laboratorio?» molto meno.

Le linee guida GESIS riassumono che la maggior parte di chi fa ricerca consiglia di offrire la categoria centrale. Il motivo non è la comodità ma la qualità del dato: senza centro, chi ha davvero una posizione neutra ripiega su un gradino vicino e sposta il risultato in una direzione che non esiste. Il prezzo da pagare è la tendenza al centro.

Una particolarità riguarda le scale bipolari. Al centro possono convivere due significati diversi: indifferenza, nel senso di «né l’uno né l’altro», oppure ambivalenza, nel senso di «un po’ e un po’». L’unico modo per separarli è aggiungere una categoria staccata come «non saprei giudicare».

Attenzione

«Non so» e «preferisco non rispondere» non sono gradini della scala e non vanno messi al centro. Il loro posto è staccato, in fondo all’elenco, e in analisi contano come valore mancante. Se convenga offrirli dipende, secondo le linee guida GESIS, dal tema, dalla modalità di rilevazione e dal pubblico. La stessa fonte rimanda ai lavori di Sturgis e colleghi: senza quella opzione le persone usano la categoria centrale come sostituto, i cosiddetti «face saving don’t knows».

Crea un sondaggio gratis

Con empirio.ai crei un moderno sondaggio online in pochi minuti — con hosting nell'UE.

  • Sondaggio creato con IA
  • Modifica con drag & drop
  • Analisi in tempo reale
Inizia gratis

Etichettare i gradini: quali parole usare in italiano

Dai una parola a ogni gradino, non soltanto ai due estremi. Le linee guida GESIS si esprimono a favore delle scale interamente verbalizzate, perché alzano attendibilità e validità e perché sono quelle che le persone preferiscono. La differenza si vede soprattutto con chi ha un titolo di studio più basso.

Le parole buone rispettano quattro condizioni: sono precise, si distribuiscono in modo simmetrico fra il lato positivo e quello negativo, le capisce chiunque e le distanze fra l’una e l’altra sembrano uguali. L’ultima è di gran lunga la più difficile, perché «spesso» e «qualche volta» non stanno alla stessa distanza per tutti.

Proprio l’ultima condizione porta al punto che quasi nessuno dice: quelle distanze sono legate alla lingua e non si traducono. In area tedesca esiste una taratura empirica famosa, quella di Bernd Rohrmann del 1978, che propose serie di parole con passi il più possibile regolari. Le sue serie sono calibrate sul tedesco e restano lì: tradotte in italiano perderebbero la proprietà per cui erano nate.

Formulazioni italiane già collaudate sul campo

L’Istat, nella rilevazione sulla soddisfazione dei propri utenti, descrive la scelta per esteso: «una scala a parziale autonomia semantica basata su quattro categorie di affermazioni che esprimono un giudizio da negativo a positivo: “per niente”, “poco”, “mediamente” e “molto” soddisfatto» (Istat, soddisfazione degli utenti, anno 2023). Due serie pronte da riusare:

  • Soddisfazione: per niente, poco, mediamente, molto soddisfatto
  • Fiducia: quattro gradini da «nessuna fiducia» a «piena fiducia»

L’espressione «autonomia semantica» non è un vezzo da manuale. La metodologia italiana la usa per dire quanto una categoria significhi qualcosa da sola: «l’autonomia semantica è una proprietà di una categoria», si legge nella lezione di Amalia Caputo per il corso di tecniche di ricerca sociale dell’Università di Napoli Federico II (Federica, Federico II). «Molto soddisfatto» si capisce da solo, «abbastanza» solo guardando gli altri gradini.

Consiglio

Chiedi della cosa, non dell’accordo. Invece di «Uso spesso i sondaggi» con una scala di accordo, chiedi «Quanto spesso usi i sondaggi?» con una scala di frequenza. Le linee guida GESIS sconsigliano le scale di accordo, perché producono più adesione delle scale che chiedono direttamente della caratteristica.

Analizzare una scala di valutazione: quale indicatore puoi riportare

Riporta sempre per prima la distribuzione delle frequenze, cioè quante persone hanno scelto ciascun gradino. Quel dato è ammesso a qualunque livello di misurazione, non si perde nel riassunto e mostra cose che ogni singolo indicatore nasconde.

Un esempio con numeri veri aiuta più di qualunque regola. Due laboratori vengono valutati su una scala da 1 a 7 e in ciascuno rispondono venti persone. Nel laboratorio A tutte e venti scelgono il 5. Nel laboratorio B dieci scelgono il 3 e dieci scelgono il 7. La media vale 5,0 in entrambi i casi e anche la mediana vale 5 in entrambi. La differenza salta fuori solo guardando la distribuzione.

IndicatoreQuando va beneChe cosa mostra
Distribuzione delle frequenzesemprequante persone per ogni gradino
Modasempreil gradino scelto più spesso
Medianasu un singolo itemla risposta centrale
Mediasu un punteggio di scalail valore medio su più item
Deviazione standardsu un punteggio di scalaquanto le risposte si disperdono
Top-two boxper report e presentazioniquota dei due gradini più alti

Media o mediana: da che cosa dipende la scelta

La media non è vietata, ma va motivata. Su un singolo item la mediana è la scelta più prudente, perché presuppone soltanto un ordine fra i gradini. Su un punteggio costruito con più item che misurano lo stesso concetto la media è abituale e difendibile, a patto che nel capitolo metodologico l’equidistanza compaia come assunzione dichiarata.

Per i confronti fra gruppi vale la stessa divisione. I singoli item si confrontano con procedure basate sui ranghi, i punteggi di scala anche con procedure che poggiano su media e dispersione, come spiega l’articolo su statistica descrittiva e statistica inferenziale.

La top-two box e quello che nasconde

Torniamo ai due laboratori, perché lì la media non basta proprio. La quota di chi ha scelto uno dei due gradini più alti, la cosiddetta top-two box, vale 0 per cento nel laboratorio A e 50 per cento nel laboratorio B, a parità di media e di mediana. Un indicatore del genere è legittimo e costa informazione: chi lo riporta mette la distribuzione completa in appendice.

Errori tipici nelle scale di valutazione

La maggior parte dei difetti di una scala di valutazione nasce quando la scrivi, non quando la calcoli. Con tendenze di risposta si indica la propensione a spostare le risposte in una direzione fissa, a prescindere dal contenuto della domanda. Non riguardano tutti, ma in chi ne è toccato vanno in una direzione prevedibile.

I quattro schemi seguenti sono ben documentati e riassunti nelle linee guida GESIS dedicate alle tendenze di risposta (Bogner e Landrock 2015). Contro nessuno di questi serve un campione più grande, mentre serve un questionario migliore.

La tendenza al centro tira le risposte verso la metà

Alcune persone scelgono i gradini centrali a prescindere dal contenuto, perché costa meno fatica che prendere posizione. Ne esce una distribuzione più equilibrata di quanto siano gli atteggiamenti reali. Aiuta una scala interamente verbalizzata, e quando una posizione intermedia non esiste nel merito la soluzione più semplice è un numero pari di gradini.

L’acquiescenza porta a dire di sì a tutto

Acquiescenza è il nome della propensione ad approvare qualunque affermazione, barrando ovunque «d’accordo», «vero» o «sì». Le linee guida GESIS indicano un solo rimedio davvero efficace: rinunciare alle scale di accordo e chiedere direttamente della caratteristica. Chi resta sull’accordo può invertire metà degli item, il che rende visibile la tendenza ma non salva correlazioni e struttura fattoriale.

La desiderabilità sociale abbellisce le domande scomode

Sui temi che chi risponde percepisce come delicati arriva la risposta attesa al posto di quella vera. I comportamenti fuori norma vengono ridimensionati, quelli conformi gonfiati. Buona notizia per i sondaggi online: le linee guida GESIS registrano che la tendenza è più debole quando non c’è una persona che intervista.

Le risposte estreme non dipendono solo dal tema

Le risposte estreme sono il rovescio della tendenza al centro, cioè la propensione a scegliere i gradini più esterni a prescindere dal contenuto. Se dietro ci sia un tratto stabile della persona la ricerca non lo ha ancora deciso. Documentato è invece che, secondo le stesse linee guida, questionari scritti e online ne risentono meno delle interviste telefoniche.

Un ultimo errore riguarda l’aspetto grafico e passa quasi sempre inosservato. I gradini devono risultare equidistanti anche a vedersi, altrimenti il centro visivo della scala non coincide più con quello logico. Altre viti da stringere le trovi nei consigli per i sondaggi online.

Conclusione

Una scala di valutazione si inserisce in un minuto e si rovina altrettanto in fretta. Cinque gradini interamente etichettati, una decisione consapevole sul centro e una altrettanto consapevole sul «non so» portano più qualità di qualunque persona intervistata in più. In fase di analisi vale una regola sola: la distribuzione entra sempre nel report, la media soltanto con una motivazione.

Resta una cosa sola da fare prima di mandare il questionario: rileggere la scala ad alta voce, gradino per gradino. Se una parola ti fa esitare mentre la leggi, farà esitare anche chi risponde, e quella esitazione finirà dritta nei tuoi dati.

Come proseguire


Vuoi provare la tua scala prima di mandarla in giro?

Con empirio.ai, uno strumento per sondaggi online dalla Germania, crei una scala graduata in pochi minuti e dopo qualche risposta di prova vedi se la distribuzione regge quello che vuoi raccontare.

Inizia gratis con empirio.ai

Domande frequenti

Una scala di valutazione è un formato di risposta graduato di un questionario, con cui chi risponde indica quanto è forte una certa caratteristica. Al posto di un semplice sì o no ci sono più gradini, per esempio cinque che vanno da «per niente soddisfatto» a «molto soddisfatto». Il termine viene dall’inglese rating, cioè valutazione o giudizio.

In senso stretto una scala di valutazione misura a livello ordinale, perché non si può dimostrare che le distanze fra i gradini siano uguali. Nella pratica di ricerca un punteggio costruito con più item viene comunque trattato come una scala a intervalli. Per un singolo item la classificazione corretta resta quella ordinale.

Da cinque a sette gradini è la raccomandazione corrente. Le linee guida GESIS indicano questo intervallo come ottimale per attendibilità, validità e capacità di distinguere, e ricordano che è anche quello preferito da chi risponde. Studi più recenti trovano miglioramenti anche con più categorie, ma nella pratica la regola di cinque o sette gradini ha vinto.

Una scala unipolare rappresenta l’intensità di una caratteristica sola, per esempio da «per niente disturbato» a «molto disturbato». Una scala bipolare mette due caratteristiche opposte alle due estremità, per esempio teso e disteso. Le linee guida GESIS avvertono che per la polarità non esiste una definizione unitaria in letteratura, quindi conviene dichiarare quale si segue.

Su un singolo item la mediana è la scelta più prudente, perché presuppone soltanto un ordine fra i gradini. Su un punteggio costruito con più item che misurano lo stesso concetto la media è abituale e difendibile, purché nel capitolo metodologico tu dichiari di aver trattato le modalità di risposta come equidistanti. La distribuzione delle frequenze va comunque riportata.

Una scala Likert è una forma particolare di scala di valutazione, non un’alternativa. La riconosci da una dimensione di accordo, da più item sullo stesso concetto e da un punteggio complessivo su tutti gli item. Un item preso da solo si chiama item Likert. Ogni scala Likert è quindi una scala di valutazione, ma non vale il contrario.

Dai una parola a ogni gradino e non soltanto ai due estremi. Le formulazioni non si traducono da un’altra lingua, perché le distanze fra le parole cambiano insieme alla lingua. Un riferimento riusabile arriva dall’Istat, che per la soddisfazione adotta quattro categorie: per niente, poco, mediamente e molto soddisfatto.

Potrebbe interessarti anche

Glossario

Scala Likert: esempi, gradini e come analizzarla

Quanti gradini servono e serve una posizione centrale? Ripercorriamo con te le decisioni, ti diamo le formulazioni usate dall'Istat e ti diciamo che cosa puoi calcolare dopo.