empirio.ai

Objetividad, fiabilidad y validez: definición y ejemplos

Un cuestionario puede medir con constancia y aun así medir lo que no toca. Te explicamos qué comprueba la objetividad, qué la fiabilidad y qué la validez, y cómo lo justificas en tu TFG.

Autora en empirio.ai - Maria Malzewpor Maria MalzewActualizado el 25 de agosto de 2026Tiempo de lectura 19 min

Imagina que dos personas corrigen el mismo cuestionario y llegan a resultados distintos. El cuestionario no está mal redactado por eso. Sencillamente no es objetivo.

La objetividad, la fiabilidad y la validez son los tres criterios de calidad principales de la investigación cuantitativa, y cada uno comprueba una cosa diferente. La objetividad significa que el resultado no depende de quién aplica, corrige e interpreta la encuesta. La fiabilidad significa que un instrumento mide con precisión, es decir, con el menor error de medida posible. La validez significa que el cuestionario mide de verdad el rasgo que te interesa y no otro distinto. Al terminar podrás justificar en tu TFG cuál de los tres cumples y cuál dejas abierto a propósito.


📌 Lo esencial de un vistazo

  • La objetividad significa que el resultado no depende de quien corrige.
  • La fiabilidad significa medir con el menor error de medida.
  • La validez significa que mides el rasgo que dices medir.
  • El CET-R español no evalúa la objetividad como criterio propio.
  • Desde 2016 se validan las interpretaciones, no el test.

Crear encuesta gratis

Con empirio.ai creas una encuesta en línea moderna en pocos minutos — con alojamiento en la UE.

  • Encuesta creada con IA
  • Ajusta con arrastrar y soltar
  • Análisis en tiempo real
Empezar gratis

Objetividad, fiabilidad y validez: los tres criterios de calidad de una medición

La objetividad, la fiabilidad y la validez son los tres criterios con los que se juzga la calidad de un instrumento de medida. Responden, en este orden, a tres preguntas: si la medición es independiente de quien la aplica, si es precisa y si mide lo correcto.

El orden no es una costumbre, sino que refleja de qué depende cada criterio. Una encuesta en la que cada persona que analiza llega a un valor distinto no puede ser precisa, y una medición imprecisa no puede ser válida. La relación es más estricta de lo que sugieren la mayoría de los resúmenes, y merece un capítulo propio en este artículo.

Criterio de calidadLa pregunta que hay detrásEn qué lo reconoces
Objetividad¿El resultado depende de la persona?reglas fijas de aplicación, corrección e interpretación
Fiabilidad¿Una repetición devuelve lo mismo?coeficiente de fiabilidad entre 0 y 1
Validez¿Se mide el rasgo que interesa?evidencias de contenido, estructura interna y relaciones

Lo que falta en casi todos los resúmenes: los tres no son la lista completa. Helfried Moosbrugger y Augustin Kelava reúnen diez criterios de calidad en su manual «Testtheorie und Fragebogenkonstruktion» (Springer, 2012), donde junto a la tríada aparecen la escalabilidad, la baremación, la economía, la utilidad, la exigencia razonable, la resistencia a la manipulación y la equidad. Conviene saber de dónde viene ese listado de diez: es una convención de la literatura en lengua alemana, no un estándar internacional, y en España el catálogo de referencia es otro.

El CET-R de la Comisión de Test: el catálogo vigente en España

La Comisión de Test del Consejo General de la Psicología de España, creada en 1995, evalúa la calidad de los tests con el modelo CET y, desde su revisión de 2016, con el CET-R. Ese catálogo no incluye ningún criterio llamado «objetividad»: valora, entre otros aspectos, la fiabilidad, con sus modalidades de equivalencia, consistencia interna y estabilidad, además de la validez y los baremos.

El peso de cada criterio se ve en los números. El CET-R reúne 55 elementos de valoración, de los cuales 20 corresponden a la validez y 15 a la fiabilidad, así que casi dos tercios del catálogo se dedican a esos dos criterios. Puedes consultar el modelo completo en la página de la Comisión de Test del COP.

Para un TFG o un TFM, quedarte con los tres criterios principales suele bastar. Conviene, eso sí, que sepas que al hacerlo estás eligiendo una convención concreta entre varias. Quien además sabe nombrar los criterios de calidad de la investigación cuantitativa y cualitativa llega a la defensa con bastante más seguridad.

Representación esquemática de los tres criterios de calidad, objetividad, fiabilidad y validez, uno al lado del otro

Objetividad: ¿el resultado depende de quien pasa el cuestionario?

La objetividad se cumple cuando un test mide el rasgo que pretende medir con independencia de quien lo aplica y lo corrige, y cuando existen reglas de interpretación que no dejan margen a la persona que las usa. En la práctica se traduce en una sola idea: quien pasa la encuesta no decide nada.

En el catálogo español la objetividad no figura como criterio con nombre propio, porque su función se reparte entre la estandarización del procedimiento y la documentación de cómo se aplica y se corrige la prueba. La categoría sigue siendo útil para explicar el problema, y de ahí que la literatura en lengua alemana la mantenga separada.

En una encuesta online la objetividad se cumple con mucha más facilidad que en cualquier procedimiento oral, porque entre quien investiga y quien responde no hay conversación. Justamente por eso la encuesta estandarizada resulta tan habitual en los trabajos de fin de grado. Los tres aspectos de la objetividad se remontan a Gustav Lienert y Ulrich Raatz (1998), y conviene que los distingas y los justifiques uno por uno.

Objetividad de aplicación: las mismas condiciones para todas las personas

La objetividad de aplicación se cumple cuando el resultado no depende de quién dirige la recogida de datos. La palanca se llama estandarización: instrucciones, orden de las preguntas, tiempos y formatos de respuesta quedan fijados de antemano y no cambian entre dos participantes. El ideal es que la persona que responde sea la única fuente de variación en la situación. Una encuesta que se reparte por enlace y se ve igual para todo el mundo cumple esa condición casi sola.

Objetividad de corrección: mismas respuestas, mismo análisis

La objetividad de corrección se cumple cuando distintas personas llegan al mismo resultado a partir de respuestas idénticas. Con preguntas cerradas y opciones predefinidas el problema no existe, porque no hay nada que interpretar. En cuanto trabajas con preguntas abiertas, la objetividad de corrección baja, ya que los textos libres hay que categorizarlos. No es motivo para descartarlas, aunque sí exige un plan de categorías documentado.

Objetividad de interpretación: mismas puntuaciones, misma conclusión

La objetividad de interpretación se cumple cuando distintos especialistas extraen la misma conclusión de una misma puntuación. En la práctica es el aspecto más débil de los tres, porque haría falta disponer de baremos o de umbrales claros. En una encuesta propia sin muestra de tipificación, esos baremos no existen. Lo que sí puedes hacer: fijar las reglas de interpretación antes de mirar los datos y declararlas en el apartado de método.

💡 Consejo

Redacta las reglas de análisis de las preguntas abiertas antes de leer la primera respuesta. Quien desarrolla el plan de categorías sobre el propio conjunto de datos ya no puede descartar que las categorías encajen con el resultado deseado. En la defensa, esa es la pregunta más incómoda de todas.

Fiabilidad: ¿una repetición devuelve la misma puntuación?

La fiabilidad es la precisión de una medida. Un test es fiable cuando mide el rasgo que mide sin error de medida. El indicador que lo resume es el coeficiente de fiabilidad, un valor que se mueve entre 0 y 1.

Un coeficiente de 1 significa que la medición está libre de error, y un coeficiente de 0, que la puntuación se debe por completo al error. El modelo CET de la Comisión de Test fijaba umbrales explícitos para la consistencia interna y calificaba de excelente un valor de r igual o superior a 0,85. Ese listón es alto para un trabajo de fin de grado, así que úsalo como referencia y no como condición de aprobado.

Los cuatro procedimientos para estimar la fiabilidad

Para estimar la fiabilidad, la teoría clásica de los tests emplea cuatro procedimientos. Cuál de ellos entra en juego en tu trabajo lo decide menos la estadística que una cuestión práctica: si vuelves a localizar a las personas que respondieron.

ProcedimientoCómo funciona¿Viable en un TFG?
Test-retestel mismo test en dos momentos, puntuaciones correlacionadasrara vez, cuesta recuperar a la muestra
Formas paralelasdos versiones equivalentes en contenidocasi nunca, el banco de ítems es pequeño
Dos mitadesse parte el test y se correlacionan las mitadessí, con la corrección de Spearman-Brown
Consistencia internacada ítem cuenta como una parte del testsí, es el caso normal

En la terminología del CET-R, esos procedimientos se agrupan en tres modalidades: la estabilidad recoge el test-retest, la equivalencia recoge las formas paralelas y la consistencia interna recoge los procedimientos que solo necesitan un pase. Las formas paralelas pasan por el camino real, porque eliminan los efectos de práctica y de recuerdo, aunque exigen dos versiones del cuestionario que lleven a las mismas puntuaciones verdaderas. En un TFG casi nadie llega hasta ahí, y casi todo el mundo termina en la consistencia interna.

Alfa de Cronbach: qué demuestra y qué no

El alfa de Cronbach mide cuánto se relacionan entre sí los ítems de una escala, así que es un indicador de consistencia interna. Su popularidad viene de que cualquier programa estadístico lo devuelve, y de ahí que se sobreinterprete tanto. Un alfa alto no demuestra que una escala mida un solo rasgo, y sube por el simple hecho de añadir ítems. El supuesto que hay detrás también es exigente: todos los ítems deberían saturar por igual en el mismo rasgo.

Cuando ese supuesto no se cumple, el alfa infravalora la fiabilidad real. Klaas Sijtsma expuso estas limitaciones con detalle en 2009 en la revista Psychometrika, y desde entonces se nombra con frecuencia el omega de McDonald como alternativa. Para un TFG no significa que tengas que calcular omega. Significa que sitúes el alfa con media frase en lugar de presentarlo como prueba. Justamente esas matizaciones distinguen una discusión metodológica buena de una discusión metodológica del montón.

Representación esquemática de la fiabilidad como medición repetida que devuelve el mismo resultado

Validez: ¿el cuestionario mide de verdad el rasgo que te interesa?

La validez se cumple cuando un test mide el rasgo que pretende medir y no otro distinto. A diferencia de la fiabilidad, no existe un número único que la demuestre, porque se sostiene sobre evidencias de distinta procedencia, y no todas son comprobables en cualquier trabajo.

En España la manera de ordenar esas evidencias cambió en 2016. Hernández, Ponsoda, Muñiz, Prieto y Elosua explican en la revista Papeles del Psicólogo que la Comisión de Test decidió «abandonar la clasificación tradicional de tipos de validez» y adoptar la terminología de los estándares de la AERA, la APA y el NCME de 2014. El artículo completo está disponible como Revisión del modelo para evaluar la calidad de los tests utilizados en España (2016).

El CET-R reconoce por eso tres fuentes de evidencias de validez, y son las que deberías nombrar en tu apartado de método.

  • Evidencias de contenido: ¿los ítems representan de forma adecuada el dominio del rasgo? La respuesta llega por juicio experto, no por cálculo.
  • Evidencias de relaciones con otras variables: ¿las puntuaciones se comportan como cabría esperar frente a criterios externos y frente a otras pruebas? Cubre lo que la clasificación antigua llamaba validez criterial, concurrente y predictiva.
  • Evidencias de estructura interna: ¿la estructura que muestran los datos coincide con la que propone la teoría? Es el terreno del análisis factorial y de las dimensiones de la escala.

Validez: no se valida el test, sino la interpretación de sus puntuaciones

El giro de 2016 va mucho más allá de un cambio de etiquetas. Hernández y sus colegas lo formulan sin rodeos: «no se valida el test, sino las interpretaciones o usos concretos que se hacen de sus puntuaciones». Un mismo cuestionario puede estar bien validado para describir el clima de un aula y no estarlo en absoluto para seleccionar personal, aunque el instrumento no cambie ni una coma.

Para tu TFG la consecuencia es muy concreta. No escribes «el cuestionario es válido», sino para qué uso y para qué población lo es. Vale la pena señalar hasta dónde llegó la decisión española: el modelo europeo de la EFPA mantuvo la clasificación clásica, así que España fue más lejos que el marco del que partía.

La clasificación clásica de la validez en cuatro tipos

La clasificación clásica de la validez sigue apareciendo en manuales anteriores a 2014 y en muchos guiones de trabajos de fin de grado, así que conviene que la reconozcas. Distingue la validez de contenido, la validez aparente, la validez de constructo y la validez criterial, esta última con dos variantes: concurrente, cuando el criterio se mide a la vez, y predictiva, cuando se mide más tarde. Si tu tutora o tutor trabaja con esa terminología, úsala y añade una frase que sitúe tu trabajo en el marco vigente.

Validez de contenido y validez aparente no son lo mismo

Con frecuencia se lee que la validez de contenido y la validez aparente son dos nombres para la misma cosa. No lo son, y la confusión sobrevive a los dos sistemas de clasificación. La validez de contenido es un juicio experto sobre si los ítems cubren el dominio del rasgo. La validez aparente es la impresión de una persona lega de que la prueba parece plausible. Un cuestionario puede resultar muy convincente a simple vista y medir al lado del rasgo, y a la inversa, un test impecable en su contenido puede parecer incomprensible desde fuera.

⚠️ Atención

No escribas en tu trabajo «validez de contenido o aparente». Quien iguala los dos términos deja un flanco abierto a cualquier pregunta de metodología. Nombra la validez de contenido como aquello que justificas técnicamente, y la validez aparente, como mucho, como argumento sobre la aceptación entre quienes responden.

Una segunda imprecisión afecta a la validez interna y a la validez externa. Los dos términos provienen de la evaluación de diseños de investigación y responden a si una inferencia causal se sostiene dentro de un estudio y a si los resultados valen fuera de él. No son subtipos de la validez de contenido ni de la validez de constructo, aunque muchos resúmenes los coloquen ahí. Quien mezcla los dos sistemas pierde justo la precisión que se evalúa en el apartado de método.

Representación esquemática de la validez como acierto en el rasgo que se quiere medir

Crear encuesta gratis

Con empirio.ai creas una encuesta en línea moderna en pocos minutos — con alojamiento en la UE.

  • Encuesta creada con IA
  • Ajusta con arrastrar y soltar
  • Análisis en tiempo real
Empezar gratis

Cómo se relacionan la objetividad, la fiabilidad y la validez

La fiabilidad es condición de la validez, y la relación funciona solo en esa dirección. Moosbrugger y Kelava escriben que la objetividad y la fiabilidad aportan únicamente las condiciones favorables para una validez alta, y que un test con fiabilidad baja no puede alcanzar una validez alta.

La frase citada del manual parece menor y sostiene todo el sistema. Significa, en concreto: una medición precisa puede estar apuntando al rasgo equivocado, mientras que una medición imprecisa nunca puede ser válida. La objetividad va antes en la práctica, porque una recogida de datos con mucho margen de corrección rara vez produce valores estables. Como condición formal, sin embargo, el manual no lo formula, a diferencia de la relación entre fiabilidad y validez.

Una báscula que marca siempre dos kilos de más lo deja claro. Resulta objetiva, porque funciona con las mismas reglas para todo el mundo. Resulta fiable, porque en tres pesadas seguidas marca lo mismo. Válida no es, porque se equivoca de forma sistemática. Ese caso concreto, fiabilidad alta con validez baja, es el más frecuente en los cuestionarios, y en los indicadores no se nota.

Qué implica para el orden de tu apartado de método

  • Aclara primero si la recogida transcurre igual para todo el mundo.
  • Comprueba después si tus escalas son internamente consistentes.
  • Justifica al final que los ítems cubren el rasgo que te interesa.
  • Informa de un valor bajo en lugar de omitirlo.

Un cuestionario fiable mide con precisión. Si mide lo correcto es otra pregunta, y no queda contestada.

¿Valen los tres criterios de calidad en la investigación cualitativa?

Los tres criterios de calidad se desarrollaron para mediciones estandarizadas y no se trasladan sin cambios a los procedimientos cualitativos. Una entrevista semiestructurada no debe dar lo mismo en cada repetición, precisamente porque se adapta a la persona que responde.

La investigación social cualitativa ha desarrollado por eso catálogos de criterios propios. El más conocido es la propuesta de Yvonna Lincoln y Egon Guba en «Naturalistic Inquiry» (Sage, 1985), con cuatro criterios: credibilidad, transferibilidad, dependibilidad y confirmabilidad. Los catálogos de evaluación de tests, el CET-R incluido, se dirigen a instrumentos estandarizados y no cubren este terreno.

Para tu trabajo la consecuencia práctica es manejable. Si recoges datos de forma cualitativa, no escribas sobre el alfa de Cronbach, sino documenta la selección, el desarrollo y el análisis con tanto detalle que otra persona pueda rehacer el camino. Qué criterios conviven en las dos lógicas de investigación lo tienes en el artículo sobre los criterios de calidad cuantitativos y cualitativos.

Los criterios de calidad en el TFG: dónde van dentro del índice

Los criterios de calidad no tienen un lugar fijo en el índice de un TFG. Dos variantes son habituales, y las dos se defienden bien: un apartado propio dentro del capítulo de diseño de la investigación o una sección en la reflexión sobre el propio procedimiento.

Cuál de las dos encaja depende de cuánta justificación necesite tu elección metodológica para la pregunta de investigación. Cuando el método ocupa el centro del trabajo, los criterios van delante, en el diseño. Cuando pesan más los hallazgos sustantivos, resultan más naturales al final. Consulta la duda con tu tutor o tutora, porque algunas facultades tienen una expectativa fija al respecto.

Primera opción: los criterios de calidad como apartado propio del diseño de la investigación

La primera variante encaja cuando justificas tu elección metodológica con detalle y los criterios de calidad forman parte de esa justificación. La ventaja está en que quien lee resuelve la cuestión de la calidad antes de ver los resultados, y el tribunal encuentra el argumento en el lugar donde lo espera. El precio está en que a esa altura todavía no sabes qué escalas resultarán débiles, así que cuenta con volver sobre ellas más adelante.

  1. Introducción con la pregunta de investigación
  2. Marco teórico y estado de la cuestión
  3. Diseño de la investigación: hipótesis, elección del método, población y muestra, variables, cuestionario y criterios de calidad, con un subapartado para la objetividad, la fiabilidad y la validez
  4. Recogida de datos
  5. Análisis de datos
  6. Resultados
  7. Reflexión sobre el procedimiento
  8. Conclusiones

Segunda opción: los criterios de calidad como sección en la reflexión sobre el procedimiento

La segunda variante encaja cuando solo puedes nombrar los límites de tu recogida de datos a la luz de los resultados. La estructura no cambia, solo se desplazan los criterios de calidad al punto 7, donde se discuten junto a las limitaciones del trabajo. La ventaja está en la honestidad, porque escribes sobre valores obtenidos y no sobre intenciones. El precio está en que queden reducidos a una lista de disculpas, así que conviene formularlos como decisiones y no como fallos.

En las dos variantes rige el mismo criterio de evaluación: no se valora si una recogida de datos cumple los tres criterios, sino si queda claro cuáles cumple y dónde están los límites.

Representación de los puntos de un TFG en los que aparecen los criterios de calidad de una medición

Errores frecuentes con los criterios de calidad

La mayoría de los descuentos en el apartado de método no vienen de indicadores bajos, sino de afirmaciones que prometen más de lo que los datos sostienen. Tres errores aparecen con especial frecuencia.

Los tres errores comparten la misma causa: se invoca un criterio de calidad para algo que ese criterio no cubre. Quien separa bien los tres se ahorra los errores casi sin esfuerzo, y el apartado de método sale además más corto en lugar de más largo.

Error 1: presentar una fiabilidad alta como prueba de validez

Un alfa de Cronbach de 0,89 indica que los ítems de una escala se relacionan estrechamente. No dice nada sobre si esos ítems recogen el rasgo que te interesa. Quien escribe después del alfa que la escala queda así validada extrae justo la inferencia que la teoría de los tests excluye. La salida es un párrafo adicional sobre las evidencias de contenido, donde justificas por qué los ítems cubren el dominio del rasgo.

Error 2: dar la objetividad por resuelta porque la encuesta es online

Una encuesta online asegura en buena medida la objetividad de aplicación, porque todas las personas participantes ven lo mismo. La objetividad de corrección y la de interpretación quedan intactas. En cuanto hay preguntas abiertas en el cuestionario o eliges umbrales a mano, el margen reaparece. La salida es nombrar los tres aspectos por separado en lugar de dar la objetividad por zanjada en bloque.

Error 3: callar los valores bajos

Un coeficiente de fiabilidad de 0,58 no es motivo para eliminar una escala del trabajo ni para omitir el valor. Lo que se evalúa es el tratamiento del problema, no el resultado. Quien declara el valor, explica a qué se debe probablemente y formula la interpretación con más prudencia demuestra justo la madurez metodológica que se busca. Los valores ocultados, en cambio, salen a la luz en la defensa.

Conclusión

La objetividad, la fiabilidad y la validez no son obstáculos que haya que superar, sino tres preguntas que tienes que contestar. El cumplimiento absoluto es la excepción incluso en estudios profesionales, y nadie lo espera en un TFG. Lo que sí se espera es que sepas separar los tres criterios y que digas con claridad dónde llega tu recogida de datos y dónde no.

Cómo seguir

Nuestra recomendación de lectura: Hernández, A.; Ponsoda, V.; Muñiz, J.; Prieto, G. y Elosua, P. (2016): Revisión del modelo para evaluar la calidad de los tests utilizados en España. Papeles del Psicólogo, 37(3), páginas 192 a 197. Son seis páginas y explican el cambio de 2016 mejor que cualquier resumen. Para el listado de los diez criterios en lengua alemana, la referencia sigue siendo Moosbrugger, H. y Kelava, A. (editores) (2012): Testtheorie und Fragebogenkonstruktion, 2.ª edición, Springer, capítulo 2.


¿Quieres que tu encuesta esté estandarizada desde el primer día?

Con empirio.ai, una herramienta de encuestas online creada en Alemania, todas las personas participantes ven el mismo cuestionario en el mismo orden, con lo que la objetividad de aplicación queda asegurada en buena medida. La objetividad de corrección y la de interpretación siguen siendo cosa tuya, porque dependen de tus reglas y no de la herramienta.

Crear una encuesta gratis

Preguntas frecuentes

La fiabilidad es la precisión de una medida y la validez es su pertinencia. Un cuestionario es fiable cuando una repetición devuelve la misma puntuación, y válido cuando mide el rasgo que dice medir. Una báscula que marca siempre dos kilos de más resulta muy fiable y nada válida, y por eso conviene informar de los dos criterios por separado.

La objetividad es condición para la fiabilidad, y la fiabilidad es condición para la validez. En la teoría clásica de los tests, un instrumento poco fiable no puede alcanzar una validez alta, porque el error de medida pone un techo. Al revés no se cumple: una medición muy precisa puede estar midiendo el rasgo equivocado con toda exactitud.

La Comisión de Test del Consejo General de la Psicología de España fijaba en el modelo CET umbrales explícitos para la consistencia interna y calificaba de excelente un valor de r igual o superior a 0,85. Para un TFG cuenta menos la altura del coeficiente que el hecho de comunicarlo e interpretarlo con prudencia.

La objetividad se divide en objetividad de aplicación, de corrección y de interpretación. La primera exige que todas las personas encuestadas encuentren las mismas condiciones. La segunda exige que unas mismas respuestas se analicen igual con independencia de quien las trate. La tercera exige que de una misma puntuación se extraiga la misma conclusión.

No, la validez de contenido y la validez aparente son dos cosas distintas. La validez de contenido es un juicio experto sobre si los ítems cubren de forma representativa el dominio del rasgo. La validez aparente es la impresión de una persona lega de que la prueba parece plausible, así que afecta a la aceptación y no a la calidad de la medida.

El CET-R, el catálogo revisado de la Comisión de Test del COP, reconoce tres fuentes de evidencias de validez: las de contenido, las de relaciones con otras variables y las de estructura interna. La revisión de 2016 abandonó la clasificación tradicional en tipos de validez y adoptó la terminología de los estándares de la AERA, la APA y el NCME de 2014.

Los tres criterios cuantitativos no se trasladan sin cambios a la investigación cualitativa, porque una entrevista semiestructurada no debe repetirse igual. Lincoln y Guba proponen en Naturalistic Inquiry (1985) cuatro criterios alternativos: credibilidad, transferibilidad, dependibilidad y confirmabilidad. Lo decisivo en un TFG cualitativo es documentar la selección, el desarrollo y el análisis con detalle suficiente.

Dos ubicaciones son habituales en un TFG: un apartado propio dentro del capítulo de método o una sección en la discusión de las limitaciones. Cuando la elección metodológica es el centro del trabajo, encajan al principio. Cuando pesan más los resultados sustantivos, funcionan mejor al final, junto a las limitaciones.

También podría interesarte

Léxico

¿Qué significa validez? Definición y ejemplo

La validez (= validez o exactitud de la medición) refleja hasta qué punto un trabajo de investigación en su construcción completa logra realmente los resultados que corresponden al objetivo de investigación planteado.