Survey Design

Comparación de escalas de valoración: Likert, NPS, estrellas y más

Compara las escalas de valoración de encuestas más comunes -Likert, NPS, valoración por estrellas, diferencial semántico, CSAT y CES- y aprende qué escala se ajusta a cada objetivo de medición.

Las escalas de valoración convierten las opiniones en números, y la escala que elijas moldea en silencio todo lo que sigue: cómo interpretan los encuestados la pregunta, cómo analizas los datos y cómo estableces comparaciones a lo largo del tiempo. Una escala de Likert de cinco puntos, una pregunta Net Promoter de once puntos y una valoración de cinco estrellas no son intercambiables; cada una acarrea sus supuestos y sus compromisos. Esta guía compara las escalas de valoración más comunes para que puedas emparejar la adecuada con tu objetivo de medición.

Fundamentos de las escalas de valoración

Unas cuantas decisiones de diseño se aplican a toda escala. Número de puntos: más puntos captan distinciones más finas pero aumentan la carga cognitiva; cinco y siete puntos son puntos óptimos habituales. Impar frente a par: un número impar de puntos ofrece un punto medio neutral, mientras que un número par fuerza una inclinación en una dirección al eliminar el centro. Etiquetado: etiquetar por completo cada punto mejora la claridad y la coherencia, mientras que etiquetar solo los extremos da a los encuestados mayor libertad interpretativa. Equilibrio: los puntos positivos y negativos deben ser simétricos para que la escala no incline a los encuestados hacia un lado. Acertar con estos fundamentos importa más que qué escala con nombre propio elijas.

La escala de Likert

La escala de Likert mide el acuerdo con una afirmación, clásicamente en cinco puntos de "muy en desacuerdo" a "muy de acuerdo", a veces ampliada a siete. Es el caballo de batalla de la medición de actitudes: flexible, familiar y fácil de analizar. Una verdadera escala de Likert combina varios ítems de Likert relacionados en una puntuación compuesta que mide una actitud subyacente única de forma más fiable que cualquier ítem aislado.

Fortalezas: los encuestados la entienden al instante, y los datos admiten un análisis rico (medias, distribuciones y comprobaciones de fiabilidad entre ítems). Debilidades: es vulnerable al sesgo de aquiescencia (la tendencia a estar de acuerdo) y a la respuesta por tendencia central (la aglomeración en el punto medio neutral). Para contrarrestarlos, redacta algunos ítems en sentido inverso, usa un enunciado específico para cada ítem cuando sea posible y plantéate si un punto medio neutral ayuda o simplemente permite a los encuestados evitar comprometerse.

Net Promoter Score (NPS)

El NPS plantea una sola pregunta -"¿Qué probabilidad hay de que nos recomiendes a un amigo o colega?"- en una escala de once puntos del 0 al 10. Los encuestados se agrupan en Promotores (9-10), Pasivos (7-8) y Detractores (0-6). La puntuación es el porcentaje de Promotores menos el porcentaje de Detractores: en concreto, %Promotores menos %Detractores, lo que produce un número de -100 a +100. Los Pasivos cuentan para el total pero no para la puntuación.

El NPS es popular porque es sencillo, universalmente comprendido y ampliamente comparado, lo que lo hace ideal para seguir la lealtad a lo largo del tiempo y compararla con las normas del sector. Sus limitaciones son reales: un único número oculta las razones que hay detrás, los umbrales de categoría son algo arbitrarios y un mismo NPS puede provenir de distribuciones muy distintas. Empareja siempre la puntuación con un seguimiento abierto que pregunte por qué. Si quieres implementarlo correctamente, parte de una encuesta NPS dedicada en lugar de reconstruir la escala a mano. El seguimiento de la lealtad es especialmente común entre las startups SaaS que vigilan de cerca la retención.

CSAT y Customer Effort Score

El CSAT (Customer Satisfaction Score) pregunta qué tan satisfecho está un cliente con una interacción concreta, normalmente en una escala de 1 a 5 (o de 1 a 7) de "muy insatisfecho" a "muy satisfecho". La puntuación suele informarse como el porcentaje de encuestados que eligen la casilla o las dos casillas superiores. El CSAT es lo mejor para medir la satisfacción con un punto de contacto discreto -un ticket de soporte, una compra, un paso de incorporación- inmediatamente después de que ocurre.

El CES (Customer Effort Score) mide cuánto esfuerzo tuvo que invertir un cliente, normalmente valorando el acuerdo con una afirmación como "La empresa me facilitó resolver mi problema" en una escala de 1 a 7. El CES es un buen predictor de la lealtad futura en las interacciones de servicio, bajo la lógica de que reducir la fricción retiene a los clientes de forma más fiable que deleitarlos. Usa el CSAT para calibrar la satisfacción y el CES para diagnosticar la fricción; se complementan.

Valoración por estrellas y diferencial semántico

Las valoraciones por estrellas (habitualmente de 1 a 5 estrellas) son intuitivas y familiares por el comercio electrónico y las tiendas de aplicaciones, lo que las hace excelentes para las reseñas de cara al público y los comentarios rápidos sobre un producto. Su debilidad es la deriva interpretativa -las cuatro estrellas de una persona son las tres de otra- y un sesgo bien documentado hacia las valoraciones extremas, por lo que las medias pueden inducir a error sin volumen.

Las escalas de diferencial semántico colocan adjetivos opuestos en cada extremo (por ejemplo, "poco fiable" a "fiable" o "barato" a "premium") y piden a los encuestados que marquen dónde cae su impresión, normalmente a lo largo de cinco a siete puntos. Son potentes para la investigación de marca y de percepción, porque captan las connotaciones de un producto o una empresa en varias dimensiones a la vez. Requieren una selección cuidadosa de pares de adjetivos verdaderamente bipolares para funcionar bien, lo que las hace más idóneas para una encuesta de investigación de mercado meditada que para una toma de pulso rápida.

Elegir la escala adecuada

Parte de la decisión, no de la escala. Para medir la lealtad y compararla, usa NPS. Para medir la satisfacción con una interacción concreta, usa CSAT. Para diagnosticar la fricción en un proceso, usa CES. Para medir actitudes y creencias en varios ítems, usa una escala de Likert. Para reseñas públicas, usa estrellas. Para percepción de marca, usa diferencial semántico. Después mantén la escala coherente en el tiempo: cambiar el número de puntos o las etiquetas a mitad de camino rompe tu capacidad de comparar tendencias. Por último, prueba cualquier escala con unos cuantos encuestados reales para confirmar que las etiquetas significan lo que pretendes.

Un punto sutil pero importante tiene que ver con cómo analizas los datos de escala. Técnicamente, la mayoría de las escalas de valoración son ordinales: los puntos están ordenados, pero no se garantiza que las distancias entre ellos sean iguales, de modo que la distancia de "de acuerdo" a "muy de acuerdo" puede no coincidir con la de "neutral" a "de acuerdo". En rigor, eso aboga por informar medianas y distribuciones de frecuencia en lugar de medias. En la práctica, muchos equipos informan medias de escalas de Likert y similares porque son fáciles de comunicar y comparar, lo cual es aceptable siempre que también observes la distribución completa. Una escala de 5 puntos con una media de 3,0 podría ser un grupo compacto en el punto medio o una división polarizada entre unos y cincos, y esas dos situaciones exigen respuestas muy distintas. Grafica siempre la distribución, no solo la media.

La representación en móvil también merece una reflexión. Una fila NPS de once puntos puede ajustarse de forma incómoda en una pantalla estrecha, y un ítem de Likert de siete puntos totalmente etiquetado puede quedar apretado. Prueba cada escala en un teléfono antes de lanzarla, ya que una gran parte de las respuestas de encuesta llega ahora en dispositivos móviles, y una escala que se ve bien en un ordenador pero se rompe en móvil hará caer en silencio tanto la finalización como la calidad de los datos. La mejor escala sobre el papel no vale nada si los encuestados la leen mal en el dispositivo que de verdad utilizan.

Preguntas frecuentes

¿Cómo se calcula la puntuación NPS? Agrupa a los encuestados en la escala 0-10 en Promotores (9-10), Pasivos (7-8) y Detractores (0-6), y luego resta el porcentaje de Detractores del porcentaje de Promotores. El resultado va de -100 a +100; los Pasivos se cuentan en la base pero no suman directamente a la puntuación.

¿Debería una escala de valoración tener un punto medio neutral? Depende. Un número impar de puntos da a los encuestados una opción neutral genuina, lo cual es honesto cuando la neutralidad es una postura real. Un número par fuerza una inclinación, útil cuando quieres específicamente empujar a los encuestados a salir de la indecisión, pero puede frustrar a los encuestados verdaderamente neutrales.

¿Cuántos puntos debería tener una escala de Likert? Cinco y siete puntos son las opciones más comunes y mejor probadas. Cinco es más sencillo y rápido; siete ofrece una discriminación más fina. Ir más allá de siete rara vez mejora la fiabilidad y aumenta el esfuerzo del encuestado.

¿Cuál es la diferencia entre CSAT y NPS? El CSAT mide la satisfacción con una interacción concreta inmediatamente después de que ocurre, mientras que el NPS mide la lealtad general y la disposición a recomendar. El CSAT es transaccional y a corto plazo; el NPS es relacional y se usa para la comparación a largo plazo.

Añade cualquier escala de valoración -Likert, NPS, CSAT, estrellas- a tu encuesta en unos pocos clics con SurveyMaker.

Empieza a crear gratis o abre una plantilla de investigación de mercado.

Publicaciones populares

SurveyMaker.io

Crea encuestas, cuestionarios y formularios profesionales con IA en minutos.

Comenzar
Build your first survey with AI — free No credit card · ready in seconds Get started