Puntuación estándar moderna de CI
Media 100 y desviación estándar 15. Es la convención más habitual en las escalas Wechsler y Stanford-Binet contemporáneas y en muchos otros compuestos cognitivos.
+2 DE = 130La referencia completa sobre puntuaciones
La guía práctica definitiva sobre rangos de CI, percentiles, desviaciones estándar, conversiones de puntuaciones, intervalos de confianza, principales familias de pruebas, historia, equidad y lo que una puntuación puede —y no puede— significar.
Una puntuación de CI suele ser una puntuación estándar referida a normas. Describe cómo se compara el rendimiento en un conjunto estandarizado de tareas cognitivas con el de un grupo de referencia de la misma edad. En la escala moderna más habitual, la media es 100 y la desviación estándar es 15.
La cifra no es un porcentaje de respuestas correctas, una cantidad fija de inteligencia ni una medida directa del valor de una persona. Un informe profesional debe identificar la prueba y edición exactas, el grupo normativo, el rango percentil, el intervalo de confianza, las consideraciones de validez y el patrón de puntuaciones generales y específicas.
Esta guía explica los sistemas de puntuación y su interpretación responsable sin reproducir ejercicios protegidos, claves de respuestas ni normas confidenciales de administración.
Última actualización: julio de 2026
Introduce una puntuación y elige la escala que aparece en el informe. La calculadora estima su puntuación Z, percentil, rareza y valores equivalentes en varios sistemas habituales de puntuación estándar.
Las etiquetas descriptivas son convenciones, no diagnósticos. Las editoriales y los profesionales pueden utilizar nombres, puntos de corte o normas de intervalos de confianza diferentes. El informe concreto es la autoridad para la puntuación que contiene.
| Rango de CI | Puntuación Z aproximada | Percentil aproximado | Denominación habitual | Nota interpretativa |
|---|---|---|---|---|
| 130 o más | +2,00 o más | Percentil 98 o superior | Muy alto / extremadamente alto | Aproximadamente el 2 % superior en una escala con media 100 y DE 15. |
| 120–129 | De +1,33 a +1,93 | Aproximadamente del percentil 91 al 97 | Alto / muy alto | Muy por encima de la media normativa. |
| 110–119 | De +0,67 a +1,27 | Aproximadamente del percentil 75 al 90 | Promedio alto | Por encima de la mitad central del grupo de referencia. |
| 90–109 | De −0,67 a +0,60 | Aproximadamente del percentil 25 al 73 | Promedio | La amplia franja central utilizada en muchos informes. |
| 80–89 | De −1,33 a −0,73 | Aproximadamente del percentil 9 al 23 | Promedio bajo | Por debajo de la franja central, pero no constituye un diagnóstico. |
| 70–79 | De −2,00 a −1,40 | Aproximadamente del percentil 2 al 8 | Muy bajo | Debe interpretarse junto con los intervalos de confianza, el funcionamiento adaptativo y el contexto. |
| 69 o menos | Menos de −2,00 | Percentil 2 o inferior | Extremadamente bajo | Una puntuación de CI, por sí sola, no permite establecer una discapacidad intelectual. |
Alrededor del 68 % de una distribución normal se encuentra dentro de una desviación estándar de la media: aproximadamente entre CI 85 y 115.
Alrededor del 95 % se encuentra dentro de dos desviaciones estándar: aproximadamente entre CI 70 y 130.
Alrededor del 99,7 % se encuentra dentro de tres desviaciones estándar: aproximadamente entre CI 55 y 145.
Un rango percentil indica el porcentaje del grupo normativo que obtuvo una puntuación igual o inferior a un resultado. No es una escala de intervalos iguales: la diferencia entre los percentiles 50 y 60 no equivale psicométricamente a la diferencia entre los percentiles 90 y 100.
| CI (DE 15) | Puntuación z | Percentil aproximado | Rareza aproximada en el extremo |
|---|---|---|---|
| 55 | −3.00 | 0.13º | Aproximadamente 1 de cada 741 obtiene esta puntuación o una inferior |
| 60 | −2.67 | 0.38º | Aproximadamente 1 de cada 261 obtiene esta puntuación o una inferior |
| 65 | −2.33 | 0.98º | Aproximadamente 1 de cada 102 obtiene esta puntuación o una inferior |
| 70 | −2.00 | 2.28º | Aproximadamente 1 de cada 44 obtiene esta puntuación o una inferior |
| 75 | −1.67 | 4.78º | Aproximadamente 1 de cada 21 obtiene esta puntuación o una inferior |
| 80 | −1.33 | 9.12º | Aproximadamente 1 de cada 11 obtiene esta puntuación o una inferior |
| 85 | −1.00 | 15.87º | Aproximadamente 1 de cada 6 obtiene esta puntuación o una inferior |
| 90 | −0.67 | 25.25º | Aproximadamente 1 de cada 4 obtiene esta puntuación o una inferior |
| 95 | −0.33 | 36.94º | Aproximadamente 1 de cada 3 obtiene esta puntuación o una inferior |
| 100 | 0.00 | 50º | La mediana |
| 105 | +0.33 | 63.06º | Aproximadamente 1 de cada 3 obtiene esta puntuación o una superior |
| 110 | +0.67 | 74.75º | Aproximadamente 1 de cada 4 obtiene esta puntuación o una superior |
| 115 | +1.00 | 84.13º | Aproximadamente 1 de cada 6 obtiene esta puntuación o una superior |
| 120 | +1.33 | 90.88º | Aproximadamente 1 de cada 11 obtiene esta puntuación o una superior |
| 125 | +1.67 | Percentil 95,22 | Aproximadamente 1 de cada 21 obtiene esta puntuación o una superior |
| 130 | +2.00 | Percentil 97,72 | Aproximadamente 1 de cada 44 alcanza o supera esta puntuación |
| 135 | +2.33 | Percentil 99,02 | Aproximadamente 1 de cada 102 obtiene esta puntuación o una superior |
| 140 | +2.67 | Percentil 99,62 | Aproximadamente 1 de cada 261 obtiene esta puntuación o una superior |
| 145 | +3.00 | 99.87º | Aproximadamente 1 de cada 741 alcanza o supera esta puntuación |
Las estimaciones de rareza suponen una distribución normal idealizada y están redondeadas. No deben utilizarse como recuentos exactos de población ni como umbrales clínicos.
La vía más segura para pasar de un sistema de puntuación a otro es la Puntuación z. Primero expresa la puntuación original en desviaciones estándar respecto de su media; después reconstruye ese valor con la media y desviación estándar de la escala de destino.
Una puntuación situada aproximadamente a +2 DE tiene una puntuación Z cercana a 2,00. Eso equivale a 130 en una escala de CI con DE 15, 132 en una escala de CI con DE 16, 148 en una escala tipo Cattell con DE 24 y 70 en una escala de puntuación T.
Por eso una cifra mayor no indica necesariamente un percentil más alto. La dispersión de la escala determina el valor impreso.
Media 100 y desviación estándar 15. Es la convención más habitual en las escalas Wechsler y Stanford-Binet contemporáneas y en muchos otros compuestos cognitivos.
+2 DE = 130Algunas pruebas históricas y tablas antiguas utilizan una desviación estándar de 16. Toda puntuación debe interpretarse junto con el nombre y la edición de la prueba.
+2 DE = 132Una escala más amplia que aparece a veces en contextos antiguos de alto CI. El mismo percentil genera una cifra aparentemente mucho mayor.
+2 DE = 148Sistema de puntuación estándar muy utilizado en psicología. La media es 50 y cada 10 puntos equivalen a una desviación estándar.
+2 DE = 70Muchas subpruebas cognitivas administradas individualmente utilizan una media de 10 y una desviación estándar de 3 antes de combinarse en puntuaciones compuestas.
+2 DE = 16La escala estadística universal. Una puntuación Z indica cuántas desviaciones estándar se encuentra un resultado por encima o por debajo de la media.
+2 DE = Z 2,00Lee un resultado de CI como una parte de la argumentación evaluativa. La puntuación debe responder a una pregunta real —como la planificación educativa, la aclaración diagnóstica o la documentación— e integrarse con la historia, las observaciones, otras pruebas y el funcionamiento cotidiano.
Registra la batería, la edición, el idioma, las normas de edad y la fecha de administración exactos.
Revisa la participación, la estandarización, las adaptaciones, la salud, la atención, el idioma y el acceso sensorial.
Interpreta el intervalo de confianza, no solo la puntuación puntual obtenida.
Compara los patrones generales, de índices y de subpruebas sin interpretar en exceso diferencias pequeñas.
Pregunta si los hallazgos encajan con el funcionamiento escolar, laboral, comunicativo y cotidiano.
Prioriza recomendaciones prácticas, apoyos y preguntas de seguimiento.
Ninguna puntuación obtenida es perfectamente precisa. Un profesional utiliza el error estándar de medida de la prueba para crear un intervalo de confianza. A modo de ejemplo, si un CI de 100 tuviera un error estándar de 3 puntos, un intervalo aproximado del 95 % sería de 94 a 106. El error estándar real varía según la prueba, la puntuación y la edad.
Rendimiento relativamente uniforme alrededor de la media.
Unas fortalezas y debilidades marcadas pueden hacer que una sola puntuación general sea menos representativa.
Los perfiles anteriores son ejemplos inventados con fines explicativos y no se basan en registros reales.
«Prueba de CI» es un término general. Las baterías difieren en rango de edad, duración, teoría, exigencia lingüística, método de administración, estructura de puntuación y uso previsto. Una puntuación nunca debe separarse del instrumento que la produjo.
Baterías administradas individualmente y adaptadas por edad que suelen ofrecer una puntuación compuesta general, además de puntuaciones por dominios y subpruebas.
Amplia batería individual de inteligencia descendiente de la tradición Binet-Simon, con vías verbales y no verbales hacia factores principales y puntuaciones de escala completa.
Baterías flexibles organizadas en torno a capacidades cognitivas amplias y específicas, a menudo integradas con la evaluación del rendimiento académico.
Medidas centradas en la infancia o breves que pueden destacar el procesamiento, los conocimientos adquiridos, el rendimiento no verbal o una detección eficiente.
Reducen la carga del lenguaje hablado y se centran más en el razonamiento visual, los patrones o la resolución no verbal de problemas; «no verbal» no significa libre de cultura.
Se administran a muchos estudiantes a la vez para detección o decisiones de programación. No son automáticamente intercambiables con una evaluación clínica individual del CI.
Comprender fortalezas y necesidades cognitivas junto con el rendimiento académico, las evidencias del aula y el historial de intervenciones.
Aportar evidencia a los criterios locales de los programas, a menudo junto con el rendimiento, la creatividad o los datos del profesorado.
Describir un perfil cognitivo dentro de una evaluación más amplia del desarrollo neurológico, la salud mental, la neurología o la medicina.
Apoyar decisiones cuando se combina con evidencias de funcionamiento y los requisitos de la entidad receptora.
Estudiar el desarrollo cognitivo, los patrones de grupo, los efectos de las intervenciones y las relaciones con otros resultados.
Ayudar a una persona a comprender su perfil cuando la evaluación tiene un objetivo claro y una interpretación cualificada.
La historia es científicamente influyente y éticamente compleja. La evaluación de la inteligencia nació de los intentos por identificar necesidades educativas, pero después quedó entrelazada con la clasificación masiva, la eugenesia, las políticas migratorias y las jerarquías raciales. La práctica moderna debe reconocer esa historia y aplicar normas más estrictas de validez, equidad y uso responsable.
Francis Galton midió la agudeza sensorial, el tiempo de reacción y características físicas en un primer intento de cuantificar las diferencias individuales.
James McKeen Cattell utilizó la expresión «pruebas mentales» para una batería centrada en el rendimiento sensorial y motor.
Alfred Binet y Théodore Simon publicaron un conjunto práctico de tareas para identificar a niños que podían necesitar apoyo educativo. Todavía no generaba el CI de desviación moderno.
Las revisiones organizaron las tareas según las edades a las que los niños solían resolverlas, lo que respaldó la idea de estimar una edad mental.
William Stern describió un cociente que relacionaba la edad mental con la edad cronológica; usuarios posteriores multiplicaron la proporción por 100.
Lewis Terman adaptó y estandarizó el enfoque Binet-Simon para Estados Unidos, lo que contribuyó a popularizar el término CI.
Durante la Primera Guerra Mundial se utilizaron pruebas colectivas a una escala sin precedentes. Esto demostró el alcance de su administración, pero también expuso grandes problemas de idioma, educación y equidad.
David Wechsler introdujo una batería para adultos que comparaba el rendimiento con pares de la misma edad y combinaba diversos tipos de tareas, en vez de depender del CI de razón.
El trabajo de James Flynn llamó la atención sobre los cambios generales en el rendimiento en pruebas y el problema del envejecimiento de las normas.
La interpretación moderna destaca las normas actuales, varios dominios cognitivos, los intervalos de confianza, la equidad, el funcionamiento adaptativo y el uso previsto de la puntuación.
La equidad no se consigue fingiendo que el contexto no existe. Exige evidencias de que la interpretación de las puntuaciones es válida para el uso previsto y para la persona evaluada, además de una atención cuidadosa al acceso, el idioma, las oportunidades, la discapacidad, la administración y las consecuencias.
El cansancio intenso puede reducir la atención, la memoria de trabajo, la velocidad y la perseverancia.
La enfermedad, el dolor, las afecciones neurológicas y los efectos de la medicación pueden modificar el rendimiento.
Realizar la evaluación en un idioma más débil puede afectar la comprensión de instrucciones, las tareas verbales, la relación con el examinador e incluso el rendimiento en tareas no verbales.
Las exigencias sensoriales o motoras pueden reducir las puntuaciones si las necesidades de acceso no se anticipan y documentan.
La ansiedad ante las pruebas, la baja implicación, el perfeccionismo o el miedo al fracaso pueden influir en la velocidad y la precisión.
La escolarización, la alfabetización, el enriquecimiento y la familiaridad con la resolución formal de problemas influyen en el rendimiento de muchas pruebas.
Los conocimientos, los estilos comunicativos y los supuestos incorporados a una evaluación pueden no resultar igual de familiares para todas las personas evaluadas.
Repetir la prueba o practicar con material similar puede generar efectos de práctica, especialmente en intervalos cortos.
Las interrupciones, una tecnología deficiente, la presión de tiempo, la conducta del examinador y una administración no estandarizada pueden influir.
Algunas adaptaciones mejoran el acceso sin alterar el constructo previsto; otras cambian la tarea lo suficiente como para que las normas estándar dejen de aplicarse con claridad. El informe debe documentar qué se cambió, por qué y cómo afecta la modificación a la interpretación.
No existe un «CI de altas capacidades» universal. Muchos programas utilizan umbrales cercanos a los percentiles superiores, pero varían las definiciones locales, las pruebas aceptadas, los límites de edad, la antigüedad permitida de la puntuación, los intervalos de confianza y las evidencias complementarias exigidas. Mensa utiliza el 2 % superior en una prueba aprobada, debidamente administrada y supervisada, en vez de una cifra universal de CI.
La AAIDD define la discapacidad intelectual por limitaciones significativas tanto en el funcionamiento intelectual como en el comportamiento adaptativo, originadas durante el periodo del desarrollo. Un CI obtenido cercano o inferior a 70 puede motivar una evaluación cuidadosa, pero no permite establecer un diagnóstico por sí solo.
La administración en línea no es automáticamente inválida, ni la presencial es automáticamente excelente. Las preguntas clave se refieren a la estandarización, las normas, la seguridad, la identidad, el entorno, el acceso, la fiabilidad, la validez y una interpretación adecuada.
Un percentil es una posición dentro de un grupo normativo. Estar en el percentil 75 no significa haber respondido correctamente al 75 % de los ejercicios.
La escala, las normas, la edición, el intervalo de confianza y los constructos cubiertos difieren. El percentil y el nombre de la prueba son esenciales.
Las pruebas de CI muestrean determinados rendimientos cognitivos. No miden por completo la creatividad, la sabiduría, el juicio práctico, la motivación, el carácter ni la experiencia.
Los resultados vitales dependen de muchos factores personales, sociales, educativos, sanitarios y de oportunidades, además del rendimiento en pruebas.
El diagnóstico exige limitaciones tanto en el funcionamiento intelectual como en el comportamiento adaptativo, con inicio durante el periodo del desarrollo.
Reducen la carga lingüística, pero la familiaridad, la educación, la experiencia visual, la motivación y el contexto de evaluación pueden seguir influyendo en el rendimiento.
La mayoría de los cuestionarios en línea carecen de administración controlada, contenido seguro, normas sólidas e interpretación profesional.
Entrenarse con contenido protegido amenaza la estandarización, la validez, la equidad y el uso clínico futuro.
Toda puntuación incluye error de medición. Los informes deben incluir un intervalo de confianza y comentar la validez.
En la escala moderna más habitual, la media normativa es 100. Una puntuación cercana a 100 representa un rendimiento próximo al centro del grupo de referencia de la misma edad, no un porcentaje de respuestas correctas.
Muchos compuestos actuales de inteligencia utilizan una desviación estándar de 15. Algunas pruebas o sistemas históricos emplean 16, 24 u otros valores; por eso importan el nombre y la edición de la prueba.
En una escala normal con media 100 y DE 15, 115 se encuentra una desviación estándar por encima de la media y corresponde aproximadamente al percentil 84.
En una escala con media 100 y DE 15, 130 se encuentra dos desviaciones estándar por encima de la media y corresponde aproximadamente al percentil 98. Las tablas específicas pueden redondear de otra manera.
En el modelo normal idealizado, sí. Las tablas normativas oficiales pueden emplear conversiones discretas y redondeos, por lo que un informe podría mostrar un percentil próximo.
Los sistemas de puntuación utilizan desviaciones estándar diferentes. El percentil 98 se sitúa aproximadamente en 130 en una escala con DE 15, 132 con DE 16 y 148 con DE 24.
Es el número de desviaciones estándar que un resultado se encuentra por encima o por debajo de la media. En una escala de CI con DE 15, Z = (CI − 100) ÷ 15.
Es un rango alrededor de la puntuación obtenida que comunica la incertidumbre de medición. Un intervalo del 95 % es más amplio que uno del 90 % y debe interpretarse junto con el manual de la prueba y el contexto de derivación.
Sí. Una persona puede mostrar un perfil uniforme entre dominios, mientras otra presenta un razonamiento verbal fuerte y menor velocidad de procesamiento o memoria de trabajo. La misma puntuación general puede resumir patrones distintos.
No existe una definición universal. Algunos programas utilizan aproximadamente los percentiles 95, 97 o 98; otros combinan capacidad, rendimiento, creatividad, evidencias del profesorado y criterios locales.
Mensa describe la elegibilidad como un rendimiento situado en el 2 % superior en una prueba de inteligencia aprobada, debidamente administrada y supervisada. La cifra clasificatoria depende de la prueba y su escala.
No. La discapacidad intelectual exige limitaciones significativas en el funcionamiento intelectual y el comportamiento adaptativo, con inicio durante el periodo del desarrollo. El profesional considera la puntuación, el intervalo de confianza, la validez y múltiples fuentes de evidencia.
Las puntuaciones pueden cambiar por el desarrollo, la salud, la educación, las intervenciones, las condiciones de evaluación, el error de medición, los efectos de práctica y la actualización de las normas. La magnitud y el significado del cambio requieren interpretación profesional.
La calidad varía mucho. Una medida de investigación o detección en línea bien diseñada puede estimar una capacidad concreta, pero los cuestionarios no supervisados no suelen sustituir una evaluación profesional estandarizada ni servir como documentación oficial.
Puedes estimar un percentil equivalente cuando se conocen la media y la desviación estándar originales, pero eso no corrige unas normas antiguas, constructos diferentes, techos de puntuación, ediciones distintas ni las condiciones de administración.
Un compuesto general de CI resume un rendimiento amplio en tareas seleccionadas. Las puntuaciones de índice resumen dominios más específicos, como comprensión verbal, razonamiento fluido, capacidad visoespacial, memoria de trabajo o velocidad de procesamiento, según la prueba.
Las muestras normativas contienen menos personas en los extremos, los techos pueden comprimir el rendimiento y un cambio pequeño en la puntuación directa puede generar una gran diferencia estándar. Los extremos altos y bajos exigen cautela.
Solo con prudencia. Compara primero los percentiles y los intervalos de confianza; después, considera el constructo medido, las normas, el rango de edad, la edición, el método de administración y el propósito de cada prueba.
Habilidades conceptuales, sociales y prácticas empleadas en la vida cotidiana. Es esencial en la evaluación de la discapacidad intelectual.
Grupo de comparación formado por personas de la misma edad o de un rango muy próximo.
Puntuación estándar formada al combinar el rendimiento de varias subpruebas.
Rango de puntuaciones que expresa la incertidumbre alrededor de un resultado obtenido.
Puntuación estándar que muestra la distancia respecto a la media del grupo de edad, generalmente en una escala con media 100.
Nivel más bajo que una prueba puede medir con una diferenciación útil.
Nivel más alto que una prueba puede medir con una diferenciación útil.
CI de escala completa: estimación compuesta general del funcionamiento cognitivo amplio en determinadas familias de pruebas.
Compuesto que representa un dominio cognitivo, en lugar de toda la batería.
Datos de referencia utilizados para convertir el rendimiento directo en puntuaciones interpretables.
Porcentaje del grupo normativo que obtiene una puntuación igual o inferior a un resultado, sujeto al redondeo específico de la prueba.
Mejora causada por la familiaridad o la exposición previa, en vez de por un cambio real en la capacidad objetivo.
Puntos o créditos iniciales obtenidos antes de la conversión mediante tablas normativas.
Consistencia o precisión de las puntuaciones en condiciones definidas.
Estimación de la variación esperable de la puntuación causada por la imprecisión de medición.
Evidencias que respaldan la interpretación y el uso de las puntuaciones para un fin concreto.
Valor estandarizado con media 0 y desviación estándar 1.
Utiliza el cuadro de impresión de tu navegador para obtener una copia limpia de referencia. Los elementos interactivos y los enlaces de fuentes se reducen automáticamente.
Créditos de las imágenes: El retrato de Alfred Binet y la fotografía de la evaluación militar de 1917 son de dominio público. La fotografía de David Wechsler se atribuye a New York University School of Medicine y tiene licencia CC BY 4.0. Las páginas de origen y licencia están disponibles a través de Wikimedia Commons.