← Base de conocimiento
✂️

El problema del punto de corte

Las puntuaciones de personalidad se amontonan en el medio, y los sistemas de tipos ponen su raya justo ahí. Por qué estar al borde es el caso mayoritario y no la excepción, y para qué sirve un resultado intermedio.

Cómo medimos

Dibuja la distribución de cualquier rasgo de personalidad sobre una muestra grande y sale una sola joroba. Un pico en el medio que se afina hacia los dos lados —— la forma de la estatura, o de la velocidad de lectura, o de cuánto aguanta cada uno sin respirar.

No salen dos jorobas. No hay un valle entre introvertidos y extrovertidos donde no viva nadie, ni un hueco que separe a los del pensamiento de los del sentimiento. McCrae y Costa lo establecieron para las dimensiones del MBTI en 1989, y Bess y Harvey lo volvieron a buscar en 2002 con mejores métodos y encontraron lo mismo: continuo, unimodal, sin costura natural.

Un sistema de tipos tiene que cortar esa joroba por algún sitio, y la corta por el medio. Lo que significa que la raya divisoria pasa justo por la parte más densa de los datos, donde hay más gente que en ningún otro punto.

Ese es el problema del punto de corte, y su consecuencia no es sutil. Estar al borde es el caso normal, no la excepción. Si tu resultado te ha parecido alguna vez medio acertado, la explicación más probable es que lo sea, y que la mayoría de quienes leen esa misma página estén en la misma situación.

En español el corte ya viene impreso: los decatipos

Hay una versión de esto que el lector hispanohablante puede tener literalmente delante, en papel, y que la versión inglesa de esta entrada tiene que construir como hipótesis.

Muchos cuestionarios editados en español no informan de puntuaciones directas ni de percentiles sino de decatipos: una escala típica de diez puntos, con la media situada en 5,5 y una desviación típica de 2 decatipos. Es la forma de puntuar del 16PF y de buena parte del catálogo profesional en castellano. En la práctica, casi todo el mundo que interpreta un perfil lee esa escala con dos rayas: de 1 a 3 «bajo», de 7 a 10 «alto», y el resto «promedio».

Míralo un segundo, porque es esta entrada entera en una línea. La escala se construyó explícitamente como un continuo normal, con su media y su desviación escritas en la definición, y después se lee con dos cortes. Nadie descubrió que hubiera tres clases de persona. Se trazaron dos rayas sobre una curva por comodidad de lectura, y a partir de ahí un decatipo 6 y un decatipo 7 —— separados por menos que el error de medida de casi cualquier escala corta —— reciben adjetivos distintos en el informe.

Y hay una segunda vuelta que solo existe en el mundo de los baremos. Los manuales en español ofrecen baremos distintos —— por sexo, por edad, por población general o por contexto de selección ——, y la conversión de tu puntuación directa a decatipo depende de cuál se elija. De modo que la misma respuesta puede caer a un lado o al otro de la misma raya según qué tabla usara quien corrigió. La raya no está solo en un sitio arbitrario: además se mueve, y el informe no suele decir cuál se usó. La entrada sobre percentiles y baremos explica de dónde sale cada tabla; lo que importa aquí es que hay más de una.

Conviene que esto no se lea como un ataque a los instrumentos profesionales, porque no lo es. Un decatipo es una forma perfectamente razonable de comunicar una posición, y es bastante más honesta que una etiqueta, porque conserva diez niveles en vez de dos. El problema no está en el decatipo. Está en la frase del informe que lo traduce a un adjetivo.

Cuánta gente es esto

Toma una dimensión con un corte en el punto medio. Las puntuaciones más cercanas a la raya son las más frecuentes, así que una banda de anchura moderada alrededor del centro se lleva una proporción grande del total —— en una distribución normal, el tercio central del rango contiene bastante más de un tercio de las personas.

Ahora hazlo cuatro veces. Un código de cuatro letras exige que cuatro lecturas independientes caigan cada una claramente de un lado. Aunque cada dimensión por separado dé una inclinación clara en la mayoría de los casos, la probabilidad de que las cuatro sean claras cae deprisa, porque las probabilidades se multiplican. El resultado es que una minoría de personas tiene un código en el que las cuatro letras son suyas con seguridad, y una mayoría amplia tiene al menos una letra en equilibrio sobre la raya.

Esta es la aritmética que hay debajo de las cifras de fiabilidad test-retest. No es que el cuestionario esté mal construido. Es que cuatro monedas al borde son cuatro ocasiones de volver distinto.

El caso más familiar es el que el test de introvertido o extrovertido tiene que manejar en cada pantalla de resultado: el grupo más numeroso en esa dimensión no es ninguno de los dos, y una pregunta binaria no tiene dónde ponerlo. La entrada sobre introversión y extroversión desarrolla qué hacer con ese medio.

También es la razón de que las preguntas del tipo «qué porcentaje de gente es INFJ» tengan respuestas inestables según la web. La rareza de un tipo es en parte un hecho sobre las personas y en parte un hecho sobre dónde puso sus rayas una editorial concreta.

Cuándo una categoría es legítima

Cortar un continuo no está automáticamente mal. La psicología tiene un método para decidir cuándo una categoría está de verdad ahí, y conviene saber que existe, porque zanja la discusión de una forma que la opinión no.

Paul Meehl desarrolló la taxometría justo para esto: un conjunto de técnicas que preguntan si bajo un conjunto de medidas continuas hay una categoría latente —— un taxón —— o si las medidas son simplemente dimensionales. Las técnicas pueden salir por cualquiera de los dos lados. Aplicadas al sexo biológico, encuentran un taxón. Aplicadas a casi todo lo demás, no.

Haslam, Holland y Kuppens revisaron 177 estudios taxométricos en personalidad y psicopatología y encontraron que la gran mayoría de los constructos salía dimensional. Sobrevivieron algunos candidatos, unos pocos en la literatura clínica. Los rasgos de personalidad normal, en general, no.

Así que la afirmación defendible es estrecha: las diferencias de personalidad son reales, medibles, consecuentes y continuas. Las categorías puestas encima son comodidades. Una comodidad puede seguir siendo útil —— en clínica se traza un umbral diagnóstico sobre un malestar continuo porque las decisiones de tratamiento son binarias, y el umbral se gana su sitio por ir seguido de una decisión.

Esto merece un párrafo aparte en español, porque «punto de corte» es en castellano sobre todo un término clínico: quien lo ha oído antes lo ha oído hablando de un cribado de depresión o de ansiedad, donde tiene sentido. La palabra llega con esa respetabilidad puesta, y la arrastra al hablar de tipos de personalidad sin que nadie se dé cuenta. La pregunta que hay que hacerle a cualquier categoría de personalidad es la misma que se le hace a un umbral clínico: ¿qué decisión apoya esta raya que el número de debajo no apoyaría mejor? Para un corte de cribado suele haber respuesta —— derivar, evaluar, tratar. Para un código de cuatro letras normalmente no la hay.

Qué cuesta un corte

Tres pérdidas concretas, y las tres aparecen en el uso ordinario.

Dos personas a lados opuestos pueden ser casi idénticas. Un 49 y un 51 se diferencian en menos que el error de medida, y reciben letras distintas, descripciones distintas y consejos distintos. Mientras tanto un 51 y un 95 reciben la misma letra y la misma descripción, aunque tengan mucho menos en común.

La descripción está escrita para los extremos. Los retratos de tipo se elaboran a partir de gente que puntúa claramente, porque es en esa gente donde el patrón se ve. Un lector que está en el 52 por ciento lee un retrato construido con personas del 90 y concluye que el sistema no funciona o, peor, que él es un mal ejemplar de su propio tipo.

El error se amplifica en vez de absorberse. En una escala, unos pocos ítems mal leídos mueven tu puntuación un poco. En una categoría, esos mismos pocos ítems pueden moverte a un tipo distinto con otro nombre. Discretizar convierte ruido de medida pequeño en un cambio grande de salida, que es lo contrario de lo que debería hacer una medición.

Hay una cosa que un corte sí compra de verdad, y no es poca: una categoría es memorable, comunicable y socialmente útil. Cuatro letras se dicen en una frase, se imprimen en un perfil, sirven para encontrar gente. Un percentil no. Es un beneficio real y es la razón auténtica de que dominen los sistemas de tipos —— no que alguien crea que las categorías son naturales, sino que un número no se comparte y un nombre sí. La entrada sobre los apodos de los tipos va sobre lo que pasa cuando ese nombre empieza a trabajar.

Si tu resultado está al borde

Lo más probable es que lo esté. Esto es lo que te está diciendo en realidad.

Una puntuación intermedia es un hallazgo, no un fallo. No significa que el test no supiera leerte ni que contestaras mal. Significa que estás cerca de la media en esa dimensión, que es donde está la mayoría, y que con frecuencia es una ventaja —— una extraversión moderada es más adaptable que cualquiera de los dos extremos, y con casi todos los rasgos pasa lo mismo.

Lee la dimensión, no la letra. Si nuestro test de estilo MBTI te sitúa en el 53 por ciento hacia un lado, la frase útil es «más o menos equilibrado en esto», no la letra. Los porcentajes están impresos al lado del código por este motivo, y el código es la parte de la que hay que desconfiar.

No persigas el resultado claro. Repetir un test hasta que una letra se afirme es seleccionar una sesión afortunada, no descubrir una verdad. Si el número queda cerca del medio en dos sesiones, esa es la respuesta.

Prefiere la escala cuando hay una decisión en juego. Para cualquier cosa con consecuencias —— un puesto, unos estudios, una discusión con tu pareja sobre cuánta vida social es suficiente ——, la puntuación continua de los cinco grandes lleva más información que cualquier código de cuatro letras, precisamente porque no se tiró nada en ningún límite.

fuentes

  • · McCrae, R. R., Costa, P. T. (1989). Reinterpreting the Myers-Briggs Type Indicator from the perspective of the five-factor model of personality. Journal of Personality, 57(1), 17–40.
  • · Bess, T. L., Harvey, R. J. (2002). Bimodal score distributions and the Myers-Briggs Type Indicator: Fact or artifact? Journal of Personality Assessment, 78(1), 176–186.
  • · Meehl, P. E. (1995). Bootstraps taxometrics: Solving the classification problem in psychopathology. American Psychologist, 50(4), 266–275.
  • · Haslam, N., Holland, E., Kuppens, P. (2012). Categories versus dimensions in personality and psychopathology: A quantitative review of taxometric research. Psychological Medicine, 42(5), 903–920.

Más de la base de conocimiento