La competencia en la industria global de la inteligencia artificial (IA) se intensifica a medida que aumentan las capacidades de razonamiento de diversos modelos desarrollados por gigantes tecnológicos como OpenAI, Google y xAI. Los datos más recientes de TrackingAI, basados en la prueba de CI de Mensa Noruega, revelan un salto significativo en la inteligencia de estos modelos de IA en 2026.
Los resultados de las evaluaciones posicionan a modelos como Grok-4.20 Expert Mode y GPT-5.4 Pro en la cima, alcanzando puntuaciones de CI de 145. Esta cifra supera significativamente el promedio humano, situado en torno a 100, y clasifica a ambos modelos dentro del estándar intelectual de personas 'superdotadas' o genios en pruebas de razonamiento abstracto.
Las pruebas realizadas incluyeron 35 preguntas centradas en la identificación de patrones visuales, símbolos y lógica relacional. Curiosamente, los modelos equipados con capacidades de visión tendieron a mostrar un rendimiento superior en comparación con los modelos basados puramente en texto, debido a su habilidad para procesar patrones visuales de forma directa, al igual que la visión humana.
Este incremento en las puntuaciones ha sido muy rápido, teniendo en cuenta que en 2025 la puntuación más alta de la IA aún se situaba en 135. Sin embargo, los expertos advierten que la puntuación de CI es solo un instrumento de medición de la capacidad lógica. Este parámetro no abarca otros aspectos cruciales como la creatividad, la ética, la habilidad en programación o la precisión contextual en el procesamiento del lenguaje natural.
Por lo tanto, la consideración de cuál es el chatbot más inteligente sigue siendo subjetiva para los usuarios. La elección del mejor chatbot debería adaptarse idealmente a necesidades específicas, que van desde la productividad laboral y el análisis de datos complejos hasta el desarrollo de contenido creativo, ya que cada modelo posee fortalezas características distintas más allá de las simples cifras de CI.