Progresos en la evaluación de la inteligencia artificial: Nuevas pruebas y resultados

Por tecnoticias, 19 Julio, 2026

En el ámbito de la inteligencia artificial, surge la pregunta de si estas tecnologías han evolucionado más allá de ser simples «loros estocásticos». Para evaluar su progreso, se han desarrollado diversas pruebas, como el Humanity’s Last Exam (HLE), que abarca 2.500 preguntas de múltiples disciplinas. Recientemente, los modelos han mostrado mejoras significativas, alcanzando tasas de acierto del 35 al 50% en menos de un año. Sin embargo, persisten limitaciones en su capacidad de razonamiento abstracto y sentido común, lo que sugiere que aún están lejos de igualar la inteligencia humana.

Puntos clave:
  • El HLE es una prueba que evalúa conocimientos en diversas disciplinas con preguntas de nivel graduado.
  • Los modelos de IA han mejorado su rendimiento, alcanzando hasta un 50% de aciertos en algunas pruebas.
  • A pesar de los avances, los modelos siguen enfrentando dificultades en tareas que requieren sentido común y razonamiento abstracto.
  • Se han desarrollado pruebas adicionales, como el ARC-AGI, para medir la capacidad de descubrir nuevas reglas.
  • Los modelos actuales aún no muestran una inteligencia general comparable a la humana.
Análisis, redacción, categorización y etiquetado asistido por IA.