Volver
ModelosInformada
Los modelos de IA más avanzados están alcanzando rápidamente a los exámenes diseñados para resistirles. Hace un año obtenían menos del 10 % en Humanity's Last Exam, una prueba de 2700 preguntas diseñada para ser difícil para la IA y favorable a los expertos humanos. Ahora la precisión ha alcanzado 38,3 % en Humanity's Last Exam, frente a menos del 10 % un año antes
Verificado 2026-08-29
EL INTELLIGENCE CLUB
Datos como este, seis días a la semana
The Daily Receipts entre semana, The Weekly Brief los sábados — cada dato trazado hasta el documento del que salió. Gratis.
Gratis para siempre. Seis correos a la semana: The Daily Receipts entre semana y The Weekly Brief los sábados. Cancela cualquiera de los dos con un clic.
Leer la edición de esta mañana →El filtro · 72 empresasCada capa de la cadena de la IA, con precios diariosCómo se verificóCada cifra enlaza con el informe del que salió
Más sobre Modelos
- El índice de capacidades de Epoch AI puntúa los modelos de frontera en una sola escala agregada y sitúa un quiebre de la tendencia en abril de 2024, cuando los modelos de razonamiento y el aprendizaje por refuerzo se impusieron en el entrenamiento de frontera. Antes del quiebre la frontera ganaba 8,3 puntos al año; después, 15,5 puntos al año, 1,85 veces la velocidad anterior
- Epoch AI probó tres detectores de IA comerciales — Pangram, GPTZero, Originality.ai — fijados en sus versiones de junio de 2026. Ante texto generado por máquina sencillo detectan casi todo, pero cuando a un modelo se le dieron cinco muestras de la escritura de un autor concreto y se le pidió imitar ese estilo, Detectores de IA fallaron en el 13 % del texto de IA que imita un estilo, frente a menos del 1 % del texto simple
- Epoch AI ajusta una tendencia sobre los modelos cuyas ventanas de contexto estaban entre las diez más largas el día de su lanzamiento, y observa que desde mediados de 2023 la ventana de contexto de frontera se vuelve unas 30 veces más larga cada año