La capacidad de la IA se está volviendo más barata de alcanzar, no solo más grande. Epoch AI comparó cuántos tokens costaba alcanzar la misma puntuación —alrededor del 27 % de precisión en su prueba FrontierMath— primero con o4-mini en abril de 2025 y luego con GPT-5.2 en diciembre de 2025, y encontró que esa capacidad se abarató unas 3 veces en ocho meses, parte de un abaratamiento de 5 a 10 veces al año
Verificado 2026-08-26
EL INTELLIGENCE CLUB
Datos como este, seis días a la semana
The Daily Receipts entre semana, The Weekly Brief los sábados — cada dato trazado hasta el documento del que salió. Gratis.
Gratis para siempre. Seis correos a la semana: The Daily Receipts entre semana y The Weekly Brief los sábados. Cancela cualquiera de los dos con un clic.
Leer la edición de esta mañana →Más sobre Modelos
- Los modelos de IA más avanzados están alcanzando rápidamente a los exámenes diseñados para resistirles. Hace un año obtenían menos del 10 % en Humanity's Last Exam, una prueba de 2700 preguntas diseñada para ser difícil para la IA y favorable a los expertos humanos. Ahora la precisión ha alcanzado 38,3 % en Humanity's Last Exam, frente a menos del 10 % un año antes
- El índice de capacidades de Epoch AI puntúa los modelos de frontera en una sola escala agregada y sitúa un quiebre de la tendencia en abril de 2024, cuando los modelos de razonamiento y el aprendizaje por refuerzo se impusieron en el entrenamiento de frontera. Antes del quiebre la frontera ganaba 8,3 puntos al año; después, 15,5 puntos al año, 1,85 veces la velocidad anterior
- Epoch AI probó tres detectores de IA comerciales — Pangram, GPTZero, Originality.ai — fijados en sus versiones de junio de 2026. Ante texto generado por máquina sencillo detectan casi todo, pero cuando a un modelo se le dieron cinco muestras de la escritura de un autor concreto y se le pidió imitar ese estilo, Detectores de IA fallaron en el 13 % del texto de IA que imita un estilo, frente a menos del 1 % del texto simple