Volver
Modelos6/día por emailPrimaria
Los matemáticos están empezando a admitir abiertamente que usaron IA. Epoch AI analizó todos los preprints de matemáticas enviados a arXiv y encontró que la proporción que reconocía el uso de IA saltó del 4% en abril de 2026 al 25% en agosto de 2026, y un 6% atribuyó a la IA una contribución sustancial a la investigación
Verificado 2026-10-02
EL INTELLIGENCE CLUB
Datos como este, seis días a la semana
The Daily Receipts entre semana, The Weekly Brief los sábados — seis datos con fuente al día por email, dos más que la web gratuita. Cada uno trazado hasta el documento del que salió. Gratis.
Únete ahora y empiezas con 100 Receipts en The Receipts Ledger — tu primer paso hacia un año gratis de Iniciado o Pro. Cómo funciona →
Leer la edición de esta mañana →El filtro · 72 empresasCada capa de la cadena de la IA, con precios diariosCómo se verificóCada cifra enlaza con el informe del que salió
Más sobre Modelos
- Los modelos de IA ya pueden ganar el oro en la Olimpiada Internacional de Matemáticas, pero el AI Index 2026 de Stanford halló que aún fallan en una tarea que la mayoría de los niños dominan pronto. En los 180 diseños de reloj y 720 preguntas de ClockBench, el mejor modelo, GPT-5.4 High, leyó correctamente relojes analógicos solo el 50,6 % de las veces, frente al 90,1 % de los humanos
- El Índice de IA 2026 de Stanford hace seguimiento del desempeño de los modelos de IA en GPQA Diamond, un conjunto de preguntas de química y física de nivel doctoral diseñadas para resistir las búsquedas en Google. La precisión media de los modelos en esta prueba alcanzó el 93 % en 2025, frente a una referencia de validadores humanos expertos de 81,2 % -- los modelos de IA ya superan a los expertos con doctorado por 12 puntos en GPQA Diamond
- Los modelos de IA más avanzados están alcanzando rápidamente a los exámenes diseñados para resistirles. Hace un año obtenían menos del 10 % en Humanity's Last Exam, una prueba de 2700 preguntas diseñada para ser difícil para la IA y favorable a los expertos humanos. Ahora la precisión ha alcanzado 38,3 % en Humanity's Last Exam, frente a menos del 10 % un año antes