Zurück
ModellePrimärquelle

Epoch AI überprüfte seinen FrontierMath-Benchmark, nachdem OpenAI verdächtig hohe Ergebnisse gemeldet hatte, und die am 12. Juni 2026 veröffentlichte v2-Version korrigierte Fehler in 42 % der ursprünglichen Aufgaben – übrig blieb ein geprüfter Satz von 338 Aufgaben in vier Stufen. 42 % der ursprünglichen FrontierMath-Aufgaben enthielten Fehler

QuelleEpoch AI·June 2026 (v2 release)

Geprüft 2026-08-24

DER INTELLIGENZ-CLUB

Fakten wie diese, sechs Tage die Woche

The Daily Receipts an Werktagen, The Weekly Brief am Samstag — jeder Fakt bis zur Quelle belegt. Kostenlos.

Für immer kostenlos. Sechs E-Mails pro Woche — The Daily Receipts an Werktagen, The Weekly Brief am Samstag. Jede einzeln mit einem Klick abbestellbar.

Die heutige Ausgabe lesen →