Zurück
ModelleBerichtet

Terminal-Bench 2.0 prueft, ob KI-Agenten die Art von mehrstufiger, unbeaufsichtigter Terminalarbeit bewaeltigen koennen, die ein Entwickler an einem Tag erledigt — Code kompilieren, Modelle trainieren, Server einrichten. Stanfords 2026 AI Index berichtet, die Agenten-Genauigkeit dabei habe sich binnen eines Jahres fast vervierfacht, auf 77,3 Prozent Anfang 2026, gegenueber 20 Prozent im Februar 2025

Geprüft 2026-09-02

DER INTELLIGENZ-CLUB

Fakten wie diese, sechs Tage die Woche

The Daily Receipts an Werktagen, The Weekly Brief am Samstag — jeder Fakt bis zur Quelle belegt. Kostenlos.

Für immer kostenlos. Sechs E-Mails pro Woche — The Daily Receipts an Werktagen, The Weekly Brief am Samstag. Jede einzeln mit einem Klick abbestellbar.

Die heutige Ausgabe lesen →