Ein Modell, zwei ARC-AGI-3-Werte im Abstand von 36 Punkten
Epoche: Das LLM-Zeitalter · 2020er–Gegenwart
Am 2. September 2026 veröffentlichte ARC Prize geprüfte ARC-AGI-3-Ergebnisse für GPT-6 Astra über zwölf Harness-Konfigurationen. Auf demselben halbprivaten Bewertungssatz erreicht das Modell 62,71% mit dem Standard-Harness, das ihm erlaubt, selbst gewählte Notizen mitzunehmen, und 98,55% mit einem Provider-Adapter-Harness, das den Denkzustand zwischen Anfragen bewahrt und lange Gespräche verdichtet. Astra brauchte auf 96% der Level weniger Züge als der Median der getesteten Menschen. Die Zahl misst ein Modell samt seinem Gerüst, weshalb hier beide stehen.
ARC Prize Foundation
Quellen und Belege
GPT-6 Astra — ARC-AGI Results
ARC Prize Foundation · Quellentyp: institutional-archive
ARC Prize records 62.71% with the Standard harness and 98.55% with the Provider Adapter harness for the same model on the same Semi-Private set, across twelve harness configurations.
Veröffentlicht: ·Abgerufen:
OpenAI’s GPT-6 Astra on ARC-AGI-3
ARC Prize Foundation · Quellentyp: primary-announcement
ARC Prize’s own analysis quotes 62.7% for $26K with the Standard harness and a best observed 99.9% for $19K with a Provider Adapter, and states that Astra used fewer actions than the median tested human on 96% of levels.
Veröffentlicht: ·Abgerufen: