GPT-5.6 Sol обошёл Opus 5 на ARC-AGI-3 — с двумя настройками API
OpenAI заявила: с двумя настройками API GPT-5.6 Sol набрал 38.3% на ARC-AGI-3 против 30.2% у Opus 5. Без них та же модель показывала лишь 7.8% — триумф инфраструктуры, не архитектуры.
GPT-5.6 Sol набрал 38.3% на бенчмарке ARC-AGI-3 против 30.2% у Claude Opus 5 — но только с двумя новыми настройками API: «Retained Reasoning» (сохранение цепочки мышления между шагами) и «Compaction» (сжатие старого контекста вместо обрезки). Без них та же модель показывала лишь 7.8%.
Главная гонка в ИИ сместилась с архитектуры на инфраструктуру: организаторы ARC Prize признали такие настройки допустимыми, раз они открыты всем через API. OpenAI на этот раз победила не самой моделью, а тем, как она её запустила.
Source: the-decoder.com
Free course
Stop reading about AI — start building with it
The free Claude Code course: your first site, tool or game — no coding. No upsells, no cross-sells — nothing to buy here.
Start free →
Author
Evgenii Arsentev
PhD · Chief Executive Officer, digital health · AI transformation
Articles · Latest articles