Hacker News Digest

03 сентября 2026 г. в 19:45 • arcprize.org • ⭐ 193 • 💬 121

OriginalHN

#arc-agi-3#arc-prize#astra#gpt-6#llm#openai#provider-adapter

OpenAI's GPT-6 Astra on ARC-AGI-3

GPT-6 Astra достиг прорывных результатов на benchmark ARC-AGI-3, решая 99,9% задач при стоимости всего $19K с использованием специальной архитектуры Provider Adapter, которая сохраняет и сжимает внутреннее состояние между запросами. При этом модель использует на 96% уровней меньше действий, чем средний человек, демонстрируя не только точность, но и исключительную эффективность. Ключевое достижение — способность превращать незнакомые среды в компактные символические модели: Astra формулирует собственные логические правила и сокращённый язык для отслеживания состояния и планирования действий, что напоминает человеческое абстрагирование.

Несмотря на впечатляющие результаты, OpenAI подчёркивает, что это не доказательство AGI. ARC-AGI-3 — узкий, детерминированный тест с закрытыми правилами, в отличие от открытой и неопределённой реальности. Модель не пыталась выйти за рамки среды, а её успехи измеряются в эффективности, а не в универсальности. Тем не менее, Astra демонстрирует резкий скачок в способности к самостоятельному обучению, моделированию и планированию без явных инструкций — ключевых компонентов агентного интеллекта. Это важный ориентир для следующих поколений бенчмарков, которые будут тестировать самосовершенствование и творческое обобщение.