Модель Astra почти прошла тест ARC-AGI-3, но по 360 долларов за одну игру

Франсуа Шолле, автор теста ARC-AGI, замерил Astra на ARC-AGI-3 — наборе интерактивных игр, правила которых модель выясняет по ходу партии. В стандартном режиме запуска модель набрала 66%.
Во второй конфигурации — непрерывный диалог и своё сжатие истории — результат вырос почти до 100%, но одна игра обошлась примерно в 360 долларов. То есть разрыв дал не сам вес модели, а код вокруг неё: как ставится задача и что делают с накопленным контекстом.
До релиза в каналах ходила цифра 98,6% без всякого упоминания стоимости.
François Chollet@fchollet
GPT-6 Astra represents a step-function change in model capability for interactive reasoning problems. It scores 66% on ARC-AGI-3 using our standard harness, and nearly 100% with a continuous conversation harness and custom compaction, at a cost of roughly $360 per game. In fact,
5 0863 сентября 2026
Что говорят
BetelbuddyHacker News
Из отчёта: людям платили 115 долларов за 90-минутную сессию плюс 5 долларов за пройденную игру — около 12,78 доллара за попытку. Но это плата за время и готовность участвовать; если считать только энергию мозга по цене электричества, выходит примерно 0,067 цента за игру.
piloto_ciegoHacker News
99,9% с правильной оснасткой? Значит, AGI уже здесь. Предсказываю: теперь ворота передвинут к «ну, человек дешевле и эффективнее», а через пару месяцев придумают новый тест, лёгкий для людей и трудный для ботов, — и так до конца моей жизни.
dwohnitmokHacker News
Пишут, что успех Astra помогает понять, какие способности ИИ пока недостижимы. Только вся статья так и не объяснила, какие именно — или я что-то пропустил, кроме «ну, на ARC-AGI-3 можно стать ещё сверхчеловечнее»?