Яндекс.Метрика
← Дайджест от 18 августа 2026

OpenAI остановила обучение самых мощных моделей на две недели

OpenAI впервые публично затормозила собственную разработку. Компания на две недели остановила дообучение с подкреплением (когда модель учат на её же ответах, награждая за верный результат) для моделей, которые готовились к выпуску, а самый крупный запланированный запуск до сих пор стоит на паузе.

Причина — киберспособности. Предварительные оценки показали, что готовящаяся модель под кодовым именем Astra может дотягивать до уровня Critical по внутренней шкале OpenAI Preparedness Framework — то есть умеет находить и использовать уязвимости на опасном уровне. Дополнительным поводом стал недавний инцидент с взломом, в котором фигурировали OpenAI и Hugging Face.

Вместо большого запуска компания проводит компактные эксперименты, проверяет поведение текущего чекпоинта и ужесточила внутренние правила: изоляция песочниц, сетевые ограничения, расширенный мониторинг цепочек рассуждений. Гендиректор Сэм Альтман и главный научный сотрудник Якуб Пахоцки подтвердили паузу лично; Майлз Брандейдж из числа бывших сотрудников OpenAI призвал разбирать не технические детали инцидентов, а культуру безопасности.

Sam Altman@sama
We have paused some frontier RL training to ensure that we can meet the appropriate alignment, security and monitoring standards for the new level of capabilities in front of us. Model progress is now extremely rapid, and we always said we would take action if we felt that model
18 августа 2026
Что говорят
KaiserProHacker News
Я работал во «фронтир-лаборатории» ещё до того, как их так стали называть. У нас было три уровня изоляции: тонкий прокси в интернет из DMZ; полуизолированный сегмент с жёстким файрволом и доступом лишь к нескольким внутренним сервисам без интернета; и полностью отрезанный — с доступом к репозиторию и сборке только по заявкам. Ни на одном уровне не было прямого прокси в публичную сеть.
sergio_valenciaHacker News
Мне интереснее всего, что происходит между обнаружением и решением поставить обучение на паузу. Для человека 30 минут на разбор — нормально, но что если в это время случится высокорисковый вызов инструмента? Если вызовы исполняются в реальном времени, мониторинг становится постфактумным, а если их задерживают — задержка и доступность мониторинга сами становятся частью контракта безопасности.
miohtamaHacker News
Я не против пары безобидных инцидентов со взломом, если взамен получу модели лучше, быстрее и дешевле. Защищать свои системы — задача администраторов: OpenAI просто постучалась, а вот русские и китайцы уже внутри, если вы не делаете свою работу.