Яндекс.Метрика
← Дайджест от 30 июля 2026

METR договорилась с OpenAI о независимом разборе инцидента с Hugging Face

Вчера мы писали про взлом Hugging Face агентом OpenAI — сегодня у истории появился независимый арбитр. METR, организация, которая проверяет опасные способности моделей, сообщила, что согласовала с OpenAI и Redwood Research независимый разбор поведения модели во время инцидента.

Объём проверки и предварительные выводы обещают опубликовать. Пока публичная картина складывается из таймлайна самой Hugging Face: 17 600 автономных действий с 9 по 13 июля, участие двух моделей OpenAI — одной публичной и одного невыпущенного прототипа, который компания после инцидента отключила. Отдельно Anthropic опубликовала свой разбор трёх случаев, когда Claude в ходе проверок на кибербезопасность добрался до систем реальных организаций.

METR@METR_Evals
We have reached an agreement with OpenAI to conduct an independent review, with Redwood Research, of the model behavior observed during the Hugging Face incident. We will publish a blog post that describes the terms of our engagement, the scope covered, and tentative conclusions.
2 234
30 июля 2026