Google DeepMind скрыла от себя тесты безопасности, а от проверяющих — веса модели

Google DeepMind запустила пилот двойной слепой проверки самых мощных моделей. Внешние специалисты по безопасности обычно оказываются в неудобной вилке: чтобы тестировать модель, надо показать лаборатории свои задания, а лаборатория не хочет отдавать наружу веса.
DeepMind строит защищённую среду, где не раскрывается ни то ни другое: тестовые запросы остаются скрытыми от разработчика модели, а веса — от проверяющего. Смысл в том, чтобы лаборатория не могла подогнать модель под известные ей задания, а сами задания не утекли и не устарели.
Компания называет это первым таким пилотом в отрасли; результатов проверок пока не публиковали.
Google DeepMind@GoogleDeepMind
In an industry first, we’re piloting double-blind evaluations for frontier AI. By creating a secure environment where neither test prompts nor model weights are revealed, we can ensure external safety and performance evaluations of our models remain private, robust, and https://t.co/puvIVxDjq7
62627 августа 2026