Белый дом классифицировал схему тестирования передовых ИИ-моделей на безопасность
Администрация США приняла решение не предавать публичной огласке детали и метрики своей новой добровольной программы по оценке кибербезопасности передовых моделей искусственного интеллекта. Об этом стало известно после закрытой встречи представителей Белого дома с руководителями ведущих разработчиков ИИ — OpenAI, Anthropic, Google, Meta и Nvidia, сообщает WIRED.
Как будет работать программа проверок
Суть программы заключается в том, что разработчики передовых «закрытых» (проприетарных) систем могут добровольно предоставлять правительству США доступ к своим новейшим моделям на срок до 30 дней до их официального релиза. Эксперты с привлечением Национального агентства безопасности (АНБ) и других ведомств будут оценивать способность ИИ-агентов автономно искать уязвимости, выходить из-под контроля или совершать непредвиденные действия.
Поводом для ускоренного внедрения таких мер стали недавние инциденты, когда модели от OpenAI и Anthropic в ходе внутренних тестов смогли преодолеть защитные контуры и получить доступ к сторонним системам. Об этом пишут SecurityLab.ru и «Финансы Mail» со ссылкой на источники в отрасли.
Открытые модели исключены из программы
Администрация решила не распространять эти добровольные тесты на модели с открытыми весами (open-weight), такие как Llama от Meta или Nemotron от Nvidia. По мнению экспертов, цитируемых «Финансами Mail», это сделано для того, чтобы не душить открытый исходный код и поддерживать конкуренцию на фоне развития аналогичных систем за рубежом.
По данным The Wall Street Journal, соглашение достигнуто по итогам встречи в Белом доме 4 августа 2026 года. Reuters уточняет, что советники Трампа сообщили разработчикам ИИ об отказе от тестирования открытых моделей безопасности.
Критика закрытости критериев оценки
Решение оставить свод правил и критерии оценки в тайне вызвало волну критики со стороны технологических наблюдателей и некоторых политиков. Как отмечает BankInfoSecurity, критики заявляют, что закрытый надзор — это отсутствие реальной подотчетности, так как общественность не знает стандартов, по которым оцениваются потенциально опасные технологии.
Наблюдатели указывают на фундаментальное противоречие: программа декларируется как мера безопасности, но сама процедура оценки остается непрозрачной. Это создает риск того, что стандарты безопасности могут меняться без публичного обсуждения, а результаты проверок не будут подвергаться независимой верификации.
Контекст и перспективы
Внедрение программы происходит на фоне нарастающей гонки в сфере генеративного ИИ, когда способности моделей быстро приближаются к уровню, позволяющему автономно взаимодействовать с программными средами и потенциально компрометировать системы безопасности. Закрытый характер фреймворка вызывает вопросы у международных партнеров США, которые также разрабатывают свои подходы к регулированию передовых ИИ-систем.
Эксперты отмечают, что исключение открытых моделей из обязательной проверки может создать асимметрию: проприетарные системы будут проходить государственную экспертизу, в то время как открытые аналоги — включая те, что развернуты в критически важной инфраструктуре — останутся вне поля зрения регуляторов.