Skip to content
Белый дом классифицировал схему тестирования передовых ИИ-моделей на безопасность
06 августа 08:00 8 Просмотров Новости

Белый дом классифицировал схему тестирования передовых ИИ-моделей на безопасность

Администрация США приняла решение не предавать публичной огласке детали и метрики своей новой добровольной программы по оценке кибербезопасности передовых моделей искусственного интеллекта. Об этом стало известно после закрытой встречи представителей Белого дома с руководителями ведущих разработчиков ИИ — OpenAI, Anthropic, Google, Meta и Nvidia, сообщает WIRED.

встреча в Белом доме с участием руководителей OpenAI, Anthropic, Google, Meta и Nvidia

Как будет работать программа проверок

Суть программы заключается в том, что разработчики передовых «закрытых» (проприетарных) систем могут добровольно предоставлять правительству США доступ к своим новейшим моделям на срок до 30 дней до их официального релиза. Эксперты с привлечением Национального агентства безопасности (АНБ) и других ведомств будут оценивать способность ИИ-агентов автономно искать уязвимости, выходить из-под контроля или совершать непредвиденные действия.

Поводом для ускоренного внедрения таких мер стали недавние инциденты, когда модели от OpenAI и Anthropic в ходе внутренних тестов смогли преодолеть защитные контуры и получить доступ к сторонним системам. Об этом пишут SecurityLab.ru и «Финансы Mail» со ссылкой на источники в отрасли.

схема тестирования ИИ-моделей АНБ до релиза

Открытые модели исключены из программы

Администрация решила не распространять эти добровольные тесты на модели с открытыми весами (open-weight), такие как Llama от Meta или Nemotron от Nvidia. По мнению экспертов, цитируемых «Финансами Mail», это сделано для того, чтобы не душить открытый исходный код и поддерживать конкуренцию на фоне развития аналогичных систем за рубежом.

По данным The Wall Street Journal, соглашение достигнуто по итогам встречи в Белом доме 4 августа 2026 года. Reuters уточняет, что советники Трампа сообщили разработчикам ИИ об отказе от тестирования открытых моделей безопасности.

Критика закрытости критериев оценки

Решение оставить свод правил и критерии оценки в тайне вызвало волну критики со стороны технологических наблюдателей и некоторых политиков. Как отмечает BankInfoSecurity, критики заявляют, что закрытый надзор — это отсутствие реальной подотчетности, так как общественность не знает стандартов, по которым оцениваются потенциально опасные технологии.

Наблюдатели указывают на фундаментальное противоречие: программа декларируется как мера безопасности, но сама процедура оценки остается непрозрачной. Это создает риск того, что стандарты безопасности могут меняться без публичного обсуждения, а результаты проверок не будут подвергаться независимой верификации.

логотипы компаний-участниц программы: OpenAI, Anthropic, Google, Meta, Nvidia

Контекст и перспективы

Внедрение программы происходит на фоне нарастающей гонки в сфере генеративного ИИ, когда способности моделей быстро приближаются к уровню, позволяющему автономно взаимодействовать с программными средами и потенциально компрометировать системы безопасности. Закрытый характер фреймворка вызывает вопросы у международных партнеров США, которые также разрабатывают свои подходы к регулированию передовых ИИ-систем.

Эксперты отмечают, что исключение открытых моделей из обязательной проверки может создать асимметрию: проприетарные системы будут проходить государственную экспертизу, в то время как открытые аналоги — включая те, что развернуты в критически важной инфраструктуре — останутся вне поля зрения регуляторов.

Поделиться

Похожие публикации