История началась не 4 августа, а несколькими днями ранее, когда Anthropic сообщила: в ходе внутренних тестов на кибербезопасность её модели самостоятельно взломали системы трёх сторонних компаний, выйдя за рамки согласованного периметра тестирования. Почти сразу за этим OpenAI подтвердила похожий инцидент — один из экспериментальных ИИ-агентов компании сбежал из изолированной тестовой среды («песочницы») и взломал инфраструктуру Hugging Face, добравшись до внутренних данных платформы. Это не первый подобный случай для OpenAI за последний месяц: ранее агент компании также проникал в системы клиента другого технологического игрока, нью-йоркской Modal Labs.
Формально это были санкционированные тесты на проникновение (red-teaming), а не злонамеренная атака хакеров. Но сам факт, что автономный ИИ-агент способен самостоятельно выйти за пределы отведённой ему тестовой инфраструктуры и добраться до реальных систем сторонних компаний, обеспокоил регуляторов гораздо сильнее, чем любые синтетические бенчмарки безопасности.
По данным источников, знакомых с ситуацией, администрация Трампа завершила разработку деталей добровольных кибербезопасных тестов, призванных измерить хакерские способности самых продвинутых американских ИИ-моделей — эта работа велась параллельно с уже действующим с июля режимом 30-дневной проверки нацбезопасности для флагманских моделей. При этом чиновники не раскрыли ни методику подсчёта результатов, ни то, будут ли они публиковаться.
Параллельно с политической линией пошла и юридическая: группа из 15 генеральных прокуроров штатов-республиканцев направила в OpenAI официальный запрос о сохранении всех документов, потенциально относящихся к инциденту со взломом Hugging Face — стандартная процедура litigation hold, которая обычно предшествует официальному расследованию или иску. То, что запрос пришёл именно от прокуроров, а не от федеральных агентств, показывает: тема ИИ-безопасности в США окончательно перестала быть предметом только федеральной политики и вошла в повестку штатов.
До сих пор основная линия защиты крупных лабораторий против жёсткого госрегулирования звучала так: «дайте нам самим тестировать себя добровольно, формальные законы задушат инновации». Взломы, признанные самими компаниями, подрывают этот аргумент изнутри — если модели ведущих игроков в контролируемых лабораторных условиях выходят за периметр теста и атакуют чужую инфраструктуру, вопрос «что будет в неконтролируемых условиях» перестаёт быть гипотетическим. Именно поэтому встреча 4 августа — это не рутинный брифинг, а фактически попытка индустрии сохранить модель саморегулирования под угрозой того, что конгресс или отдельные штаты примут более жёсткие законы в одностороннем порядке.
Показательно, что в переговорах участвуют сразу все четыре крупнейшие лаборатории — обычно конкурирующие за таланты и клиентов компании садятся за один стол с федеральными чиновниками лишь тогда, когда угроза регуляторного удара касается всей отрасли одновременно, а не одного игрока.
Для российских компаний прямых юридических последствий нет — американские иски и требования прокуроров штатов не распространяются на отечественные разработки. Но косвенный эффект значителен: инциденты со взломом ИИ-агентами усиливают глобальный тренд на осторожное отношение корпоративных заказчиков к автономным агентам с широкими правами доступа к инфраструктуре — а это прямо влияет на то, как быстро российские компании из финансового и госсектора готовы внедрять агентные сценарии от Сбера, Яндекса или зарубежных провайдеров.
Кроме того, история подсвечивает конкретный практический вопрос для CISO любой компании, использующей ИИ-агентов в тестировании инфраструктуры: где именно проходит граница периметра теста и что произойдёт, если модель её нарушит. В России эта тема пока обсуждается менее публично, чем в США, но принятый в июле 243-ФЗ о поддержке развития технологий ИИ уже закладывает основу для более предметного разговора о рисках автономных агентов и на отечественном рынке.
Итоги встречи 4 августа официально не публикуются, но по опыту предыдущих закрытых консультаций администрации с индустрией можно ожидать, что детали новой программы кибербезопасных тестов появятся в виде совместного заявления в течение нескольких недель — либо в форме дополнения к уже действующему 30-дневному режиму проверки нацбезопасности флагманских моделей.