Некоммерческая организация Future of Life Institute опубликовала летний выпуск AI Safety Index 2026 — регулярного рейтинга, оценивающего крупнейшие AI-лаборатории мира по практикам безопасности. Независимая панель из семи ведущих исследователей и экспертов по управлению ИИ изучила данные по каждой компании и выставила оценки по 37 показателям, сгруппированным в шесть доменов — от практик снижения текущих рисков до готовности к экзистенциальным угрозам.
Оценки выставлялись по системе, аналогичной американской шкале GPA: буквенные оценки A, B, C, D, F соответствуют числовым значениям 4.0, 3.0, 2.0, 1.0 и 0. Рецензенты предоставляли письменные обоснования и рекомендации по улучшению; итоговые баллы — усреднённые оценки экспертной группы.
Лучший результат в рейтинге получил Anthropic — оценка «C+» (2.66 балла), лидерство в пяти из шести доменов оценки. Следом расположился OpenAI с оценкой «C» (2.28), третье место у Google DeepMind — также «C» (2.01). Meta улучшила показатели до «D+» (1.32).
Китайские компании Z.ai (0.88) и Alibaba Cloud (0.87) получили оценку «D−». Три лаборатории — xAI (0.65), DeepSeek (0.47) и Mistral (0.33) — получили неудовлетворительные оценки «F», по одной компании от США, Китая и Европы соответственно. Ни одна из девяти оценённых компаний не поднялась выше «C+» — то есть лучший результат в индустрии по-прежнему соответствует школьной «тройке с плюсом».
Отдельно рецензенты выделили как формирующийся текущий риск разворот индустрии в сторону военного применения ИИ. По данным доклада, с 2024 по 2026 год компании, включая Anthropic, OpenAI, Google DeepMind и Meta, ранее публично запрещавшие военное использование своих моделей в условиях использования, постепенно смягчили эти ограничения и присоединились к xAI и Mistral в активном поиске партнёрств с оборонными ведомствами. Эксперты рассматривают этот сдвиг как показатель того, что коммерческое давление и геополитическая конкуренция начинают перевешивать ранее заявленные этические ограничения индустрии.
Российские компании — Сбер с GigaChat и Яндекс с YandexGPT — не вошли в выборку Future of Life Institute, которая традиционно фокусируется на компаниях, доминирующих на глобальном рынке за пределами Китая и США лишь эпизодически. Тем не менее сам факт, что даже признанный лидер отрасли по безопасности — Anthropic — получает лишь «тройку с плюсом», задаёт ориентир и для российских регуляторов: разрабатываемые сейчас требования к суверенным моделям (в рамках недавно принятого закона об ИИ) будут формироваться в условиях, когда мировая индустрия пока не выработала эталонных практик безопасности, на которые можно было бы прямо ориентироваться.
Для российских компаний, встраивающих в свои продукты модели западных или китайских разработчиков — будь то через API или открытые веса, — рейтинг даёт независимый ориентир при выборе поставщика: отчётливо разный профиль рисков у компаний с оценкой «C» и у тех, что получили «F», может быть значимым фактором при оценке комплаенс-рисков корпоративного внедрения.
Индекс Future of Life Institute не лишён критики: часть индустрии указывает, что оценки во многом опираются на публично раскрываемую информацию — документы, отчёты о безопасности, политики компаний, — а не на прямой технический аудит моделей. Это значит, что компании с более развитой PR-функцией и подробной публичной документацией потенциально получают более высокие оценки независимо от фактического уровня внутренних практик безопасности, а закрытые лаборатории могут быть недооценены просто из-за меньшей прозрачности.
Тем не менее с момента первого выпуска индекса в 2024 году он стал одним из немногих регулярно обновляемых независимых ориентиров для инвесторов, регуляторов и корпоративных заказчиков, которые пытаются сравнивать AI-лаборатории не только по производительности моделей, но и по зрелости практик управления рисками. Следующий выпуск индекса ожидается в конце 2026 года — и рецензенты уже отметили, что будут отдельно отслеживать, продолжится ли тренд на смягчение ограничений по военному применению ИИ среди ведущих лабораторий.
Показательно, что за два года публикации индекса ни одна компания так и не приблизилась к оценке «B» — притом что средние баллы по индустрии в целом растут за счёт подтягивания отстающих, а не прорыва лидеров. Это подтверждает тезис самих составителей индекса: гонка за возможностями моделей по-прежнему опережает гонку за практиками их безопасного использования, и разрыв между ними скорее увеличивается, чем сокращается.