虎嗅

Самая надежная компания в области искусственного интеллекта не смогла соблюсти свои обязательства по обеспечению безопасности

原文:最安全的AI公司,也守不住安全承诺

Когда самая “безопасная” компания в области ИИ начинает действовать без ограничений: игра о доверии, деньгах и выживании

Здравствуйте, я ваш финансовый журналист. Сегодня мы поговорим не о каком-то скучном техническом отчете, а о кризисе доверия, произошедшем на самом верху кремниевой долины.

Главным героем этой истории является компания Anthropic, которая считается самой соблюдающей правила и придерживающейся принципов безопасности в индустрии ИИ. Основной персонажем — исследователь по имени Джейкоб Коксон, работающий в компании всего четыре месяца. 8 сентября 2026 года он внезапно уволился и публично заявил, что обе компании — Anthropic и OpenAI — рискуют человеческими жизнями в погоне за сверхинтеллектом, отказываясь от основных принципов безопасности.

Это событие вызвало большой резонанс не столько из-за самого увольнения, сколько из-за того, что Коксон сказал правду: “Я ушел до того, как были определены права на акции компании, мне больше не нужно было повышать ее оценку, чтобы получить прибыль”.

Представьте себе: у вас в руках огромный лотерейный билет, который скоро должен быть реализован (Anthropic планирует провести IPO в октябре, оценка компании составляет 2 триллиона долларов), но вы решаете его разорвать. Почему? Потому что вы считаете, что компания совершает ошибки, которые кажутся неприемлемыми.

Сегодня мы попытаемся разобраться в логике происходящего простым языком.

---

Первый шаг: от “тормозов” к “декоративным элементам”: тихое изменение обязательств по безопасности

Сначала давайте поймем, что именно изменилось в политике компании Anthropic.

В 2023 году компания опубликовала документ под названием “Политика ответственного расширения возможностей ИИ” (Responsible Expansion Policy, RSP). В нем содержалось очень важное обязательство, которое можно сравнить с “системой аварийных тормозов” автомобиля:

> “Если наши меры безопасности недостаточны, мы обязаны приостановить разработку более мощных моделей.”

Это было жесткое ограничение, без которого разработка не могла продолжаться. Тогда это было главным достоинством Anthropic, отличающим ее от OpenAI, стремящейся к скорости.

Однако в феврале 2026 года была выпущена версия RSP 3.0. В этом обновлении “аварийные тормоза” исчезли, их заменил более сложный набор инструментов для мониторинга: планы разработки, отчеты о рисках, внешний надзор.

Проще говоря:

Раньше было: “Если тормоза не работают, я останавливаюсь.”

Теперь: “Если с тормозами есть проблемы, я пишу отчет, объясняю, почему продолжаю движение, и веду машину, следуя показаниям приборной панели.”

Anthropic утверждает, что из-за неопределенности границ возможностей ИИ жесткие ограничения невыполнимы. Но вопрос в том: зачем же два года назад это было главным принципом компании? Почему именно перед IPO произошли такие изменения?

Еще более тревожным является то, что в тот же период компания подписала контракты на использование вычислительных ресурсов на сумму 517 миллиардов долларов на следующие десять лет. Компания, которая заранее фиксирует свои расходы на десять лет, вряд ли будет активно использовать меры безопасности. Обязательства по безопасности изменились с “мы не будем делать что-то определенное” на “мы будем объяснять, что мы сделали”.

Второй шаг: исчезновение двух ключевых слов: OpenAI тоже меняет свою политику

Вы думаете, что только Anthropic меняет свои документы? Нет, OpenAI тоже действует аналогично.

В ноябре 2025 года в годовом налоговом отчете (форма 990) OpenAI скрыто изменила свое миссионное заявление:

  • Раньше: “Создавать универсальный искусственный интеллект, безопасный для всего человечества, независимо от финансовых целей.”
  • Теперь: “Обеспечивать, чтобы универсальный искусственный интеллект приносил пользу всему человечеству.”

Обратите внимание: два ключевых слова исчезли:

1. “Безопасный”: обязательства по безопасности стали менее выраженными.

2. “Независимо от финансовых целей”: обязательства, связанные с финансами, тоже исчезли.

Это означает, что OpenAI больше не подчеркивает свою ответственность за безопасность человечества и не заявляет о своей независимости от капитала. Она становится обычным технологическим гигантом, стремящимся к максимизации прибыли.

Кроме того, за два года OpenAI расформировала три ключевых отдела по безопасности, включая известную команду по обеспечению безопасности. Даже такой выдающийся специалист, как Илья Сутскевер, ушел, чтобы основать собственную компанию, занимающуюся вопросами безопасности.

Значение этого: обе компании, которые раньше больше всего подчеркивали безопасность, одновременно переосмысливают ее понятие. Это не просто моральный упадок одной компании, а коллективный отказ от принципов безопасности под давлением капитала и конкуренции. Когда “безопасность” перестает быть непреложным принципом и становится предметом переговоров, возникает опасность.

Третий шаг: парадокс без выхода: ради большей безопасности нужно двигаться быстрее?

В интервью Коксон сказал несколько очень болезненных для индустрии вещей:

1. “Если вы находитесь в условиях конкуренции, вам приходится искать короткие пути или пропускать некоторые этапы проверок.”

2. “Чрезмерная параноя по отношению к OpenAI и Китаю иногда используется как оправдание для ускорения разработок.”

Это приводит к парадоксу без выхода:

  • Логика А: Если Anthropic замедлит процесс разработки для обеспечения безопасности, OpenAI или китайские конкуренты могут первыми создать сверхинтеллект.
  • Логика Б: Если конкуренты создадут сверхинтеллект раньше, но их меры безопасности будут хуже, глобальные риски увеличатся.
  • Вывод: Чтобы быть “более безопасными” (избежать создания сверхинтеллекта ненадежными игроками), Anthropic должна действовать быстрее.
  • Последствия: Но “быстрее” означает сокращение времени на тренировку, проверку и выпуск моделей, что уменьшает время, доступное для понимания их работы и выявления потенциальных рисков.

Проще говоря: “Чтобы быть безопаснее, нужно двигаться быстрее. Но чем быстрее мы движемся, тем меньше у нас шансов на безопасность.”

Коксон уволился не потому, что ненавидел Anthropic, а потому что понял: в таких условиях ни одна компания не может сохранить безопасность в одиночку. Это системный тупик. Смена компании не поможет, ведь вся индустрия движется вперед, и никто не осмеливается использовать меры безопасности, потому что те, кто это делает, могут быть исключены из конкуренции или обойдены соперниками.

Четвертый шаг: три дня до отзыва модели: безопасность — это реагирование на уже произошедшие проблемы, а не их предотвращение

В статье упоминается ключевой инцидент: событие с моделью Fable 5 в июне 2026 года.

Anthropic выпустила новую модель Fable 5. Через два дня генеральный директор Amazon позвонил Белому дому и сообщил о ее уязвимостях, позволяющих обойти меры безопасности. Белый дом срочно созвал совещание, и Министерство торговли ввело запрет на ее экспорт. Модель Fable 5 была отозвана по всему миру.

С момента выпуска до отзыва прошло всего три дня.

Здесь важный факт: модель была остановлена не из-за внутренних правил безопасности, а из-за вмешательства правительства после того, как риски уже возникли.

Это показывает, что обязательства по безопасности в реальности не выполняют своей функции до возникновения проблем. Они больше похожи на инструменты для последующего реагирования или соблюдения правил после факта. Когда риски становятся слишком великими, вмешивается внешняя сила (правительство).

Пятый шаг: кошмар для инвесторов: сколько стоят обязательства по безопасности?

Наконец, давайте обратим внимание на рынок капитала.

Оценка компании Anthropic составляет 2 триллиона долларов, и ее брендовый слоган звучит так: “Мы — самая безопасная компания в области ИИ”. Инвесторы покупают не только возможности моделей, но и обязательства по обеспечению безопасности.

Но если эти обязательства могут быть изменены под давлением конкуренции, их стоимость в инвестиционных решениях должна быть снижена.

  • В отчете Morningstar говорится, что инцидент с Fable 5 превратил обязательства по безопасности в финансовый риск.
  • **Дэвид Сакс (американский технологический консультант) призывает отложить IPO Anthropic до выяснения ситуации.”

Что это означает для обычных людей?

1. Разрушение брендового преимущества: если “безопасность” — это лишь маркетинговый ход, а не реальное обязательство, оценка компании становится неоправданной.

2 Кризис с соблюдением правил: если регулирующие органы признают, что обязательства не соответствуют действиям компании, это приведет не только к кризису в отношениях с общественностью, но и к юридическим проблемам.

3 Голосование доверия: уход Коксона от компании — это акт недоверия. Он своими действиями показал рынку: я не верю, что эта система способна самостоятельно предотвращать ошибки.

Вывод:

Деньги, которые Коксон отказался от них, по сравнению с оценкой в 2 триллиона долларов, кажутся незначительными. Но его слова — это символ проблемы, которая затрагивает всю индустрию ИИ: мы думаем, что создаем более безопасное будущее, но на самом деле строим более дорогие, более неуправляемые системы, за которые в конечном итоге придется платить всему человечеству.

Когда “безопасность” превращается из непреложного принципа в предмет переговоров, мы теряем не только технические меры предосторожности, но и моральные ориентиры.

Для обычных людей это означ