США приказали Anthropic отключить мощные ИИ-модели из соображений национальной безопасности
Правительство США в пятницу потребовало от компании Anthropic немедленно отключить доступ к двум своим мощнейшим моделям искусственного интеллекта — Claude Fable 5 и Claude Mythos 5. Причиной были названы соображения национальной безопасности. Anthropic, как сообщила компания в социальной сети X, выполнила предписание, но выразила свое несогласие с решением властей.
Подробности распоряжения
Директива, полученная Anthropic в пятницу в 17:21 по восточному времени США, обязывает компанию отключить обе модели для всех пользователей по всему миру, а не только для иностранных граждан, на которых было номинально направлено распоряжение правительства об экспортном контроле. Доступ к другим моделям Anthropic не был затронут.
Значение модели Mythos 5
Mythos 5 является самой передовой моделью ИИ от Anthropic. Компания представила ее предварительную версию в начале апреля и с тех пор жестко ограничивала доступ, объясняя это ее исключительной способностью находить уязвимости в программном обеспечении. По данным Anthropic, Mythos 5 выявила недостатки во всех основных операционных системах и веб-браузерах, которые были протестированы. Вместо того чтобы выпустить модель в широкий доступ, компания запустила контролируемую программу под названием Project Glasswing. В рамках этой программы доступ к Mythos 5 был предоставлен примерно 50 проверенным организациям, включая Amazon, Apple, Google, Microsoft и CrowdStrike, для использования в оборонительных целях кибербезопасности.
Модель Fable 5 и ее предназначение
Fable 5, выпущенная всего три дня назад, стала ответом Anthropic на очевидное коммерческое давление. Эта версия Mythos была оснащена защитными механизмами, блокирующими ответы в областях высокого риска, таких как кибербезопасность и биология, что, по мнению компании, делало ее достаточно безопасной для общего выпуска. Согласно сравнительным тестам от Vals AI — компании, отслеживающей производительность ИИ-технологий, — Fable 5 сразу же стала самой мощной общедоступной моделью ИИ.
Разногласия о причинах блокировки
Директива правительства официально представлена как мера экспортного контроля, ограничивающая доступ к моделям для иностранных граждан. Однако в своем подробном сообщении в блоге Anthropic заявляет, что, по ее мнению, основная проблема заключается в предполагаемом "джейлбрейке" (обходе ограничений) Fable 5. На данный момент, как утверждает компания, правительство предоставило лишь устные доказательства "потенциального узкого, не универсального джейлбрейка". Anthropic описывает его как процесс, при котором модель просят прочитать определенный код и выявить программные уязвимости. Компания также добавляет, что подобный уровень возможностей уже широко доступен в других общедоступных моделях, включая GPT-5.5 от OpenAI, и рутинно используется специалистами по кибербезопасности в оборонительных целях.
Аргументы Anthropic в защиту безопасности
Основной аргумент Anthropic заключается в том, что ее самые сильные меры безопасности работают через независимые системы классификации, которые функционируют отдельно от самой модели. Это означает, что даже если кто-то убедит Fable продолжить разговор после отказа, базовые механизмы защиты от наиболее опасных результатов остаются на месте.
Несогласие компании и последствия для индустрии
Очевидно, что этих аргументов оказалось недостаточно, чтобы остановить действия правительства, и Anthropic не скрывает своего разочарования. "Мы не согласны с тем, что обнаружение узкого потенциального джейлбрейка должно быть причиной отзыва коммерческой модели, развернутой для сотен миллионов пользователей", — написала компания. "Если бы этот стандарт применялся во всей отрасли, мы считаем, это фактически остановило бы все новые развертывания моделей для всех ведущих поставщиков передовых ИИ."
Контекст IPO и ирония ситуации
Anthropic, как ожидается, в этом году проведет первичное публичное размещение акций (IPO) и в значительной степени построила свой публичный имидж как безопасная альтернатива конкурентам. Наблюдатели отмечают иронию в том, что именно та осторожность, которую Anthropic проявила, ограничивая Mythos 5 — модель, которую она продвигала как настолько опасную, что ее нельзя было выпускать публично, — теперь, по-видимому, привлекла именно тот вид правительственного внимания, который может нанести наибольший ущерб ее бизнесу. Сэм Альтман из OpenAI, должно быть, этому только рад. В апреле он заявил подкастеру Эшли Вэнсу, что подход Anthropic к Mythos 5 сродни "маркетингу, основанному на страхе". "Это, безусловно, невероятный маркетинг: сказать 'Мы создали бомбу. Мы собирались сбросить ее вам на голову. Мы продадим вам бомбоубежище за 100 миллионов долларов'", — сказал Альтман. Альтман, чья компания также, как ожидается, проведет IPO как можно скорее, не предсказывал правительственного отключения, но он указал на то, что сейчас обернулось против Anthropic: когда вы месяцами говорите миру, что ваш ИИ уникально опасен, мир — включая правительство США — склонен прислушиваться.
