Компания Anthropic, специализирующаяся на разработке искусственного интеллекта, готовится вернуть общественный доступ к своим самым передовым моделям — Claude Fable 5 и Mythos 5. Напомним, что ещё в середине июня эти модели были временно отключены по требованию американских властей.
Спустя несколько недель после введения экспортных ограничений, вызванных инцидентом, в котором исследователи сумели обойти защиту Fable 5, правительство США всё же приняло решение о снятии запрета. Об этом официально заявил сам разработчик — Anthropic. Так, уже в среду ограничения были отменены.
«После конструктивного диалога с госструктурами мы возвращаем модель с обновлёнными классификаторами безопасности, которые позволят эффективнее блокировать потенциально опасные киберзадачи», — сообщили в компании.
Введение запрета на доступ к моделям вызвало бурные обсуждения в экспертной среде. Многие специалисты заговорили о том, что государство пытается установить тотальный контроль над передовыми ИИ-технологиями, что может создать опасный прецедент. Экспортные ограничения также продемонстрировали обеспокоенность Белого дома возможными рисками: если такие мощные модели будут взломаны и использованы в преступных целях, это может обернуться серьёзной угрозой для национальной кибербезопасности.
Приоритет — максимально быстрое и безопасное внедрение технологий
В среду на платформе X глава Министерства торговли США Говард Лутник заявил: «За последние две недели мы тесно взаимодействовали с Anthropic, чтобы провести анализ и одобрить Fable 5. Это необходимо для согласованности действий всех госструктур и укрепления лидерства Америки в сфере искусственного интеллекта».
В свою очередь, главный администратор Белого дома Сьюзи Уайлз подчеркнула, что приоритет государства — «как можно быстрее и безопаснее внедрять лучшие ИИ-технологии».
Ограничения были введены после того, как власти США получили данные о том, как исследователи из Amazon сумели обойти защиту Fable 5, заставив модель выявить несколько уязвимостей в программном обеспечении. Однако в своём официальном блоге Anthropic подчеркнула, что подобные риски не уникальны для Fable 5: аналогичные уязвимости могут быть обнаружены и менее мощными моделями.
Разработка новых стандартов противодействия ИИ-взломам
Компания также начала работу над единой системой классификации взломов ИИ-моделей в рамках проекта Glasswing — инициативы, запущенной в апреле при участии Amazon, Microsoft, Google и других партнёров. Цель проекта — создание механизмов защиты от киберугроз, связанных с искусственным интеллектом.

Схема взаимодействия классификаторов безопасности Anthropic с потенциальными взломами. Источник: Anthropic
Кроме того, Anthropic расширяет сотрудничество с правительством США в области тестирования и защиты ИИ-моделей. «Это будет включать предварительный доступ к новым моделям, механизмы оценки безопасности, обмен информацией о случаях взломов и неправомерного использования, а также выделение ресурсов для совместных исследований», — уточнили в компании.
Известный исследователь в области ИИ утверждает, что ему удалось взломать Fable 5 в течение 48 часов после её запуска в июне — ещё до введения правительственных ограничений. Он опубликовал скриншоты, демонстрирующие, как ему удалось обойти защитные механизмы модели.
Американские власти сняли экспортные ограничения на передовые ИИ-модели Anthropic — Fable 5 и Mythos 5. Ограничения были введены после инцидента с обходом защиты модели, но теперь доступ к ним восстановлен с обновлёнными системами безопасности. Эксперты обсуждают риски государственного контроля над ИИ-технологиями.
Возвращение доступа к мощным ИИ-моделям может стимулировать инновации и развитие экосистемы, но также усиливает внимание к вопросам кибербезопасности. Для инвесторов это сигнал о том, что регуляторные барьеры могут быть временными, но требуют адаптации к новым стандартам безопасности.
Государственное вмешательство в развитие ИИ неизбежно, но важно найти баланс между безопасностью и прогрессом. Чрезмерные ограничения тормозят инновации, а их ослабление без должного контроля создаёт новые риски.





