IT'S NEW IT'S NEW

Поиск

Anthropic возвращает доступ к моделям Fable 5 и Mythos 5

Anthropic возвращает доступ к моделям Fable 5 и Mythos 5
3 минуты

Компания Anthropic объявила о снятии экспортных ограничений на свои новейшие нейросети Fable 5 и Mythos 5. После кратковременного запрета, введенного властями США в июне, доступ к модели Fable 5 будет полностью восстановлен для всех пользователей уже с 1 июля. Это решение касается таких платформ, как Claude.ai, Claude Platform, Claude Code и Claude Cowork.

Причины временного запрета и работа исследователей

Ограничения вступили в силу 12 июня и затронули всех пользователей, включая иностранных сотрудников самой компании Anthropic. Регуляторы ввели экспортный контроль, чтобы предотвратить возможные риски безопасности. Поскольку на тот момент у компании не было системы мгновенной проверки гражданства, доступ к обоим новым моделям пришлось полностью отключить.

Основным поводом для вмешательства стал отчет исследователей из Amazon. В ходе тестирования они обнаружили способ обхода защитных механизмов Fable 5. Исследователям удалось заставить модель выявлять уязвимости в программном обеспечении, а в одном из случаев — генерировать код для их эксплуатации. Данный инцидент стал триггером для немедленного реагирования государственных органов.

Анализ безопасности и новые методы защиты

В ходе разбирательства, в котором участвовали Anthropic, правительство США и Amazon, выяснилось, что обнаруженные уязвимости не являются уникальными для новых моделей. Аналогичные проблемы были выявлены и в менее мощных системах, таких как Claude Opus 4.8, GPT-5.5 и Kimi K2.7. Более того, методику обхода защиты удалось применить даже к моделям Haiku 4.5 и Sonnet 4.6.

Усовершенствование систем фильтрации

Для устранения выявленной проблемы Anthropic внедрила обновленный классификатор безопасности. Это вспомогательная система, которая распознает опасные запросы в режиме реального времени. Теперь новая методика обхода блокируется в более чем 99% случаев. При этом, если запрос к модели Fable 5 классифицируется как подозрительный, он автоматически перенаправляется на модель Opus 4.8 для обработки.

Однако у усиления защиты есть своя цена: рост числа ложных срабатываний. Система стала чаще блокировать безобидные запросы, связанные с программированием и отладкой кода. Разработчики признают необходимость работы над уменьшением таких ошибок в будущем.

Новые стандарты индустрии и доступ к сервисам

Инцидент с Fable 5 послужил катализатором для создания общих отраслевых стандартов. Anthropic совместно с Amazon, Microsoft, Google и другими участниками программы Glasswing приступила к разработке единого метода оценки «джейлбрейков» — способов взлома ИИ. Оценка будет базироваться на четырех параметрах:

  • степень усиления атакующего инструментария;
  • универсальность метода для различных задач;
  • сложность преобразования метода в реальную атаку;
  • доступность методики взлома.

Кроме того, компания расширяет сотрудничество с государством: планируется предоставление регуляторам раннего доступа к новым моделям и совместное исследование угроз в рамках президентского указа о безопасности ИИ.

Условия использования моделей

С 1 июля Fable 5 возвращается в общий доступ на следующих условиях:

  • Для подписчиков тарифов Pro, Max, Team и некоторых Enterprise-планов модель будет включена в подписку с лимитом до 50% от недельного объема использования;
  • После исчерпания лимита доступ будет осуществляться через систему кредитов.

Модель Mythos 5, предназначенная для задач оборонительной кибербезопасности, пока остается доступной только для узкого круга американских организаций в рамках программы Project Glasswing. Возврат доступа к моделям на платформах AWS, Google Cloud и Microsoft Foundry будет осуществляться поэтапно.

Вывод: Инцидент с временным запретом моделей Anthropic продемонстрировал как уязвимости современных ИИ-систем, так и важность взаимодействия технологических компаний с государственными регуляторами для создания единых стандартов безопасности.

07:08
58
Поделиться:
Нет комментариев. Ваш будет первым!