Поиск

OpenAI удвоила награду за джейлбрейк GPT-5.5 до $50 000 и сделала программу биобезопасности постоянной

OpenAI удвоила награду за джейлбрейк GPT-5.5 до $50 000 и сделала программу биобезопасности постоянной

Компания OpenAI анонсировала масштабное обновление своей программы по поиску уязвимостей в области биобезопасности. Изначально запущенная как временный тест для модели GPT-5.5, инициатива превращается в постоянную закрытую программу OpenAI Bio Bounty Program. Главное изменение — максимальная награда за обнаружение универсального джейлбрейка выросла в два раза и составила 50 000 долларов. Заявление опубликовано 9 июля, в тот же день, когда новая модель GPT-5.6 стала доступна широкой публике.

Суть программы: поиск «универсального ключа» к запрещенным знаниям

Цель охотников за багами осталась прежней: найти единственный промпт, который надежно заставит модель ответить на пять вопросов, связанных с созданием биологического оружия. Важный нюанс — речь идет именно об универсальном джейлбрейке. Это означает, что атака должна срабатывать стабильно при каждом новом запуске чата, без дополнительных подсказок или манипуляций с контекстом. Разовые сбои, которые устраняются точечными патчами, не считаются полноценной победой и оплачиваются по сниженным тарифам по усмотрению компании.

Формат испытаний жестко регламентирован: участник работает в «чистом» чате, без истории предыдущих сообщений и без доступа к системным настройкам. Одна удачная попытка на пять вопросов — это критерий получения главной награды.

Почему ставки выросли именно сейчас

Удвоение выплаты не случано. Оно происходит на фоне признания самой OpenAI в том, что защита предыдущей модели GPT-5.5 была пробита еще на стадии предрелизного тестирования. В системной карточке модели зафиксировано: опытные редтимеры (специалисты по имитации атак) добивались выдачи биологически опасной информации. Хотя классификатор безопасности фиксировал попытки, а финальный стек защиты блокировал самые критичные случаи, сам факт получения небезопасных ответов моделью документален.

Дополнительный тревожный сигнал пришел извне. Британский институт безопасности ИИ (AI Security Institute) за шесть часов собрал универсальный джейлбрейк, пробивающий защиту от запрещенных киберзапросов, включая сложные многошаговые агентные сценарии. OpenAI успела обновить защиту, но британцы из-за технических проблем не смогли верифицировать финальную версию патча. Этот прецедент показывает: внешние аудиторы находят рабочие обходы быстрее, чем разработчики подтверждают их полное устранение.

Закрытый клуб: как попасть в программу

Участие в Bio Bounty Program доступно не всем желающим. Отбор кандидатов осуществляет сама OpenAI на основе анкеты, где нужно указать имя, место работы и релевантный опыт. Требования к участникам:

  • Наличие действующего аккаунта ChatGPT.
  • Подписание соглашения о неразглашении (NDA).
  • Работа через выделенную платформу для баг-баунти.

NDA накладывает строгие ограничения: под запрет на публикацию попадают не только найденные уязвимости, но и сами промпты, ответы модели и вся переписка с командой безопасности OpenAI. Компания не обещает публиковать сводную статистику — сколько заявок получено, сколько джейлбрейков подтверждено, как менялась защита после каждого инцидента. Для участников прошлого теста GPT-5.5 повторная подача заявки не требуется — доступ сохраняется автоматически.

Хронология: от закрытого теста к публичному релизу GPT-5.6

Дата анонса 9 июля согласована с важным этапом жизненного цикла моделей. Ровно три недели GPT-5.6 находилась в закрытом доступе у примерно двух десятков партнерских организаций. Такая осторожность требовала американское правительство: из-за усиленных возможностей модели в области кибербезопасности был предписан обязательный аудит. Публичный релиз GPT-5.6 и включение её в периметр новой баг-баунти программы произошли синхронно.

Тестирование старой модели GPT-5.5 в рамках программы продлится до 27 июля. После этой даты она выйдет из зоны ответственности баг-баунти, и вся нагрузка по поиску уязвимостей переключится исключительно на GPT-5.6. Совпадают ли наборы тестовых вопросов для двух моделей, OpenAI не уточняет.

Чем это грозит бизнесу и разработчикам

Для компаний, интегрирующих GPT в научные исследовательские конвейеры, биотех-стартапы или образовательные платформы, новость имеет двоякий смысл. С одной стороны, рост награды демонстрирует серьезность намерений OpenAI платить за безопасность. С другой — это реактивная мера: платить больше пришлось потому, что дыры уже находили. Прозрачность процесса минимальна: закрытый NDA не позволяет независимым экспертам оценить реальную устойчивость текущей защиты. Единственная ориентировочная точка — 27 июля, когда завершится переходный период и станет понятно, удерживает ли GPT-5.6 линию обороны лучше предшественника.

Резюмируя: OpenAI легализовала охоту на биоджейлбрейки как постоянный процесс, подняла ставки до рекордных для индустрии $50 000, но сохранила полную непрозрачность результатов. Рынок получит объективную картину устойчивости новых моделей только после 27 июля, когда скроется за NDA тестирование GPT-5.5.
08:07
231
Нет комментариев. Ваш будет первым!