OpenAI выпустила ограниченное превью GPT‑5.6: новые модели, цены и меры кибербезопасности
OpenAI объявила о стартовом ограниченном превью серии моделей GPT‑5.6, включающей три варианта: Sol – флагманскую, Terra – сбалансированную и Luna – быструю и дешёвую. Доступ на данный момент имеют лишь проверенные партнёры, список которых согласован с правительством США. Компания открыто заявила, что такой подход является лишь временной мерой.
Новая система именования: поколение и класс раздельно
В линейке GPT‑5.6 число «5.6» указывает на поколение, а названия Sol, Terra и Luna определяют класс модели по соотношению «интеллект / скорость / цена». Каждый класс может развиваться независимо, получая собственные улучшения.
| Модель | Класс | Стоимость за 1 млн токенов (вход / выход) |
|---|---|---|
| Sol | Флагман, максимум интеллекта | $5 / $30 |
| Terra | Баланс для повседневных задач | $2,5 / $15 |
| Luna | Скорость и минимальная цена | $1 / $6 |
По словам OpenAI, Terra сопоставима с GPT‑5.5 прошлым годом, но в два раза дешевле, а Luna предлагает базовую функциональность при самой низкой цене.
Также была улучшена система кеширования запросов: теперь есть чётко обозначенные точки кеша, а время жизни кеша ограничено 30 минутами. Запись в кеш стоит 1,25 × обычной цены входа, а чтение – со скидкой 90 %.
Почему доступ ограничен
В отличие от обычных запусков, когда модель сразу появляется в ChatGPT и через API, GPT‑5.6 пока доступна только через API и среду разработки Codex для узкого круга партнёров, согласованного с американскими властями. OpenAI заранее продемонстрировала возможности моделей правительству и начала ограниченный релиз по требованию администрации.
Компания подчёркивает, что такой «государственный фильтр» не является желаемой практикой. По её мнению, он задерживает доступ лучших инструментов для разработчиков и специалистов по кибербезопасности. Фильтрация рассматривается как вынужденное и временное решение, пока разрабатывается кибер‑указ и процедуры для будущих выпусков.
Кибербезопасность: повышение уровня без критического перехода
Самой мощной моделью в линейке считается Sol, ориентированная на задачи безопасности – выявление уязвимостей и подготовку эксплойтов. В тестах ExploitBench она показывает результаты, сопоставимые с конкурентом Mythos Preview, но использует в три раза меньше токенов.
Тем не менее, Sol не достигает порога «Cyber Critical» в рамках внутренней методологии оценки рисков OpenAI. При тестировании на движках Chromium и Firefox модель находила уязвимости, но не смогла собрать полностью рабочую цепочку атаки. Это делает её более ценным инструментом для защитников, чем для злоумышленников.
Семь уровней защиты и 700 000 GPU‑часов на «самопроверку»
Для обеспечения безопасного использования в модели встроено несколько слоёв защиты:
- Встроенный отказ – модель обучена отказываться от выполнения запрещённых запросов, даже если намерения скрыты.
- Классификаторы в реальном времени – обнаруживают кибер‑ и биоугрозы непосредственно во время генерации.
- Проверка на уровне аккаунта – учитывается поведение пользователя в целом, а не отдельные диалоги.
- Дифференцированный доступ и мониторинг – самые чувствительные функции доступны только ограниченному кругу пользователей.
Если классификатор обнаруживает подозрительный вывод, генерация ставится на паузу, и более крупная модель переоценивает запрос.
Для поиска скрытых уязвимостей OpenAI потратила более 700 000 GPU‑часов (примерно A100) на автоматический «red‑timing», а также привлекла независимых экспертов. Цель – выявить универсальные методы обхода, работающие в разных контекстах.
Компания предупреждает, что в превью могут возникать ложные срабатывания, например, при обычном ревью кода или анализе уязвимостей, и просит пользователей отправлять обратную связь.
Новые режимы: max и ultra
Впервые в GPT‑5.6 появились два режима:
- max – даёт Sol больше времени для «размышления», увеличивая глубину анализа.
- ultra – подключает субагентов, позволяя распараллелить сложные задачи и выйти за пределы возможностей одного агента.
Бенчмарки показывают рост производительности в трёх областях: программирование (новый рекорд Terminal‑Bench 2.1), биология (лучший результат на GeneBench v1 при меньшем расходе токенов) и кибербезопасность.
В июле планируется запуск Sol на чипах Cerebras с ускорением до 750 токенов в секунду, но только для избранных клиентов.
Проверочная точка: ближайшие недели
OpenAI обещает открыть общий доступ к Sol, Terra и Luna в ближайшее время. Это станет ключевым индикатором того, насколько процесс согласования с правительством будет влиять на скорость выпуска новых моделей. Если задержка сохранится, может возникнуть вопрос, станет ли государственный фильтр постоянной практикой для всех «пограничных» ИИ‑технологий.