IT'S NEW IT'S NEW

Поиск

OpenAI выпустила ограниченное превью GPT‑5.6: новые модели, цены и меры кибербезопасности

OpenAI выпустила ограниченное превью GPT‑5.6: новые модели, цены и меры кибербезопасности
3 минуты

OpenAI объявила о стартовом ограниченном превью серии моделей GPT‑5.6, включающей три варианта: Sol – флагманскую, Terra – сбалансированную и Luna – быструю и дешёвую. Доступ на данный момент имеют лишь проверенные партнёры, список которых согласован с правительством США. Компания открыто заявила, что такой подход является лишь временной мерой.

Новая система именования: поколение и класс раздельно

В линейке GPT‑5.6 число «5.6» указывает на поколение, а названия Sol, Terra и Luna определяют класс модели по соотношению «интеллект / скорость / цена». Каждый класс может развиваться независимо, получая собственные улучшения.

МодельКлассСтоимость за 1 млн токенов (вход / выход)
SolФлагман, максимум интеллекта$5 / $30
TerraБаланс для повседневных задач$2,5 / $15
LunaСкорость и минимальная цена$1 / $6

По словам OpenAI, Terra сопоставима с GPT‑5.5 прошлым годом, но в два раза дешевле, а Luna предлагает базовую функциональность при самой низкой цене.

Также была улучшена система кеширования запросов: теперь есть чётко обозначенные точки кеша, а время жизни кеша ограничено 30 минутами. Запись в кеш стоит 1,25 × обычной цены входа, а чтение – со скидкой 90 %.

Почему доступ ограничен

В отличие от обычных запусков, когда модель сразу появляется в ChatGPT и через API, GPT‑5.6 пока доступна только через API и среду разработки Codex для узкого круга партнёров, согласованного с американскими властями. OpenAI заранее продемонстрировала возможности моделей правительству и начала ограниченный релиз по требованию администрации.

Компания подчёркивает, что такой «государственный фильтр» не является желаемой практикой. По её мнению, он задерживает доступ лучших инструментов для разработчиков и специалистов по кибербезопасности. Фильтрация рассматривается как вынужденное и временное решение, пока разрабатывается кибер‑указ и процедуры для будущих выпусков.

Кибербезопасность: повышение уровня без критического перехода

Самой мощной моделью в линейке считается Sol, ориентированная на задачи безопасности – выявление уязвимостей и подготовку эксплойтов. В тестах ExploitBench она показывает результаты, сопоставимые с конкурентом Mythos Preview, но использует в три раза меньше токенов.

Тем не менее, Sol не достигает порога «Cyber Critical» в рамках внутренней методологии оценки рисков OpenAI. При тестировании на движках Chromium и Firefox модель находила уязвимости, но не смогла собрать полностью рабочую цепочку атаки. Это делает её более ценным инструментом для защитников, чем для злоумышленников.

Семь уровней защиты и 700 000 GPU‑часов на «самопроверку»

Для обеспечения безопасного использования в модели встроено несколько слоёв защиты:

  • Встроенный отказ – модель обучена отказываться от выполнения запрещённых запросов, даже если намерения скрыты.
  • Классификаторы в реальном времени – обнаруживают кибер‑ и биоугрозы непосредственно во время генерации.
  • Проверка на уровне аккаунта – учитывается поведение пользователя в целом, а не отдельные диалоги.
  • Дифференцированный доступ и мониторинг – самые чувствительные функции доступны только ограниченному кругу пользователей.

Если классификатор обнаруживает подозрительный вывод, генерация ставится на паузу, и более крупная модель переоценивает запрос.

Для поиска скрытых уязвимостей OpenAI потратила более 700 000 GPU‑часов (примерно A100) на автоматический «red‑timing», а также привлекла независимых экспертов. Цель – выявить универсальные методы обхода, работающие в разных контекстах.

Компания предупреждает, что в превью могут возникать ложные срабатывания, например, при обычном ревью кода или анализе уязвимостей, и просит пользователей отправлять обратную связь.

Новые режимы: max и ultra

Впервые в GPT‑5.6 появились два режима:

  • max – даёт Sol больше времени для «размышления», увеличивая глубину анализа.
  • ultra – подключает субагентов, позволяя распараллелить сложные задачи и выйти за пределы возможностей одного агента.

Бенчмарки показывают рост производительности в трёх областях: программирование (новый рекорд Terminal‑Bench 2.1), биология (лучший результат на GeneBench v1 при меньшем расходе токенов) и кибербезопасность.

В июле планируется запуск Sol на чипах Cerebras с ускорением до 750 токенов в секунду, но только для избранных клиентов.

Проверочная точка: ближайшие недели

OpenAI обещает открыть общий доступ к Sol, Terra и Luna в ближайшее время. Это станет ключевым индикатором того, насколько процесс согласования с правительством будет влиять на скорость выпуска новых моделей. Если задержка сохранится, может возникнуть вопрос, станет ли государственный фильтр постоянной практикой для всех «пограничных» ИИ‑технологий.

07:08
452
Поделиться:
Нет комментариев. Ваш будет первым!