Perplexity представила новую оркестрационную модель на базе китайской GLM 5.2
Perplexity представила новую оркестрационную модель для агентной платформы
Kомпания Perplexity объявила о запуске исследовательского превью новой оркестрационной модели для своей агентной платформы Perplexity Computer. Это дообученная версия открытой китайской модели GLM 5.2 от Z.ai, которая стала основой для снижения стоимости обслуживания сложных запросов.
Агентная платформа Perplexity уже успешно интегрирует более 19 различных моделей и берёт на себя выполнение многосложных многошаговых задач: исследований, работы с документами, кода и аналитики. Новая модель встраивается в эту систему как экономичное решение по умолчанию, берущее на себя основную массу запросов, а дорогие фронтир-модели использующие только при необходимости.
Advisor tool: умный механизм эскалации
Дообучение GLM 5.2 — это не создание модели с нуля, а донастройка уже готовой архитектуры на узком наборе данных под конкретную задачу. Переключить внимание Perplexity было на один ключевой навык: распознавание момента, когда задача выходит за пределы возможностей модели, и автоматическая передача её более мощной системе.
Встроенный advisor tool действует как механизм эскалации. Основная масса запросов обрабатывается самой моделью, а к Claude Opus 4.8 она обращается только тогда, когда задача требует более глубокого рассуждения. По словам CEO Perplexity Аравинда Шриниваса, такая связка обеспечивает качество, сопоставимое с фронтир-моделью, но при значительно меньших затратах.
Экономический эффект по внутренним тестам
Компания провела сравнение трёх сценариев по собственной метрике эффективности — измеряющей стоимость решения сложных задач. Базовая версия GLM 5.2 без эскалации остаётся самым дешёвым вариантом, однако при этом даёт наименьшее качество. Та же модель с встроенным advisor tool стоит вдвое дороже базовой версии, но выдаёт качество, сопоставимое с фронтир-моделью.
Полное прогон всех задач через один Opus 4.8 обходится примерно в шесть раз дороже базовой GLM 5.2. В сумме новая связка даёт результат на уровне Opus примерно за треть его цены — отсюда коэффициент 0,344×, указанный в анонсе Perplexity. Полные бенчмарки и исследовательскую статью компания обещает опубликовать в ближайшие недели.
Китайская модель с американским полигоном
GLM 5.2 — масштабная языковая модель с 744 миллиардами параметров, разработанная лабораторией Z.ai (бывшей Zhipu AI). Китайская лаборатория с января 2025 года включена в список Entity List Минторга США, однако это не помешало Perplexity использовать её разработку.
Модель вышла в июне под лицензией MIT, что снимает вопросы доступа — веса можно скачать, изменить и дообучить без ограничений. Это уже второй похожий проект Perplexity за полтора года. В начале 2025 года компания выпустила R1-1776 — версию DeepSeek R1, из которой убрали около 300 тем, подпадавших под цензуру китайских властей. Тогда цель была политической: сделать рассуждающую модель пригодной для использования на Западе. Сейчас мотивация экономическая — снизить стоимость обслуживания массового агентного продукта, не потеряв в качестве.
Дообученная GLM 5.2 работает на серверах Perplexity в США на видеокартах Nvidia B200.
Планы на будущее: Nemotron 3 Ultra
Перplexity не планирует останавливаться на одной модели. Следующим шагом компания намерена применить тот же приём дообучения к Nemotron 3 Ultra — открытой модели американского происхождения. Так снимается вопрос, который может возникнуть у части корпоративных клиентов: готовность строить инфраструктуру на китайских весах, пусть и открытых.
Важно отметить, что пока это исследовательское превью, доступное пользователям Computer уже сейчас, а не обещание на будущее. Однако судить об экономике рано: цифры о цене и качестве представлены как внутренние метрики самой Perplexity. Ориентиром считается публикация полного бенчмарка и исследовательской статьи в ближайшие недели, чтобы увидеть, держит ли связка GLM 5.2 и advisor заявленную треть цены Opus на практике, а не на графике в презентации.