
Компания Alibaba представила новую флагманскую нейросеть Qwen3.8-Max. Это масштабная MoE-модель (Mixture-of-Experts) с общим количеством параметров в 2,4 триллиона. Главная особенность релиза заключается в том, что разработчики впервые открывают доступ к весам для моделей линейки Max, что делает этот инструмент доступным не только через API, но и для локального развертывания на мощных кластерах.
Технические характеристики и возможности архитектуры
Архитектура Qwen3.8-Max построена по принципу смеси экспертов. Несмотря на колоссальный объем параметров, при каждом конкретном запросе в работе участвует лишь около 95 миллиардов активных параметров, что оптимизирует вычислительные процессы. Модель сохранила преемственность с предыдущей версией Qwen3.5, но значительно расширила свои возможности.
Мультимодальность и контекстное окно
Одной из ключевых функций стала поддержка огромного контекстного окна. Модель способна обрабатывать до 1 миллиона токенов. При этом технические лимиты выглядят следующим образом:
- Максимальный объем ввода: до 991 тысячи токенов;
- Максимальный объем ответа: до 131 тысячи токенов (включая режим размышлений);
- Поддержка различных типов данных: текст, изображения и видео.
- Программирование: В течение 16 дней нейросеть самостоятельно разрабатывала консольную утилиту, генерируя код, создавая задачи на GitHub, проводя тесты и исправляя ошибки.
- Научные исследования: Модель смогла воспроизвести результаты научного исследования, потратив на это 125 часов вычислений. Она написала 7600 строк кода и успешно прошла математические тесты, превзойдя показатели существующих методов.
- Проектирование микросхем: Qwen3.8-Max оптимизировала криптографический блок, сократив количество логических вентилей с 8298 до 678, что позволило значительно уменьшить физическую площадь кристалла.
- Бизнес-симуляции: Модель успешно управляла виртуальными магазинами на маркетплейсах, справляясь с закупками, переговорами и логистическими трудностями, показав доходность на 38% выше конкурентов.
Зрение в модели интегрировано непосредственно в цикл планирования, что позволяет ей эффективно анализировать документы объемом более 200 страниц и видеоматериалы длительностью свыше 100 часов. Также пользователям доступен параметр reasoning_effort, позволяющий выбирать между скоростью работы и глубиной проработки задачи.
Автономность и практическое применение
В рамках презентации Alibaba продемонстрировала способность модели решать сложные многоэтапные задачи без участия человека. Разработчики выделили несколько сценариев успешного исполнения:
Стоимость и доступность
На текущий момент Qwen3.8-Max доступна через сервисы QwenCloud и Qwen Studio. Стоимость использования составляет $2 за миллион входных токенов и $6 за миллион выходных. Примечательно, что флагманская модель оказалась на 20% дешевле своей предшественницы Qwen3.7-Max. Для разработчиков, предпочитающих использование через API, предусмотрена система кеширования, снижающая стоимость чтения данных в 8 раз.
Ожидается, что на следующей неделе на платформах Hugging Face и ModelScope будут опубликованы открытые веса не только для компактной модели Qwen3.8-27B, но и для флагмана Qwen3.8-Max. Это позволит независимым исследователям проверить эффективность модели в реальных условиях.
Заключение
Выпуск Qwen3.8-Max демонстрирует стремление Alibaba создать универсального ИИ-агента, способного к автономному планированию и сложным расчетам. Несмотря на то, что в некоторых инженерных тестах модель уступает GPT-5.6 Sol, её мультимодальные способности и возможности автоматизации делают её серьезным игроком на рынке больших языковых моделей.
