Китайская компания Alibaba представила Qwen3.8-Max — новую флагманскую модель семейства Qwen. Разработчики называют её самой мощной системой компании и делают акцент на программировании, исследовательских задачах и автоматизации офисной работы.
Qwen3.8-Max насчитывает 2,4 трлн параметров, что в полтора раза больше, чем у другой популярной китайской нейросети DeepSeek-V4-Pro. ИИ-модель Alibaba построена на архитектуре «смесь экспертов» (Mixture-of-Experts, MoE). При обработке запроса модель активирует не вся нейросеть, а только часть специализированных блоков — 95 млрд из 2,4 трлн параметров. Такой подход должен снизить вычислительные затраты и сократить время ответа по сравнению с моделью, которая использует все параметры для обработки запроса.
Нейросеть поддерживает несколько типов данных: текст, изображения и видео. Размер контекстного окна достигает 1 млн токенов: за один запрос можно проанализировать базу данных, сотни страниц документов, длинные видео и другое.
Alibaba утверждает, что модель стала лучше справляться с написанием и отладкой кода, комплексной разработкой приложений, анализом данных, исследованиями и продолжительными многоэтапными заданиями. Основными направлениями развития Qwen3.8-Max компания называет программирование и Cowork — выполнение рабочих задач при минимальном участии человека.
После запуска система стала самой высокооценённой китайской текстовой моделью на платформе сравнительного тестирования Arena.AI. В рейтинге нейросетей для анализа изображений она заняла второе место в мире.
Qwen3.8-Max уже доступна через API Alibaba Cloud Model Studio и рабочую платформу QwenWork. На следующей неделе компания планирует опубликовать открытые веса модели, чтобы разработчики могли самостоятельно её дообучать и развёртывать.
Подписывайтесь на «Рамблер» в «Maксе»! Так мы останемся на связи даже в нестабильные времена.
Новый ChatGPT Work может работать за вас: что умеет и как настроить в России