Alibaba представила Qwen3.8-Max — мультимодальную модель с 2,4 трлн параметров, превосходящую GPT-5.6 Sol Max в задачах агентного использования ПК

Китайский технологический гигант Alibaba представил Qwen3.8-Max — новую флагманскую мультимодальную крупную языковую модель с архитектурой mixture-of-experts и 2,4 триллионами параметров. Основная цель модели — автоматизация сложных корпоративных процессов и автономная разработка программного обеспечения с длительным горизонтом выполнения.
По опубликованным компанией результатам внутренних тестов, Qwen3.8-Max превосходит несколько ведущих моделей, включая GPT-5.6 Sol Max и Fable 5, в ряде ключевых бенчмарков, связанных с агентным использованием компьютера. Так, на тесте OSWorld-Verified, оценивающем способность ИИ-агентов работать с операционной системой и приложениями, модель набрала 86,1 балла, опередив GPT-5.6 Sol Max (83,2) и Fable 5 (85,0).
Кроме того, Qwen3.8-Max продемонстрировала лучший результат на PaperBench — бенчмарке OpenAI, проверяющем умение моделей воспроизводить научные статьи на основе экспериментальных данных. Модель также показала высокие результаты в задачах программной инженерии, воспроизведения исследований, мультимодального рассуждения и веб-разработки с визуальными элементами.
Важной новацией стало объявление о скором открытии весов Qwen3.8-Max и Qwen3.8-27B, что может означать первый случай, когда модель класса Max станет доступна для самостоятельного развёртывания при условии использования разрешительной лицензии. Однако детали лицензирования пока не раскрыты, и нельзя исключать более ограничительные условия, аналогичные недавно выпущенной китайской модели Moonshot Kimi K3.
В отличие от моделей, ориентированных на диалог или краткие задачи, Qwen3.8-Max позиционируется как автономный сотрудник, способный выполнять проекты длительностью свыше 10 дней, включая сложное программирование, повторное воспроизведение научных работ с тысячами строк кода и итеративную оптимизацию чип-дизайна с использованием мультимодальной обратной связи.
Новая модель демонстрирует широкий и сбалансированный профиль производительности, что особенно важно для корпоративных пользователей, которым требуется надёжное выполнение разнообразных рабочих процессов — от написания кода и анализа документов до управления интерфейсами и визуальной инспекции.
Стоимость использования Qwen3.8-Max через API QwenCloud составляет $2 за миллион входных и $6 за миллион выходных токенов, что значительно дешевле конкурентов из США, включая Claude Opus 5 и GPT-5.6 Sol Max. Это ценно для агентных систем, которые потребляют большое количество токенов в ходе длительных автономных задач.
Тем не менее, Qwen3.8-Max не претендует на полную замену американских лидеров рынка. Модель предлагает альтернативный набор преимуществ, ориентированных на специфические корпоративные сценарии и автономные рабочие процессы.
По данным Venture Beat.
