Китайский ИИ целится в лидеров, а главная интрига — в условиях открытого релиза.
Представьте: китайская модель ИИ приходит и заявляет, что обходит GPT-5.6 Sol Max и Fable 5 в тестах на использование компьютера. Именно это сделала Qwen3.8-Max от Alibaba — флагманский монстр с 2,4 трлн параметров и архитектурой Mixture-of-Experts. Впрочем, главная интрига даже не в цифрах, а в том, что компания пообещала выложить веса в открытый доступ. Правда, с одним большим «но».
Новинка нацелена на автономную разработку ПО и долгие корпоративные многоэтапные задачи. Её позиционируют как «цифрового сотрудника», который может вести проект больше десяти дней. Но прежде чем радоваться, стоит разобраться, что именно Alibaba готова отдать сообществу и на каких условиях.
Что такое Qwen3.8-Max: позиционирование и ключевые характеристики
Цифровой трудоголик из Поднебесной
Ключевая фишка тут — не умение поддержать светскую беседу, а способность доводить дело до конца. Alibaba Qwen делает ставку на то, что модель будет самостоятельно планировать, выполнять и корректировать работу, используя мультимодальные циклы обратной связи. То есть она не просто смотрит на картинку или текст, а использует визуальную информацию для непрерывного улучшения своих действий. Эдакий вечный двигатель, который не спит, не ест и не просит повышения зарплаты.
При этом компания обещает опубликовать открытые веса Qwen3.8-Max и Qwen3.8-27B уже на следующей неделе. Это важный шаг: если всё получится, модель можно будет развернуть на собственных мощностях, не платя за каждый чих через API. Правда, дьявол, как обычно, кроется в деталях — какие именно условия лицензии выкатят китайцы, пока остаётся загадкой. Но сам факт такого обещания уже заставляет конкурентов нервно переглядываться.
Похоже, на фронте ИИ-гонки появляется ещё один серьёзный игрок, который вместо красивых демо и философских рассуждений о безопасности просто говорит: «Вот вам инструмент. Идите работайте». Посмотрим, что из этого выйдет на дистанции.
Результаты бенчмарков: лидерство в агентном использовании компьютера
Пока остальные конкуренты меряются интеллектом в чате, Alibaba решила доказать, что ее новая флагманская модель умеет не просто рассуждать, а реально работать за компьютером. И цифры, которые приводит команда Qwen, выглядят дерзко. В бенчмарке OSWorld-Verified, который оценивает способность ИИ-агента взаимодействовать с операционной системой и приложениями, Qwen3.8-Max набирает 86,1 балла. Это выше, чем у GPT-5.6 Sol Max (83,2) и Fable 5 (85,0), не говоря уже о Gemini 3.1 Pro, который застрял на 76,2.
Что это значит? По сути, модель тренировали не на болтовне, а на реальных действиях: открыть приложение, кликнуть нужную кнопку, заполнить форму, спасти умирающий legacy-процесс. Именно эти сценарии и измеряет OSWorld-Verified, и именно здесь Qwen3.8-Max обходит конкурентов. Показательно, что это не голословный маркетинг, а результаты свежих замеров, которые уже разлетелись по профильным изданиям.
Бенчмарки ИИ: не только десктоп
Но компьютерным агентом дело не ограничивается. Qwen3.8-Max также заявляет лучший результат в PaperBench — 93,0 балла. Этот тест от OpenAI проверяет, способен ли ИИ восстановить научную статью по экспериментальным данным. 93 балла — это серьезная заявка на то, чтобы модель использовали в исследовательских лабораториях для автоматизации рутины.
В остальном результаты тоже впечатляют: TerminalBench 2.1 — 86,6, Vision2Web — 69,0, LVBench — 81,8 и ERQA — 77,8. Однако абсолютного доминирования нет. На SWE-Pro, например, лидирует OpenAI, а Opus 4.8 продолжает удерживать первенство на ряде тестов по разработке ПО и в Agents' Last Exam. То есть перед нами не новый «убийца всех моделей», а один из самых сбалансированных профилей производительности среди актуальных моделей. Именно такая универсальность, а не победа в одной категории, часто оказывается решающим аргументом для корпоративных заказчиков.
Практические сценарии и ценовая политика
Где Qwen3.8-Max покажет себя лучше всего
Если отбросить сухие цифры бенчмарков, главный вопрос — а что с этой моделью вообще делать? Alibaba четко обозначила четыре сценария, где Qwen3.8-Max должна чувствовать себя как рыба в воде. Это длительная автономная разработка ПО, компьютерные агенты, автоматизация исследований и мультимодальные промышленные процессы. То есть вместо того, чтобы вежливо отвечать на вопросы, модель должна сама тащить проект от начала до конца, желательно — без постоянного дергания за рукав.
Особенно интересно выглядит направление компьютерных агентов. Qwen3.8-Max способна автоматизировать работу с desktop-приложениями: обработка документов, заполнение форм, навигация по интерфейсам. Самый сок — интеграция унаследованных систем, где нет API и вообще непонятно, как к ним подступиться. Раньше для этого нанимали человека, который кликает мышкой. Теперь этим может заняться ИИ, и, судя по результатам OSWorld, у него это неплохо получается. По сути, это открывает дорогу к автоматизации тех процессов, которые десятилетиями оставались нетронутыми просто потому, что для них не было программных интерфейсов.
Отдельная фишка — мультимодальность, но не в том смысле, к которому мы привыкли. Здесь визуальное восприятие работает не как разовый анализ картинки, а как непрерывный механизм обратной связи при планировании и выполнении задач. Проще говоря, модель смотрит на экран, видит результат своих действий, корректирует план и двигается дальше. Для производства и логистики это критически важно: конвейер, склад, инспекция качества — везде, где нужно реагировать на визуальную обстановку в реальном времени, такой подход выглядит куда полезнее, чем просто распознавание изображений.
Цена вопроса: дешево и сердито
Переходим к самому вкусному — к деньгам. API Qwen3.8-Max на QwenCloud обойдется в $2 за миллион входных токенов и $6 за миллион выходных. Для флагманской модели с 2,4 триллиона параметров это очень аппетитно. Давайте посчитаем: совокупная цена за пару вход+выход получается $8. У Claude Opus 5 совокупная цена — $30 (то есть $5 за вход + $25 за выход), у GPT-5.6 Sol Max — $35 ($5 + $30). Итого Qwen3.8-Max более чем в три раза дешевле Opus 5 и более чем в четыре раза дешевле Sol Max. Чувствуете разницу?
Тут стоит вспомнить, что агентные системы потребляют токены как не в себя. Автономная работа в течение нескольких часов может сжечь миллионы токенов: постоянные итерации, самокоррекция, чтение промежуточных результатов. Именно поэтому стоимость инференса становится ключевым фактором для корпоративных ИИ-агентов. Показательно, что даже OpenAI на днях срезала цены на GPT-5.6 Terra и Luna на 20% и 80% соответственно — похоже, в Сан-Франциско прекрасно понимают, что дорогие агенты никто не потянет.
В итоге Qwen3.8-Max выглядит очень соблазнительно для тех, кто хочет запускать корпоративные ИИ-агенты в промышленных масштабах, не разорив бюджет на инференс. Сочетание агрессивной цены на Qwen Cloud, мощных агентных способностей и мультимодальной обратной связи делает эту модель серьезным аргументом в переговорах с американскими гигантами. Вопрос только в том, насколько стабильно она поведет себя в реальных продакшен-средах, а не на красивых демороликах.
Открытые веса и лицензионная неопределённость
Пока конкуренты меряются цифрами на бенчмарках, вокруг Qwen3.8-Max остаётся куда более практичный вопрос: на каких условиях Alibaba выложит открытые веса. На момент анонса компания заявила, что и флагман, и компактная версия Qwen3.8-27B появятся в открытом доступе уже на следующей неделе. Но ни в релизе, ни в сопроводительных документах не указано, под какой лицензией это произойдёт.
Разница между разрешительной и ограничительной лицензией для бизнеса колоссальная. Если модель выпустят под Apache 2.0 или подобной лицензией, предприятия смогут без лишних проволочек разворачивать её на своих мощностях, дорабатывать и встраивать в коммерческие продукты. Это практически идеальный сценарий для долгосрочных инвестиций в инфраструктуру.
Чем опасна кастомная лицензия?
Обратный сценарий — кастомная лицензия, как у Moonshot Kimi K3. Формально веса открыты, но на деле компания может запретить коммерческое использование, модификацию или потребовать отдельный контракт для тех, кто предлагает модель как сервис (Model-as-a-Service). При таком раскладе open-weight теряет половину смысла: для серьёзного бизнеса это скорее витрина, чем рабочий инструмент.
До тех пор пока Alibaba не опубликует точные условия, заявление об открытых весах стоит считать предварительным. Полагаться на него при планировании долгосрочных инфраструктурных вложений пока рискованно — слишком много неизвестных.
Впрочем, даже если с лицензией всё сложится удачно, судьба Qwen3.8-Max будет решаться не в бенчмарк-таблицах. Независимая проверка заявленных результатов, реальная надёжность в продакшене и те самые условия лицензии ИИ — вот что определит, станет ли новинка полноценной альтернативой американским проприетарным моделям или просто ещё одним ярким участником гонки. Позиции в лидербордах тут вторичны.
Кажется, в мире ИИ теперь неделя — это вечность. Пока мы готовили этот материал, ещё пара моделей могла устареть. Но именно такие моменты и вдохновляют: гонка ускорилась настолько, что лидеры меняются чуть ли не еженедельно. И если Qwen3.8-Max действительно получит свободную лицензию, у разработчиков появится ещё один мощный инструмент, который уже невозможно игнорировать.