Alibaba представила Qwen3.8-Max: новую планку для ИИ-разработчиков

Новая китайская языковая модель бьёт рекорды автономности

2 мин.
Alibaba представила Qwen3.8-Max: новую планку для ИИ-разработчиков

Alibaba Cloud анонсировала выход своей самой мощной языковой модели — Qwen3.8-Max. Это историческое событие для компании, поскольку разработчики впервые приняли решение открыть веса модели класса Max. Официальный релиз исходного кода запланирован на следующую неделю, а пока ИИ-сообщество активно обсуждает невероятные масштабы новинки: архитектура Qwen 3.5 была масштабирована до внушительных 2,4 триллиона параметров, из которых активными являются 95 миллиардов.

Главной фишкой Qwen3.8-Max стала её феноменальная автономность в решении сложных инженерных задач. Разработчики заявляют, что она способна вести многодневные проекты без какого-либо участия человека. В качестве эксперимента нейросеть в течение 16 дней полностью самостоятельно создавала проект на GitHub, обрабатывая отзывы пользователей, исправляя баги и проводя автотесты. За это время она совершила 265 коммитов и закрыла более полутора сотен задач.

Ещё один впечатляющий кейс — воспроизведение и улучшение научной статьи по машинному обучению. Получив лишь текст исследования и доступ к графическим процессорам, Qwen3.8-Max за пять дней с нуля написала более 7 тысяч строк кода, провела 33 цикла обучения и не просто повторила результаты учёных, а самостоятельно разработала улучшенный метод отбора данных. Новая методика ИИ превзошла оригинальное исследование на престижном математическом бенчмарке AIME24.

Чтобы доказать превосходство модели в реальных условиях, её заявили на онлайн-хакатон по распознаванию намерений в мультимодальных диалогах WWW2025, где соревновались 526 команд из людей. За отведённые 24 часа Qwen3.8-Max без посторонней помощи выстроила сложнейшую систему ансамблей из текстовых и визуальных моделей, сделала 45 сабмитов и обошла 87% живых участников, заняв место в топе лидеров.

Сфера применения Qwen3.8-Max выходит далеко за рамки написания кода. Модель протестировали в сотнях высокооплачиваемых профессий. Например, в роли корпоративного юриста она за час проанализировала сотни документов и выявила более 1200 ключевых пунктов — задача, на которую у команды стажёров уходит неделя. В инженерном деле модель за минуты воссоздала сейсмическую модель 30-этажного здания прямо в браузере, а для ресторанного бизнеса разработала сбалансированное меню из 26 блюд с точным расчётом себестоимости.

Настоящим прорывом выглядит участие ИИ в проектировании микросхем. Модель полностью автономно провела весь цикл разработки криптографического ускорителя, сократив площадь чипа на 81% и оптимизировав архитектуру с 8298 до 678 логических вентилей. Кроме того, в симуляции годового управления интернет-магазином E-Commerce Bench модель показала выдающиеся навыки ведения переговоров с поставщиками и управления капиталом, увеличив стартовый бюджет в четыре раза.

Мультимодальные возможности Qwen3.8-Max позволяют ей не просто анализировать огромные PDF-документы и видеозаписи длиной более 100 часов, но и использовать своё зрение как инструмент обратной связи. Нейросеть способна оценивать собственные промежуточные результаты — например, сверять получившийся интерфейс приложения с макетом и самостоятельно исправлять ошибки в коде, если дизайн «поехал».

Модель уже доступна на платформе QwenCloud с поддержкой гибкой настройки глубины рассуждений (параметр reasoning_effort). Разработчики могут интегрировать её в популярные ИИ-ассистенты, такие как Claude Code, Codex и OpenClaw.

Мнение редакции

Если раньше нейросети были лишь умными помощниками, то Qwen3.8-Max доказывает: эра полностью автономных ИИ-агентов уже наступила. Способность модели самостоятельно обучаться на собственных ошибках, вести многодневные проекты и конкурировать с профессиональными инженерами меняет правила игры. Но смогут ли открытые веса этой модели совершить революцию в open-source сегменте, или коммерческие гиганты удержат лидерство?