Новая ИИ-модель Alibaba Qwen3.8-Max объявлена победителем ключевых тестов на автономное программирование и мультимодальное мышление. Китайская Alibaba сообщила о том, что в ряде бенчмарков модель превзошла GPT-5.6 Sol Max, Claude Fable 5 и даже Gemini 3.1 Pro. Однако результаты пока выглядят слишком обнадеживающе, чтобы не требовать независимой валидации. При этом в тестах на сложные агентные задачи Qwen3.8-Max набрал баллы, которые до сих пор достигали лишь топовые версии конкурентов.
Кроме того, по словам разработчиков, модель достигла рекордных показателей в задачах, где ранее узкие искусственные интеллекты не справлялись — например, в интеграции текста с изображениями или самостоятельном поиске информации. Для сравнения: в России аналогичные усилия, такие как модели от Яндекса и Сбера, пока находятся на уровне Qwen2.5. Цена лицензии на Qwen3.8-Max, как утверждают, составит около 500 долларов в месяц для корпоративных клиентов. Эквивалент в рублях при текущем курсе — 45 тысяч, что делает её доступной для небольших компаний, но всё ещё выше, чем популярные open source решения.
Третьи эксперты уже начали обсуждать, насколько эти результаты могут изменить глобальную динамику развития ИИ. Одни видят в них прорыв для локальной обработки данных, другие предупреждают о рисках переоценки реальной практичности модели без полевых тестов. Кстати, именно в автономных сценариях — например, управление роботами или анализ больших данных на основе естественного языка — Qwen3.8-Max выделяется особенной гибкостью. Это может стать катализатором для внедрения ИИ в промышленность, где раньше задачи требовали ручного контроля.
А если серьёзные тесты подтвердят данные Alibaba, это будет означать, что Китай официально выступит на первом месте в гонке за самую мощную языковую модель. Раньше американские компании доминировали здесь, но теперь их позиции под угрозой. Например, GPT-5.6 Sol Max, который в прошлом году был «золотым стандартом», оказывается неэффективным именно в тех сценариях, где важна не только точность, но и способность к самостоятельному принятию решений. Это меняет правила игры для всех, кто работает с ИИ в реальном времени.
Вы когда-нибудь сталкивались с тем, что ИИ «застревает» на простой задаче, которую видит человеку за секунду? Если хотите понять, насколько глубока разница между текущими моделями и тем, что может предложить Qwen3.8-Max, сервис AiGENDA быстро проведёт вам mini-тест на реальных примерах. Наш анализирующий алгоритм сравнит ваш текущий ИИ-инструмент с новой моделью и покажет, где вы теряете время или деньги. Попробуйте бесплатно или выберите тариф под ключ. Перешлите эту статью коллеге из IT-отдела — возможно, это спасёт часы работы над проектом.