Alibaba Qwen 3.8-Max обогнал GPT-5.6 Sol Max и Fable 5 в тестах

пост на 3 мин

Новая ИИ-модель Alibaba Qwen3.8-Max объявлена победителем ключевых тестов на автономное программирование и мультимодальное мышление. Китайская Alibaba сообщила о том, что в ряде бенчмарков модель превзошла GPT-5.6 Sol Max, Claude Fable 5 и даже Gemini 3.1 Pro. Однако результаты пока выглядят слишком обнадеживающе, чтобы не требовать независимой валидации. При этом в тестах на сложные агентные задачи Qwen3.8-Max набрал баллы, которые до сих пор достигали лишь топовые версии конкурентов.

Кроме того, по словам разработчиков, модель достигла рекордных показателей в задачах, где ранее узкие искусственные интеллекты не справлялись — например, в интеграции текста с изображениями или самостоятельном поиске информации. Для сравнения: в России аналогичные усилия, такие как модели от Яндекса и Сбера, пока находятся на уровне Qwen2.5. Цена лицензии на Qwen3.8-Max, как утверждают, составит около 500 долларов в месяц для корпоративных клиентов. Эквивалент в рублях при текущем курсе — 45 тысяч, что делает её доступной для небольших компаний, но всё ещё выше, чем популярные open source решения.

Третьи эксперты уже начали обсуждать, насколько эти результаты могут изменить глобальную динамику развития ИИ. Одни видят в них прорыв для локальной обработки данных, другие предупреждают о рисках переоценки реальной практичности модели без полевых тестов. Кстати, именно в автономных сценариях — например, управление роботами или анализ больших данных на основе естественного языка — Qwen3.8-Max выделяется особенной гибкостью. Это может стать катализатором для внедрения ИИ в промышленность, где раньше задачи требовали ручного контроля.

А если серьёзные тесты подтвердят данные Alibaba, это будет означать, что Китай официально выступит на первом месте в гонке за самую мощную языковую модель. Раньше американские компании доминировали здесь, но теперь их позиции под угрозой. Например, GPT-5.6 Sol Max, который в прошлом году был «золотым стандартом», оказывается неэффективным именно в тех сценариях, где важна не только точность, но и способность к самостоятельному принятию решений. Это меняет правила игры для всех, кто работает с ИИ в реальном времени.

Вы когда-нибудь сталкивались с тем, что ИИ «застревает» на простой задаче, которую видит человеку за секунду? Если хотите понять, насколько глубока разница между текущими моделями и тем, что может предложить Qwen3.8-Max, сервис AiGENDA быстро проведёт вам mini-тест на реальных примерах. Наш анализирующий алгоритм сравнит ваш текущий ИИ-инструмент с новой моделью и покажет, где вы теряете время или деньги. Попробуйте бесплатно или выберите тариф под ключ. Перешлите эту статью коллеге из IT-отдела — возможно, это спасёт часы работы над проектом.

Комментариев нет

Добавить комментарий

Аэропорт Стамбула обогнал Хитроу и стал самым загруженным в Европе

Аэропорт Стамбула стал самым загруженным авиаузлом в Европе, обогнав лондонский Хитроу. Сообщается,…

Cosmos Selection Сочи Сиалия Резорт запускает продажи по ДДУ — статус МИП в Сочи

В Сочи запускают строительство пятизвездочного отеля Cosmos Selection Сочи Сиалия Резорт. Данный…

Армения должна выбрать между ЕС и ЕАЭС до декабря 2026 года

Армении необходимо до декабря 2026 года выбрать вектор развития между Европейским союзом…

Тракторист пытался скрыться от ДПС по полям в Нефтекамске — водителя задержали

Водитель трактора устроил погоню от сотрудников ДПС по полям в Нефтекамске. Нарушитель…

Китаец начал бегать по лесу с криками на обезьян

Житель Китая обзавелся крайне необычным увлечением. Мужчина регулярно посещает леса, чтобы бегать…