Alibaba снова привлекла внимание.
На этот раз претензии компании выходят за рамки простой вычислительной мощности. Речь идет об устойчивости. Китайский технологический гигант утверждает, что его новая модель, Qwen3.8-Max, способна работать автономно — без присмотра — в течение нескольких дней. Никаких людей, контролирующих каждый шаг. Никакого надзора. Только ИИ, последовательно выполняющий задачи до их завершения.
Долгое время это было прерогативой Anthropic. Их модели, такие как Claude, славились способностью выполнять длительные и сложные рабочие процессы без постоянного вмешательства человека. Теперь Alibaba утверждает, что догнала конкурентов, а возможно, и перегнала их.
Что на самом деле означает «работа без присмотра»?
Давайте разберемся, как именно ИИ выполняет задачи «в одиночку». Это не сидение перед монитором в ожидании инструкций. Это выполнение последовательности закодированных действий, написание отчетов или отладка программного обеспечения. И все это продолжается часами, а то и днями.
По данным Alibaba, один из конкретных тестов длился 125 непрерывных часов. Это пять полных суток.
Что же ИИ делал все это время? Он с нуля воссоздал эксперимент, описанный в математической исследовательской статье. При этом он не просто скопировал оригинал, а улучшил первоначальную методологию. Это уже не просто воспроизведение информации. Это синтез и самостоятельное исполнение.
В другом тесте Qwen3.8-Max принял участие в реальном онлайн-соревновании по написанию кода. Сроки? 24 часа. Конкурентами выступили 526 команд инженеров-людей. Итог? Модель обошла всех, кроме 68 участников.
Производит впечатление? Безусловно. Но это самоотчетные метрики. Независимая верификация этих данных отсутствует. Пока мы вынуждены принимать их на веру.
Американский соперник: Claude и Anthropic
Почему это важно? Потому что между США и Китаем идет гонка, и дистанция между ними сокращается.
Anthropic, американская компания, стоящая за созданием Claude, долгое время лидировала в нарративе о «автономном ИИ». Их флагманская модель Claude Opus (часто упоминаемая в недавних обзорах как Claude Fable) предназначена для решения незнакомых задач с минимальным вмешательством человека.
Компания даже продает продукт под названием Claude Code (ранее — Claude Cowork). Эти инструменты созданы для передачи задач. Вы даете ИИ исследовательский проект, таблицу или черновик. Вы оставляете его работать в покое. Вы возвращаетесь позже, чтобы проверить результат. Инструменты призваны заменить слой «рутинной работы» в интеллектуальном труде.
Anthropic утверждает, что их новейшая версия справляется с длительными отрезками работы лучше, чем любые предыдущие модели. По их словам, она способна самостоятельно читать архитектуру программного обеспечения, планировать исправления, тестировать код и проверять результаты.
Та же самая стратегия. То же самое обещание. Просто другие бренды.
Почему эта гонка актуальна именно сейчас?
Это не просто технологический спор о первенстве. Это вопрос геополитики.
Вашингтон потратил последние два года на попытки затормозить Китай. Стратегия проста: ограничить экспорт передовых ИИ-чипов. Оставить китайские компании, такие как Alibaba, на поколение позади, лишив их доступа к соответствующему «железу».
Логика очевидна: нет чипов — нет передовых моделей.
Ответ Alibaba? Показать им превосходство.
Выпустив веса модели Qwen3.8-Max в открытый доступ бесплатно, Alibaba совершает смелый ход. Она приглашает всю глобальную разработчиков аудировать модель. Никакой «черной коробки». Никаких скрытых трюков. Просто код, который любой может изучить.
Если утверждения подтвердятся, это докажет две вещи:
1. Алгоритмическая эффективность может компенсировать нехватку аппаратного обеспечения.
2. Китайская разработка ИИ не отстает от США. Она соревнуется на одной площадке.
Итог: Здоровый скептицизм — лучшее оружие
Давайте взглянем на реальность.
Ни Alibaba, ни Anthropic не публиковали независимые аудиты. Обе компании представляют результаты, выгодно подчеркивающие их возможности. Им выгодно показывать свои модели как мощные, автономные и превосходящие аналоги.
Вопрос не в том, правдивы эти утверждения или нет. Вопрос в том: насколько близко на самом деле расстояние между ними?
Инвесторы и правительства внимательно следят за этим. Если Alibaba сможет предоставлять высококачественные услуги автономного ИИ, используя менее мощное «железо», чем американские компании, весь нарратив о «аппаратном превосходстве» начнет давать трещину.
Это увлекательный сдвиг. Мы переходим от гонки за более быстрые чипы к гонке за более умный код. И финишная черта постоянно смещается.
Доверите ли вы пятидневному циклу работы ИИ без человеческого контроля? Или, наоборот, это именно то, чего вы ждете?
Инструменты уже здесь. Тестирование не останавливается.





























