Cайт веб-разработчика, программиста Ruby on Rails ESV Corp. Екатеринбург, Москва, Санкт-Петербург, Новосибирск, Первоуральск

Alibaba показала искусственный интеллект, который 16 дней подряд самостоятельно писал и правил код

Новая нейросеть Alibaba получила программный проект и работала над задачей 16 дней. По заявлению компании, Qwen3.8-Max самостоятельно вносила изменения в код и выполняла последовательность длительных операций. Эксперимент стал одной из главных демонстраций возможностей крупнейшей и самой производительной модели в истории семейства Qwen.

Alibaba представила Qwen3.8-Max с 2,4 трлн параметров. Компания позиционирует разработку как конкурента передовым системам Anthropic и OpenAI. После анонса акции Alibaba Group на торгах в Гонконге подорожали на 7%.

Qwen3.8-Max использует архитектуру «смесь экспертов», которая распределяет запросы между специализированными частями нейросети. При выполнении одной задачи система активирует около 95 млрд из 2,4 трлн параметров. Архитектура сокращает вычислительные расходы и задержку, поскольку оборудование не обрабатывает всю модель одновременно, уточняет Reuters.

Модель принимает текст, изображения и видео, а контекстное окно вмещает до 1 млн токенов. Подобный объем позволяет загрузить в один запрос сотни страниц документов, длинные юридические материалы или крупную базу исходного кода. Alibaba особенно выделяет способности Qwen3.8-Max к автономному программированию, исследовательской работе и выполнению многоэтапных заданий, рассчитанных на продолжительное время.

После публикации Qwen3.8-Max стала самой высоко оцененной китайской текстовой моделью в рейтинге Arena.AI. Разработка уступила Claude Fable 5 и трем вариантам Claude Opus от Anthropic. В отдельном рейтинге систем для анализа изображений модель Alibaba заняла второе место в мире, пропустив вперед только одну версию Claude Fable 5.

Qwen3.8-Max также превзошла в нескольких тестах Kimi K3 от китайского стартапа Moonshot AI. Конкурирующая нейросеть содержит 2,8 трлн параметров, однако больший размер сам по себе не гарантирует более высокое качество. Число параметров прежде всего показывает масштаб архитектуры, объем вычислений и количество данных, использованных при обучении.

Команда Qwen планирует опубликовать веса Qwen3.8-Max на следующей неделе. Разработчики смогут загружать модель, запускать на собственной инфраструктуре и адаптировать под специализированные задачи. Alibaba также готовит к публикации веса более компактной Qwen3.8-27B, говорится в сообщении разработчиков.

Анонс продолжил серию крупных релизов китайских ИИ-компаний. Moonshot AI недавно представила Kimi K3, а DeepSeek расширила доступ к V4-Flash. По оценке исследовательской компании Artificial Analysis, новая система DeepSeek стала самой дешевой в эксплуатации среди известных моделей: средняя стоимость одного теста составила три цента против 86 центов у Kimi K3, $1,86 у GPT-5.6 Sol и $3,15 у Claude Fable 5.

SecurityLab