ТЕХНОЛОГИИ

Alibaba улучшила ИИ-модель Qwen3.8-Max благодаря дополнительному обучению

Alibaba обновила свою ИИ-модель Qwen3.8-Max, которая теперь заняла первое место в рейтинге Code Arena: WebDev. Новая версия, Qwen3.8-Max-0902, была получена в результате дообучения, сосредоточенного на программировании и совместной работе агентов.

Искусственный интеллект Qwen3.8-Max, разработанный Alibaba, достиг первого места в рейтинге Code Arena: WebDev на платформе Arena.ai. Это улучшение стало возможным без выпуска новой версии, благодаря дополнительному обучению с подкреплением, сосредоточенному на программировании и совместной работе агентов. Новая версия модели получила индекс Qwen3.8-Max-0902.

Изначальная версия Qwen3.8-Max была представлена 3 августа 2026 года и заняла четвёртое место в рейтинге, набрав 1668 баллов. Она уступила моделям Anthropic Claude Opus 5 (Max), Moonshot Kimi K3 (Max) и Claude Opus 5 (High). После повторного тестирования 2 сентября Qwen3.8-Max-0902 улучшила свои результаты до 1691 балла, обойдя Claude Opus 5 (Max) на 2 балла и Kimi K3 (Max) на 17 баллов.

Обновление модели позволило ей сохранить 2,4 трлн параметров и 95 млрд активных параметров на токен. Цены на использование остались прежними: $2 за 1 млн входных токенов и $6 за 1 млн выходных токенов. В ходе дообучения Qwen3.8-Max-0902 продемонстрировала значительный рост в различных тестах, включая увеличение баллов в TerminalBench с 11,3 до 29,0 и в ProgramBench с 10,5 до 28,0.

Несмотря на улучшения, Qwen3.8-Max-0902 всё ещё уступает Claude Opus 5 в ряде тестов, включая DeepSWE и ProgramBench. Первая версия модели набрала 67,7 баллов в тесте SWE-bench Pro, в то время как Claude Fable 5 показала 80 баллов. Открытые веса модели Qwen3.8-2.4T-A95B доступны на платформе Hugging Face, хотя о планах по выпуску весов для варианта 0902 пока нет информации.

По материалам: 3dnews.ru