На LM Arena новый Qwen 3.8 Max занял место между Fable и Opus в категории разработки фронтендов по визуальному эскизу. Это показывает, что нативное обучение сразу на смесь текста и графики вполне на уровне лучшего, что может сделать Anthropic.
Однако я заметил по работе с Qwen 3.8 Max, что модель на деле не поощряет чайников, как Claude. Известная фишка Claude в том, что Дарио исходит из того, что AI-агентом скорее будет управлять дилетант, поэтому он невероятно «дуракоустойчив». В целом, за Anthropic добавили дуракоустойчивость и другие вендоры LLM, т.к. далеко не все разработчики нормально обучены агентской оркестрации. Даже возникла идея, что теперь не нужно с фротиром особо понимать, как управлять LLM, а она «массой задавит».
Вот в случае Qwen 3.8 Max тревожный звонок для тех, кто агентами управляет Ad Hoc. Модель явно заточена на профессионала и в постановке задачи на спеке и в самом пайплайне разработки, т.е. Alibaba ожидает довольно отлаженный фреймворк промптов для управления их фронтиром.
Если другие вендоры топовых LLM также решат, что пора бы уже разработчикам начинать нормально учиться управлять агентами, а не пихать в ИИ «записки сумасшедшего», то очень многие «рабочие пайплайны» могут рухнуть, т.к. они рабочими, строго говоря, были не согласно им, а вопреки им за счет дуракоустойчивости топовых LLM. Но как я уже отметил, Qwen 3.8 Max может указывать на окончание эры «чайника за пультом ИИ».