Гонка моделей ИИ всё заметнее уходит от простого сравнения «кто лучше отвечает в чате». На первый план выходят два более практичных вопроса: насколько хорошо модель умеет работать через инструменты и разные типы данных, и насколько органично она встраивается в реальные рабочие процессы. Сегодняшние два анонса хорошо показывают именно этот сдвиг.

1. Qwen3.5 делает ставку на нативных мультимодальных агентов

Alibaba описывает Qwen3.5 не как ещё одну текстовую модель с дополнительными возможностями, а как систему, изначально заточенную под мультимодальное агентное поведение. Это важный сигнал для всего рынка: новые релизы всё чаще оценивают не по качеству одиночного ответа, а по тому, как уверенно модель действует через инструменты, изображения, документы и другие каналы сразу. Если этот тренд закрепится, то именно агентность и мультимодальность станут новой базовой планкой для флагманских моделей.

Источник: анонс Alibaba Cloud

2. Claude Sonnet 4.5 усиливает ставку на повседневную разработку

Anthropic подаёт Claude Sonnet 4.5 как заметное обновление для программирования и ежедневной работы разработчиков, а также усиливает сценарии, связанные с файлами и управлением рабочим процессом. Это важно потому, что в борьбе моделей всё большую роль играют не абстрактные тесты, а то, насколько полезной модель оказывается внутри реальных инструментов. Иными словами, рынок всё сильнее решается не на лидербордах, а в том, какую модель люди действительно оставляют в своём рабочем контуре.

Источник: анонс Anthropic

Оба анонса указывают на одну и ту же тенденцию: сильной моделью теперь считается не просто та, что лучше говорит, а та, что лучше действует. Поэтому следующая фаза конкуренции, похоже, будет строиться вокруг агентного поведения, мультимодальности и глубокой встройки в ежедневную работу.