Свежий срез Vision Arena показывает не одиночный отрыв лидера, а плотную верхушку мультимодальных моделей. Для разработчиков это важнее, чем сама смена мест: при близких оценках выбор модели всё чаще будет зависеть от конкретного сценария, цены и устойчивости на своих данных.

Claude Fable 5 High лидирует, qwen3.8-max идёт второй

По данным Vision Arena от 28 сентября, Claude Fable 5 High занимает первое место с оценкой 1310±7. qwen3.8-max находится на втором месте с 1301±7. Разрыв между ними укладывается в девять пунктов, то есть лидерство Anthropic выглядит сильным, но не недосягаемым.

Самый интересный сигнал здесь — положение Alibaba в верхней части рейтинга. qwen3.8-max держится рядом с лидером, а модели Google, Meta и OpenAI в этом срезе находятся ниже. Это делает таблицу полезной не только как список победителей, но и как индикатор того, какие лаборатории реально конкурируют в мультимодальных задачах.

Практический вывод: если команда выбирает модель для работы с изображениями, документами, интерфейсами или смешанными визуально-текстовыми задачами, смотреть только на бренд уже недостаточно. Нужно брать лидеров верхней группы, прогонять собственные примеры и сравнивать не среднее место, а ошибки на тех типах входных данных, где цена промаха выше всего.