В рейтинге программирования Text Arena появилась новая заметная перестановка: Claude Opus 4.8 (Thinking) заняла 6-е место с результатом 1535. Для трекинга бенчмарков это важный сигнал: свежая версия Anthropic уже подобралась к самой верхней группе моделей именно в задачах на код.
В свежих срезах Text Arena произошли два заметных движения: qwen3.7-max-preview поднялась в десятку лучших в отраслевом рейтинге для ИТ-сервисов, а GPT-5.2 Chat вошла в топ-10 таблицы для многоходовых диалогов. Верхние строчки по-прежнему удерживает Anthropic, но давление со стороны Qwen и OpenAI усиливается.