LMArena снова показала не столько смену лидера, сколько важное уплотнение преследователей сразу в нескольких специализированных категориях. Верхушка по-прежнему в основном остаётся за линейкой Claude, но ниже первой пятёрки начались движения, которые полезно отслеживать: Meta, Alibaba, Moonshot и Google всё увереннее занимают места в тех режимах, где раньше доминировала почти одна семья моделей.

Что изменилось:

Рейтинг сложных англоязычных запросов: muse-spark-1.1 теперь №6

В срезе сложных англоязычных запросов модель muse-spark-1.1 от Meta поднялась на шестое место с результатом 1517 и пометкой о предварительном статусе после 2 119 голосов. Первая пятёрка здесь всё ещё полностью занята моделями Claude, но сам факт появления нового заметного игрока сразу под ними важен: Meta начала закрепляться не только в общих чат-рейтингах, но и в более трудном наборе запросов, где слабые модели обычно быстро проседают. Для рынка это сигнал, что давление на нижнюю часть элитной группы усиливается.

Рейтинг длинных запросов: qwen3.7-max-preview вошла в топ-10 на №10

В рейтинге длинных запросов qwen3.7-max-preview заняла десятое место с результатом 1497 и 1 597 голосами. Ещё интереснее, что Kimi K3 уже поднялась на седьмую строку, а Gemini 3.6 Flash подобралась к десятке на тринадцатую. Верхушка тут тоже остаётся в основном за Claude, но картина меняется: длинные и более открытые запросы больше не выглядят территорией одной лаборатории. Alibaba и Moonshot уже не просто мелькают на периферии, а получают видимое место в важном прикладном сценарии.

Экспертный рейтинг: Claude Opus 4.8 Thinking дошла до №6

В экспертной категории Claude Opus 4.8 Thinking поднялась на шестую позицию с результатом 1526 после 3 121 голоса. Здесь новость не в смене лидера, а в том, насколько крепко Anthropic держит именно сложный профессиональный срез: первая пятёрка остаётся плотной внутренней зоной Claude. Ниже уже толпятся GPT-5.6 Sol (xHigh), GPT-5.5 High, GPT-5.4 High, Gemini 3.6 Flash и qwen3.7-max-preview, но пока это скорее борьба за нижнюю половину расширенного списка лидеров, чем реальная атака на вершину.

Рейтинг творческого письма: Gemini 3.6 Flash вошла в топ-10 на №8

В категории творческого письма Gemini 3.6 Flash заняла восьмое место с результатом 1478 и пометкой о предварительном статусе после 783 голосов. Следом идут GPT-5.6 Sol (xHigh) и Kimi K3. Здесь особенно интересно не само место, а тип категории: творческое письмо обычно хуже прощает дешёвые или облегчённые модели, потому что там быстрее видны огрехи стиля и ритма. Если Gemini 3.6 Flash удержится после набора большего числа голосов, это будет хороший аргумент в пользу того, что быстрые модели продолжают догонять тяжёлые не только по скорости, но и по качеству выразительного текста.

Общий вывод пока такой: лидерство Claude никуда не делось, но внутреннее пространство под первой пятёркой стремительно становится более многополярным. Если эти сдвиги сохранятся ещё несколько обновлений подряд, ближайшие недели в LMArena будут уже не про одинокого лидера, а про очень плотную борьбу разных лабораторий за право стать главным преследователем.