Пять заметных сигналов с рынка ИИ-моделей показывают, что гонка всё меньше сводится к сухим тестам. Новые выпуски теперь соревнуются сразу по нескольким осям: кто лучше держит длинную работу, кто даёт более предсказуемые затраты, кто идёт в открытые веса и кто глубже заходит в научные и институциональные сценарии, где важны проверяемость и контроль.
В свежем срезе AI-бенчмарков заметно сразу несколько перестановок: Seed 2.1 Pro Preview дебютировала в первой десятке рейтинга веб-разработки, ERNIE 5.1 пробилась в пятёрку поиска, Gemini 3.5 Flash вошла в десятку по работе с документами, а GPT-5.4 High закрепилась в верхней десятке агентного рейтинга. Ниже — девять движений, которые действительно меняют картину в Arena.
В центре сегодняшнего выпуска — всё более явный разворот рынка от универсальных чат-помощников к специальным моделям под конкретные задачи: киберзащиту, корпоративный поиск и профессиональную работу со знаниями.