На досках Arena модель GPT-image 2.5 Sunburst теперь стоит первой и в создании изображений по тексту, и в редактировании одного изображения. Это заметное движение относительно прежней картины, где лидером этих направлений была GPT-image 2 medium.
В рейтинге Image-to-WebDev на Arena модель Claude Sonnet 5 High сразу заняла 7-е место с результатом 1533. Для рынка это заметный сигнал: Anthropic быстро закрепляется не только в текстовых задачах, но и в прикладном сценарии, где модель должна превращать изображение в рабочую веб-страницу.
В свежих срезах Arena сразу три заметных движения: Gemini 3.1 Pro Preview вошла в десятку по следованию инструкциям, muse-spark закрепилась в десятке сложных запросов, а qwen3.7-max-preview добралась до десятки математического рейтинга. Это не переворот всего рынка, но важный сигнал, что нижняя половина сильнейших таблиц быстро меняется.
В свежем срезе AI-бенчмарков заметно сразу несколько перестановок: Seed 2.1 Pro Preview дебютировала в первой десятке рейтинга веб-разработки, ERNIE 5.1 пробилась в пятёрку поиска, Gemini 3.5 Flash вошла в десятку по работе с документами, а GPT-5.4 High закрепилась в верхней десятке агентного рейтинга. Ниже — девять движений, которые действительно меняют картину в Arena.
Сразу три заметные новости о прикладном ИИ-бизнесе: Pocket привлёк 11 млн долларов на фоне продаж 130 тысяч устройств для записи заметок, Arena превратила платформу сравнений моделей в бизнес с годовой выручкой на темпе 100 млн долларов, а Base44 запустила собственную модель Base1, чтобы меньше зависеть от внешних поставщиков.
В сегодняшней денежной повестке ИИ — гигантская ставка Южной Кореи на память и полупроводники, Arena с уже $100 млн бизнеса на инфраструктуре доверия к моделям и робототехническая компания, которая после спора с Tesla всё равно закрыла новый раунд на $11 млн.
Новая модель wan2.7-i2v уже поднялась на 5-е место в рейтинге Arena по генерации видео из изображения. Для свежего участника это заметный вход: 1434 балла и 14 113 голосов сразу выводят модель в верхнюю часть таблицы.
В свежих бенчмарках и таблицах лидеров за день заметны сразу несколько сдвигов: Claude Sonnet 4.5 стартовала первой в новом CodeClash, Dreamina Seedance 2.0 лидирует в редактировании видео, в преобразовании изображения в видео наверху почти ничья между Gemini Omni Flash и Dreamina, а в редактировании изображений заметный отрыв показала gpt-image-2.
Свежий срез по AI-бенчмаркам показывает сразу несколько заметных перестановок: gemini-omni-flash возглавила рейтинг генерации видео, gpt-image-2 (medium) стала лидером в генерации изображений, а в задачах поиска, документов и создания сайтов по картинке сильнее всего выглядят разные версии Claude. Ниже — пять важных сдвигов, за которыми стоит следить в рейтингах Arena.