Higgsfield API даёт разработчикам единый асинхронный доступ к десяткам моделей для изображений и видео. Это полезно тем, кто строит медиасервис и не хочет отдельно поддерживать интеграции, очереди и скачивание результатов у каждого поставщика.
Alibaba Qwen выпустила Qwen-Image-2.1 — открытую модель для генерации и редактирования изображений с поддержкой прозрачности. Она важна не только качеством, но и тем, что сразу подходит для дизайнерских и товарных сценариев без отдельного слоя вырезания объекта.
Четыре тихих запуска показывают, где агенты могут быть полезны без большого шума: переговоры о встречах, узкий доступ к генерации изображений, зрение для текстовых агентов и реклама в Google Ads. У всех слабый публичный сигнал, но понятная рабочая боль.
Photoroom выпустила PRX — открытую модель для генерации изображений по тексту, обученную с нуля и доступную в Diffusers под лицензией Apache 2.0. Для открытой экосистемы это заметно: модели изображений с разрешением на коммерческое использование выходят реже, чем текстовые.
На досках Arena модель GPT-image 2.5 Sunburst теперь стоит первой и в создании изображений по тексту, и в редактировании одного изображения. Это заметное движение относительно прежней картины, где лидером этих направлений была GPT-image 2 medium.
OpenAI обновила генерацию и редактирование изображений в ChatGPT: версия Images 2.5 лучше удерживает объекты с референсов, точнее следует многошаговым правкам и работает быстрее. Для разработчиков появились две модели GPT-Image-2.5 в API: быстрая Flare и более точная Sunburst.
OpenAI обновила ChatGPT Images и вывела две модели для API, IBM усилила специализированные прогнозные модели, а TinyDiT показал, что обучение генератора изображений с нуля становится доступнее небольшим командам.
xAI объявила, что с 2 ноября 2026 года запросы к grok-imagine-image-quality будут прозрачно обслуживаться через grok-imagine-image-2.0 с низким качеством изображения. Для разработчиков это важное изменение: внешний формат запросов обещают сохранить, но за кулисами меняются модель и цена за изображение.
CapsLock срочно ищет удалённого техлида по пайплайнам генеративного ИИ для платформы генерации визуалов товаров: роль про сборку воспроизводимых пайплайнов, работу с графическими ускорителями и удобные интерфейсы для команд без инженерного бэкграунда. Зарплата не раскрыта, зато зона ответственности выглядит широкой и по-настоящему продуктовой.