В этот раз главная новость не в новом тестовом рекорде, а в доступности: спрос на GPT-6 Astra оказался достаточно сильным, чтобы OpenAI временно ограничила продажи дорогого тарифа. Параллельно видно другое движение рынка: одни команды пытаются лучше распределять задачи между моделями, другие — удешевляют мультимодальные возможности для API.

OpenAI временно остановила новые подписки Pro из-за нагрузки от GPT-6 Astra

TechCrunch сообщил, что OpenAI временно приостановила новые подключения к тарифу Pro за 200 долларов в месяц. Причина — необычно высокий спрос на GPT-6 Astra и нагрузка на инфраструктуру. Более дешёвые тарифы Go и Plus, а также API, по данным материала, оставались доступны.

Почему это важно: запуск сильной модели обычно обсуждают через тесты, но здесь видно влияние на упаковку продукта и доступ. Если мощная модель быстро забивает доступные вычислительные ресурсы, компании приходится управлять не только качеством ответов, но и очередью пользователей, ценой и обещаниями по доступности.

Sakana AI выпустила Fugu Max и Fugu Ultra v2 как альтернативу одной гигантской модели

Sakana AI представила Fugu Max и Fugu Ultra v2. Компания описывает их не как очередную одну большую модель, а как архитектуру оркестрации: система выбирает и сочетает разные открытые и специализированные модели под задачу. Fugu Max нацелен на более дешёвую производительность, в том числе через интеграции NVIDIA Nemotron, а Fugu Ultra v2 — на сложные многошаговые задачи, визуальные и структурированные данные и программирование.

Почему это важно: Sakana делает продуктом сам способ выбора моделей. Для команд это может быть практичнее, чем спор о том, какая одиночная модель «самая умная»: разные задачи требуют разной цены, задержки, контекста и точности. Если такой подход сработает, рынок будет сравнивать не только модели, но и умение правильно собрать их в рабочий контур.

DeepSeek вывела DeepSeek-V4.1-Flash с мультимодальностью и более низкими ценами API

DeepSeek объявила DeepSeek-V4.1-Flash — более быструю и дешёвую модель с нативным пониманием изображений. По описанию компании, новая схема использует 8 млрд активных параметров на входе и 16 млрд на выходе, снижает стоимость кэша ключей и значений и уже доступна в API как deepseek-flash. С 14 сентября она должна временно заменить маршрутизацию V4-Pro до запуска V4.1-Pro.

Почему это важно: DeepSeek продолжает давить ценой в сегменте, где мультимодальность и агентные сценарии быстро становятся базовым требованием. Если зрительное понимание, высокая скорость и низкая стоимость сходятся в одном тарифе API, разработчикам становится проще переносить такие модели из экспериментов в массовые продукты.