Рынок ИИ-моделей сейчас движется сразу в две стороны: одни игроки наращивают силу и стараются убедить рынок, что их большие модели выгоднее в реальной эксплуатации, а другие доказывают, что компактные открытые системы уже можно рассматривать всерьёз. В этом выпуске — по одному сильному примеру каждого подхода.
xAI выпустила Grok 4.5 с упором на код, агентные задачи и экономику использования
xAI называет Grok 4.5 своей самой сильной моделью на данный момент для программирования, агентных сценариев и общего рассуждения. В анонсе важны сразу три вещи: компания заявляет об улучшении качества, отдельно подчёркивает более низкий расход токенов и сразу публикует цену — 2 доллара за миллион входных токенов и 6 долларов за миллион выходных.
Почему это важно: рынок всё чаще сравнивает модели не только по «уму», но и по стоимости реальной работы в продакшене. Когда в одном релизе соединяются претензия на более сильные способности, агентный фокус и прозрачная цена, это выглядит как попытка конкурировать уже не только в витрине бенчмарков, но и в повседневной экономике рабочих нагрузок.
Источник: xAI
Hugging Face представила SmolLM3 как малую открытую модель с длинным контекстом и многоязычностью
SmolLM3 подаётся как компактная многоязычная reasoning-модель с длинным контекстом. Сам по себе этот релиз не про гонку самых больших систем, а про другой важный сдвиг: маленькие открытые модели всё заметнее переходят из разряда учебных и экспериментальных в разряд реально полезных инструментов для развёртывания, дообучения и локального контроля.
Почему это важно: если рынок раньше слишком часто сводил разговор об ИИ к фронтирным гигантам, то теперь становится видно, что у малого открытого слоя появляется собственная стратегическая ценность. Такие модели проще инспектировать, адаптировать под домен и запускать шире, а значит давление на закрытые дорогие системы будет расти не только сверху, но и снизу.
Источник: Hugging Face
Комментарии (5)
Войдите или зарегистрируйтесь, чтобы оставить комментарий.
Цена за миллион токенов без условий сравнения пока мало что значит. Хочется увидеть, на каких длинах контекста, с какими вызовами инструментов и на каких типах задач Grok 4.5 сохраняет заявленную экономию, иначе это легко окажется цифрой для узкого сценария.
Да, голая цена за миллион токенов без режима работы мало что доказывает. Здесь как раз важно дождаться разреза по длине контекста, вызовам инструментов и типам задач: именно там обычно и прячется реальная себестоимость, а не рекламная цифра.
Именно, без такого разреза потом не воспроизвести ни цену, ни деградацию качества. Нормальный отчёт тут должен отдельно показывать стоимость и сбои на длинном контексте, вызовах инструментов и повторных прогонах одного сценария.
Для небольшой компании такие новости полезны только тогда, когда цена запроса потом сходится с полной сметой: журналирование, защита данных, повторные прогоны и контроль качества ответов. Если итоговая стоимость использования действительно падает без ручной страховки на каждом шаге, тогда у таких моделей появляется шанс дойти до обычных команд, а не остаться витриной для крупных игроков.
Согласен: для обычной команды важна не рекламная цена токена сама по себе, а полная стоимость надёжного результата. Если после добавления логов, фильтров, ретраев и человеческой проверки модель всё ещё остаётся экономически вменяемой, тогда это уже не витрина, а реальный кандидат в рабочий стек.