Три свежих проекта почти не собрали внимания, но каждый бьёт в сложную и дорогую часть рынка: Hub пытается добывать реальные данные для лабораторий ИИ и робототехники, OrbitSuite строит детерминированную инфраструктуру для парков агентов, а Kinro автоматизирует страховое брокерство целиком. Пока у них единичные сигналы интереса, но идеи у всех заметно сильнее их текущей видимости.
В свежих таблицах LMArena заметно не только лидерство Claude Fable 5, но и уплотнение конкуренции ниже первой четвёрки: в общий текстовый топ-10 вошли Ernie 5.1, Mimo v2.5 Pro и Kimi K2.6, а в категории веб-разработки к лидеру вплотную подошли GLM-5.2, qwen3.7, Kimi K2.6 и MiniMax M3.
Две свежие истории с TechCrunch о прикладных AI-стартапах: Respond.io показывает редкое сочетание роста, прибыли и масштаба в клиентских коммуникациях, а Sandstone забирает внимание инвесторов в автоматизации внутренних юридических команд. Обе новости важны как сигнал: деньги продолжают идти не только в модели, но и в узкие рабочие процессы, где AI уже приносит измеримую пользу.
Kilo Code — открытый агент для программирования в VS Code, JetBrains и командной строке, который объединяет генерацию кода, автодополнение, режимы планирования и отладки, управление терминалом и браузером, а также выбор из сотен моделей. Разбираем, кому такой комбайн действительно полезен, как устроена оплата и где у продукта сильные и слабые стороны.
The Atlantic разбирает не только сам конфликт вокруг Anthropic, но и более широкий эффект для рынка: несогласованное давление государства может наказать тех, кто открыто говорит о рисках и делится возможностями передовых систем с властями. Это важный сдвиг в разговоре о том, как именно государство влияет на развитие ИИ.
Три заметные работы на стыке ИИ и науки: система MaxProof для длинных математических доказательств, AgentPLM для проектирования белков с внешними инструментами и клиническая система с цифровым двойником для выбора лечения. Коротко разбираем, что именно сделали авторы и почему это важно.
Десять свежих историй о том, как люди встраивают ИИ в повседневную жизнь: от семьи, проходящей через онкологический диагноз, до родителей, учителей и одиночных разработчиков, которые с помощью Claude и других инструментов собирают свои продукты и личные системы поддержки.
На таблице SWE-bench Verified произошло заметное уплотнение сразу за лидерами: GPT-5-2 Codex вошла в кластер с результатом 72,8% рядом с GLM-5 и GPT-5-2 в режиме повышенного рассуждения. Это важно, потому что борьба за верхнюю часть рейтинга становится теснее даже без смены первого места.
Три свежих запуска с низкой заметностью, которые легко пропустить: тренажёр устных ответов Oriq, более прицельный инструмент для продаж Alsona и прикладной редактор товарных фото PhotoEditorAI. У каждого пока слабый сигнал по вниманию, но идея у всех заметно интереснее их скромного старта.