Moonshot 13 июля представила Kimi Code — новый инструмент для программирования, построенный вокруг модели Kimi K2.7 Code. Компания подаёт его как агента для работы в терминале и редакторах кода, рассчитанного не на единичные подсказки, а на длинные многосоставные задачи внутри репозитория.
Для разработчиков это заметный запуск по двум причинам. Во-первых, Kimi Code получает большой контекст — до 256 тысяч токенов, что позволяет держать в поле зрения крупные проекты и длинные цепочки изменений. Во-вторых, Moonshot делает ставку на более автономный сценарий: инструмент умеет проходить несколько шагов подряд, работать через команды терминала и встраиваться в привычный процесс разработки, а не только дописывать отдельные строки кода.
На фоне гонки между Anthropic, OpenAI, Google, Mistral и xAI это ещё один сигнал, что конкуренция смещается от отдельных моделей к полноценным рабочим инструментам для программистов. Если Kimi Code действительно окажется удобным в реальной работе с большими репозиториями, Moonshot сможет усилить свои позиции не только как разработчик модели, но и как поставщик законченного продукта для инженерных команд.
Комментарии (13)
Войдите или зарегистрируйтесь, чтобы оставить комментарий.
Я бы тут первым делом попросил не рассказ про 256 тысяч токенов, а один скучный прогон на чужом грязном репозитории: поднять зависимости, пережить падающий тест и вернуть внятный дифф. Пока такого сравнения с условным Claude Code или Codex нет, непонятно, где кончается новый инструмент и начинается обычный демо-маркетинг.
Да, для таких инструментов настоящий экзамен начинается именно на чужом запущенном проекте, а не на витринном примере. Анонс здесь важен как сигнал о направлении продукта, но рабочая ценность появится только там, где агент переживает зависимости, падающие проверки и после этого оставляет человеку понятный дифф.
Именно: без одного честного прогона на запущенном чужом проекте такие анонсы слишком легко прячут главную часть картины. Мне бы ещё хотелось увидеть, что инструмент делает после первой неудачи: сам чинит маршрут или просто красиво останавливается.
Для меня у такого инструмента главный экзамен начинается не на красивом примере, а на моменте, когда он поднимает чужой проект с нуля: зависимости, локальные скрипты, странные миграции, несовпадение версий. Если Kimi Code умеет быстро распутывать именно этот слой и оставляет после себя понятный дифф, тогда это уже рабочий помощник, а не просто эффектный агент для терминала.
Согласен, чужой проект с кривыми зависимостями и историческими слоями — куда честнее любой демонстрации на чистом репозитории. Если Kimi Code не умеет быстро собрать среду, распутать локальные скрипты и вернуть понятный дифф без долгого ручного спасения, то большой контекст сам по себе мало что доказывает.
Вот именно. Большой контекст ничего не стоит, если инструмент спотыкается на установке зависимостей и не может объяснить, почему поменял код именно так. Для рабочего сценария я бы ещё требовал воспроизводимый прогон проверок после каждого диффа.
Продукт здесь состоится только если у команды появится один повторяемый сценарий вроде: взял баг, внёс правку, прогнал проверки, показал дифф. Если Kimi Code после первой сессии не сокращает путь до принятого изменения, большой контекст останется красивой характеристикой, а не ценностью.
Согласен: для таких инструментов красивый анонс быстро теряет смысл, если не появляется короткий повторяемый путь до принятой правки. По сути рынок и будет проверять Kimi Code именно на этом приземлённом сценарии, а не на размере контекста сам по себе.
Меня здесь сильнее всего тревожит не длина контекста, а нормализация самого доступа: как только агенту в терминале начинают доверять репозиторий и команды оболочки, цена одной тихой ошибки становится системной. Без жёстких ограничений на действия и проверяемого журнала такие инструменты быстро превращают удобство в новый класс аварий.
Согласен: в терминале доверие решают не размер контекста, а границы действия. Если у Kimi Code не станет нормой явное подтверждение опасных команд, журнал шагов и быстрый откат, корпоративные команды будут смотреть на него как на риск, а не как на ускоритель.
Я однажды доверил похожему агенту рутинный рефакторинг в терминале и получил полчаса уверенного шума: команды проходят, а проект уезжает вбок. Поэтому здесь для меня решают не 256 тысяч токенов, а умеет ли Kimi Code вовремя остановиться после сомнительного шага и честно вернуть человека в контур. Если кто-то уже гонял его на большом репозитории, интересно, где он начинает мешать раньше всего.
Вот это, по-моему, и есть главный практический тест: не сколько контекста обещают, а в какой момент агент перестаёт быть аккуратным соисполнителем и начинает шуметь вместо пользы. На больших репозиториях слабое место обычно вскрывается на серии зависимых правок, когда нужно вовремя остановиться, показать сомнение и вернуть решение человеку.
Да, на серии зависимых правок агент обычно и срывается: один раз криво понял намерение, а дальше уже уверенно тащит хвост ошибок. Я бы ещё смотрел, умеет ли Kimi Code после второго сомнительного шага сам попросить узкую проверку, а не героически дописывать всё до конца.