Свежие личные истории про ИИ на этой неделе особенно хорошо показывают одну вещь: люди уже не просто пробуют модели, а выстраивают вокруг них правила, тормоза и проверки. Ниже — десять случаев, где польза ИИ видна рядом с очень человеческими страхами: забыть контекст, сломать платежи, довериться рейтингу или пустить агента слишком далеко.

Четыре строки перед тем, как ИИ-агент тронет репозиторий

Автор RoutineKit описывает короткий ритуал, который пережил месяцы сокращений: перед задачей для агента он пишет, для кого работа, что считается готовым, чего нельзя делать и какой следующий шаг нужен. Ценность истории в практическом шраме: за этими четырьмя строками стоят сорванные ожидания, случайные миграции, лишние зависимости и потерянный контекст после возвращения к задаче. Это не теория подсказок, а маленькая страховка перед тем, как агент получает доступ к коду.

Память Mycelium помнила важное, но забывала вчерашнюю работу

Leon Odor строил Mycelium как систему памяти, где связи усиливаются от использования, а ненужное постепенно слабеет. В обычной разработке выяснилось, что такая память отлично поднимает давние важные узлы, но плохо помогает продолжить вчерашнюю работу. Вместо бесконечной настройки одного рейтинга автор разделил два режима: вспоминать важное и вспоминать недавнее.

Claude Code принял разрешённое изменение памяти за внедрение чужой инструкции

PersistentStateAudit описывает узкий, но показательный случай с Claude Code 2.1.251 и постоянной автоматической памятью. После того как Codex изменил файл памяти с разрешения пользователя, Claude Code якобы счёл это внедрением чужой инструкции, потому что изменение прошло не через него. История важна для всех, кто собирает несколько агентов вокруг одного состояния: мало знать, кто прав, нужно ещё доказать происхождение каждого изменения.

Один и тот же сервис коротких ссылок прошёл через Claude Code, Cursor и Codex

Anshul Rajpal дал трём инструментам одну и ту же задачу: сервис коротких ссылок с API, Redis, Docker Compose и тестами. Его вывод получился полезнее обычного сравнения моделей: Claude Code дал более чистый код, Cursor быстрее дошёл до результата, но ошибся с настройкой Redis, а Codex обошёлся дешевле, зато потребовал больше ручных правок. Это хорошая история про реальный выбор инструмента, где скорость, цена и качество не сходятся в одну колонку.

Claude Code пришлось доказать платежи на настоящей инфраструктуре

Indie Rob изменил определение готовности для релиза облачного сервиса: агент должен был пройти не только тесты, но и реальный путь через Render и пробные платежи Paddle. Именно внешняя проверка обнаружила ошибку параллельной обработки в веб-перехватчиках оплаты. История напоминает: когда дело касается денег, «тесты зелёные» ещё не значит «можно выпускать».

Пять агентов вместо одной бесконечной беседы

Cristián Labra рассказывает, как ограничения по квотам, разросшиеся диалоги и ручное копирование контекста привели его к локальному рабочему процессу с несколькими ролями в VS Code на Arch Linux. Он не продаёт полную автономность: у него есть исполнитель, проверяющий, исследователь и вспомогательные роли, а разрешения и следы действий становятся частью самой системы. Самая сильная мысль здесь — ИИ-работа должна оставлять протокол, иначе она превращается в длинное совещание без записи.

Голосовой учебный помощник вырос из десятидневного эксперимента

Raja Vaishnavi за десять дней VoiceForBharat начала с голосового агента и довела идею до учебного помощника с памятью, упражнениями, аналитикой, передачей человеку и отдельным математическим агентом. Эта история интересна не набором функций, а сменой точки входа: если человек не начинает с клавиатуры и длинного текста, образовательный ИИ должен иначе объяснять, проверять и поддерживать.

Разработчица вела Claude Code через три архитектурных решения и всё равно ловила ошибку в продакшене

Alejandra Rocha Ovalles описывает работу над Retro Dynamics Agent: проектирование, реализацию, отладку в продакшене и документацию вместе с Claude Code. Главный урок не в том, что агент написал код, а в том, что архитектурные решения оставались за человеком, планы проверялись почти как запросы на изменение кода, а настоящая среда всё равно нашла несовпадение зависимости и файла фиксации версий.

Неделя с Kimi K3 вместо тестов на витрине

Автор вернулся к Kimi K3 после первых впечатлений и несколько дней использовал модель в обычной работе, а не только в синтетических заданиях. Для выпуска это полезная история именно из-за бытового угла: запускная эйфория быстро меркнет, когда инструмент должен держаться в ежедневных задачах. Такой формат обзора лучше показывает, где полезность модели расходится с обещаниями на странице продукта.

Claude Code собрал самохостинговый ИИ-стек без присмотра — и показал, что ломается

Автор хотел получить полностью самохостинговый стек с несколькими службами Docker для локальных моделей и шлюзом к большим языковым моделям. Агент быстро собрал основу, но дальше началась реальность: сеть, настройки, связность служб и эксплуатационные мелочи потребовали пяти важных исправлений. Это честная история про автоматизацию инфраструктуры: скорость впечатляет, но именно окружение решает, можно ли этим пользоваться завтра.