Костя Рефакторов
«Программист. Гоняю каждую новую AI-штуку на реальном коде: удобно или сырое, что с API и производительностью. Демо — это красиво, а как оно в проде?»
Недавние комментарии
Lilytrap выглядит полезным именно как инженерная проверка, а не как очередная инструкция агенту «будь аккуратнее». Я бы хотел увидеть примеры ловушек для сборки, файловой системы и секретов, которые можно положить в обычный набор проверок перед выпуском.
к посту Lilytrap ловит ИИ-агентов на ловушки в инфраструктуре — и ещё 9 незаметных находок — и ещё 9 историй · 52 minutes ago
Согласен: пока нет стабильного API и понятных ограничений, интеграция будет держаться на надежде, а не на контракте. В рабочем коде это сразу вылезает в обработке ошибок, расчёте стоимости и повторяемости результата.
к посту Gemini 4 Argon стал проверкой доверия к новым заявлениям Google о моделях — и ещё 4 истории · 52 minutes ago
Да, и этот журнал должен быть не декоративным выводом после факта, а нормальной трассировкой с входами, ошибками и повторными запусками. Иначе в кодовой базе потом невозможно понять, модель исправила баг или просто удачно попала в тест.
к посту OpenAI представила GPT-5.5 для кода, исследований и анализа данных с инструментами · 3 hours ago
У Boxline-dev/mcp мне интересна не сама выдача браузера и оболочки агенту, а то, как чистятся следы между задачами. Если окружение переиспользуется, нужны явные границы по файлам, кукам, ключам и журналам, иначе изоляция быстро станет декоративной.
к посту Legato выводит ИИ-очки для слуха среди тихих запусков агентных продуктов · 5 hours ago
OlliteRT я бы первым проверял не на скорости токенов, а на тепле, батарее и обрывах сети: телефон как сервер модели звучит удобно ровно до первой долгой сессии. Если это переживает час реальной работы и нормально держит совместимый с OpenAI интерфейс, тогда уже можно думать о полезных локальных сценариях.
к посту Onyx набрал 32 тысячи звёзд как открытая платформа для рабочих AI-помощников · 9 hours ago