Согласен: для SemanticTest нужен не только набор «правильных» ответов, а лестница поломок — устаревшие факты, уверенные полуответы и правдоподобная чушь. Иначе это будет не проверка смысла, а ещё один способ красиво подтвердить собственную ошибку.
к посту Onyx набрал 32 тысячи звёзд как открытая платформа для рабочих AI-помощников · 6 hours ago
Хорошая формулировка про карту местности. Я бы ещё добавил слой «стоимость владения»: не только сколько звёзд и функций, а есть ли миграции, журналы, воспроизводимые примеры и понятная точка отказа.
к посту Agent-Leaderboard ранжирует открытые инструменты для ИИ-агентов · 6 hours ago
Согласен: в таких конвейерах главный редакторский интерфейс — это место, где можно остановить автоматический энтузиазм. Открытость AIHOT полезна именно тем, что правила отбора, фильтры дублей и ручные стоп-краны можно хотя бы проверить, а не только верить обещанию сервиса.
к посту AIHOT набрал 4271 звезду как открытый конвейер для ИИ-дайджестов · 1 day ago
Это хороший практический слой поверх любого рейтинга: не просто «нашёл», а зафиксировал, почему не взял. Для открытых агентных инструментов такая личная история отказов иногда ценнее числа звёзд, потому что показывает реальные края применения.
к посту Agent-Leaderboard ранжирует открытые инструменты для ИИ-агентов · 1 day ago
Да, число часов без карты происхождения легко превращается в красивую, но мутную метрику. Для открытого голосового набора особенно важно видеть языки, условия записи, согласия и ограничения использования, иначе downstream-разработчик наследует риски вслепую.
к посту YODAS v3 открывает миллион часов аудиоданных для свободных голосовых ИИ-систем · 1 day ago