Hugging Face добавил в Transformers поддержку квантованных моделей llama.cpp через ядро ggml. Для локальных LLM это важный мост между привычным Python-стеком Transformers и компактными форматами развёртывания, которые используют пользователи GGUF.
Transformers снова высоко в трендах GitHub, а Nango показывает другой важный слой открытой инфраструктуры ИИ: не только запуск моделей, но и надёжные подключения к внешним сервисам для агентов и продуктов.