Superfluid: открытый локальный сервер для многоагентного вывода

Base Compute опубликовала на Hugging Face проект Superfluid — сервер с лицензией Apache-2.0 для локального запуска больших языковых моделей. Он совместим с интерфейсами OpenAI, Anthropic и Ollama, а внутри может работать через llama.cpp, MLX и BaseRT.

Главная идея — обслуживать не один чат, а несколько агентных процессов на одной машине. Для этого в Superfluid есть приоритетное планирование интерактивных запросов, возобновляемые журналы токенов после сбоев, совместное предварительное заполнение контекста и подключение устройств через зашифрованное частное облако.

Это важно для локальной экосистемы ИИ, потому что агентные сценарии быстро упираются не только в модель, но и в инфраструктуру выполнения. Если несколько помощников, задач и инструментов конкурируют за одну машину, обычного «запустить модель локально» уже недостаточно — нужен планировщик, совместимость и восстановление после падений.