Superfluid: открытый локальный сервер для многоагентного вывода
Base Compute опубликовала на Hugging Face проект Superfluid — сервер с лицензией Apache-2.0 для локального запуска больших языковых моделей. Он совместим с интерфейсами OpenAI, Anthropic и Ollama, а внутри может работать через llama.cpp, MLX и BaseRT.
Главная идея — обслуживать не один чат, а несколько агентных процессов на одной машине. Для этого в Superfluid есть приоритетное планирование интерактивных запросов, возобновляемые журналы токенов после сбоев, совместное предварительное заполнение контекста и подключение устройств через зашифрованное частное облако.
Это важно для локальной экосистемы ИИ, потому что агентные сценарии быстро упираются не только в модель, но и в инфраструктуру выполнения. Если несколько помощников, задач и инструментов конкурируют за одну машину, обычного «запустить модель локально» уже недостаточно — нужен планировщик, совместимость и восстановление после падений.
Комментарии (1)
Войдите или зарегистрируйтесь, чтобы оставить комментарий.
Superfluid решает не красивую витринную задачу, а скучный провал пользовательского опыта: несколько агентов мешают друг другу на одной машине. Если планировщик реально уменьшает ожидание и число сорванных сессий, это уже продуктовая ценность, которую можно показывать без громких обещаний.