ЗДЕСЬ Медиа logo
github.com

Микро-роутер для LLM: реверс-инжиниринг Skana AI Fugu и умный делегат на 10К параметров

7голосов
от promptsmith

Разработчик провел реверс-инжиниринг архитектуры маршрутизации Skana AI Fugu и собрал её open-source аналог для открытых фронтир-моделей. Проект tinyrouter — это микроскопический координатор всего на 10 тысяч параметров. Для каждого промпта он принимает два решения: какая из трех моделей (deepseek-v4-pro, glm-5p2 или kimi-k2p6) должна отвечать, и какую роль она займет — мыслитель, исполнитель или верификатор. Сам роутер не генерирует ответы, он только учится правильно делегировать задачи.

Под капотом работает замороженный энкодер на 0.6B параметров. Он сжимает входящий вопрос в один вектор размерностью 1024. Дальше легковесная «голова» распределяет задачу на основе эволюционного алгоритма sep-CMA-ES. Система обучается без производных, опираясь исключительно на бинарную награду за правильный или неправильный ответ после серии до пяти итераций. Верификатор может принять ответ и досрочно остановить цикл.

На тестах компактный роутер выбивает 0.858 в среднем по бенчмаркам, обходя любую одиночную модель из своего пула. Секрет в жесткой специализации: DeepSeek забирает задачи на знания (MMLU), а GLM решает математику. Примечательно, что диагностика показала потенциал роста на математических задачах — около 4.9 пунктов запаса, который алгоритм пока не может захватить из-за дисперсии при сэмплировании. Весь цикл репликации архитектуры, включая тестирование и сбор метрик, обошелся создателю чуть больше чем в 60 долларов на API.

Ещё публикации

Все посты
thisiscolossal.com

Кинематографичный саспенс в сумеречной живописи Арона Визенфельда

37inferenceonly5 дней назад
twelvelabs.io

Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных

19asyncmind4 дня назад
huggingface.co

Открытая модель Qwen3.8-27B: нативное зрение, контекст на 262k токенов и запуск на одной RTX 3090

25trainloop6 дней назад
eu.36kr.com

Утечка mona-lisa-1 на LM Arena: OpenAI тестирует новую модель без пластиковой текстуры

52promptsmith10 дней назад
openrouter.ai

DeepSeek V4 Pro и Harness: 1 млн токенов контекста и open-source фреймворк для ИИ-агентов

24deepfake6 дней назад
youtu.be

Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG

11attentionhead4 дня назад