Weave Router

локальный роутер, который сам подбирает LLM под каждый запрос

github.com ↗
 Публичный пост

Что это

Weave Router — прокси-сервер для языковых моделей, который анализирует каждый запрос локальным ONNX-эмбеддером и направляет его к оптимальной модели среди подключённых провайдеров (Anthropic, OpenAI, Gemini, а также open-source модели вроде DeepSeek, Llama, Mistral, Qwen через OpenRouter). Роутер понимает форматы Anthropic Messages, OpenAI Chat Completions и Gemini native, поддерживает стриминг, вызов инструментов и работу с изображениями, а также сохраняет cache_control и расширенное мышление в исходном формате запроса. Заявленная скорость выбора модели — менее 50 мс, экономия на инференсе — 40-70% (по данным разработчиков на трафике Claude Code — до 80-85%).

Для участника клуба это полезно как способ снизить расходы на API при вайб-кодинге и агентных сценариях: достаточно поменять base URL у Claude Code, Codex, Cursor или opencode на адрес роутера (localhost:8080 при self-host или облачный router.workweave.ai), не переписывая промпты и не теряя кэш подсказок благодаря привязке модели к сессии. Подходит тем, кто строит собственные n8n-цепочки или агентов и хочет автоматически отправлять простые задачи на дешёвые модели, а сложные — на топовые, без ручного переключения.

Возможности

  • Автоматический выбор модели под запрос через встроенный ONNX-эмбеддер, менее 50 мс на маршрутизацию
  • Поддержка форматов Anthropic Messages, OpenAI Chat Completions и Google Gemini native
  • Совместимость с Claude Code, Codex, Cursor и opencode через смену base URL
  • Доступ к open-source моделям (DeepSeek, Llama, Mistral, Qwen, Kimi, GLM) через OpenRouter
  • Привязка модели к сессии для сохранения кэша подсказок при повторных запросах
  • Сохранение cache_control, расширенного мышления и вызова инструментов в исходном формате
  • Self-hosted развёртывание в собственном VPC для требований по резидентности данных
  • Шифрование ключей провайдеров на диске и OTLP-трассировка с визуализацией в дашборде

Цена: Self-hosted вариант (GitHub, лицензия ELv2) не требует оплаты Weave, но нужны собственные ключи провайдеров. Есть управляемый облачный сервис router.workweave.ai с единым счётом, но конкретные тарифы и планы на сайте не опубликованы

Откомментируйте первым 👇

😎

Автор поста открыл его для большого интернета, но комментирование и движухи доступны только участникам Клуба

Что вообще здесь происходит?


Войти  или  Вступить в Клуб