2 мин чтения

JEV Model Router выбирает модели в Claude Code

Claude CodeJEV Model Routerмаршрутизация моделей

JEV Model Router добавляет в Claude Code слой маршрутизации: для каждого запроса он выбирает модель сабагента и уровень reasoning effort, а основную модель фиксирует при старте сессии, чтобы не сбивать кеш. Мод подключает Jev через TypeSafe API или Vercel AI Gateway и ставится одной командой npx.

Что именно маршрутизирует JEV

Для меня ключевая идея JEV Model Router не в доступе к еще одной модели, а в разделении решений внутри Claude Code. Роутер выбирает модель сабагента для каждого запроса, уровень reasoning effort и только при старте сессии определяет основную модель, чтобы последующие переключения не ломали кеш.

Согласно описанию мода JEV Model Router в документации проекта Claude Code Templates, Jev получает состояние задачи и преобразует его в типизированное решение о маршрутизации. Это не свободный текстовый совет для агента, а отдельный слой выбора перед продолжением работы Claude Code. На момент опубликованного описания поддерживались два пути подключения: TypeSafe API и Vercel AI Gateway.

  • Для TypeSafe используется аккаунт и параметр typesafeApiKey.
  • Для Vercel AI Gateway указан параметр gatewayApiKey.
  • Через шлюз Jev доступен с идентификатором модели typesafe-ai/jev.

Мод устанавливается командой npx claude-code-templates@latest --mod productivity/jev-model-router. В доступной проектной документации также упомянуты Node.js 18+ или 20+, Claude Code 2.1.259+ и переменная CLAUDE_CODE_ENABLE_FUNCTION_HOOKS=1. Это именно дополнение для Claude Code, а не самостоятельная модельная точка доступа.

Дата исходного анонса не указана, поэтому я воспринимаю его как разбор доступной конфигурации, а не как подтверждение свежего релиза. Версии и требования здесь отражают состояние документации на момент ее публикации.

Где появляется практический выигрыш

Главный выигрыш возникает на смешанных задачах, где одному запросу достаточно дешевой модели, а другому нужен более сильный reasoning. Вместо единого дорогого режима на всю сессию сабагенты получают разные модели, а уровень рассуждений подстраивается под задачу. Фиксация основной модели дополнительно защищает кеш от постоянной смены начального состояния.

Инженерно это выглядит содержательнее обычного обещания «умной маршрутизации», но результат целиком зависит от качества классификации. Я бы первым проверял ошибки на границах: не отправляет ли роутер сложную задачу слабой модели, насколько стабилен выбор при похожих формулировках и не съедает ли дополнительный вызов ожидаемую экономию токенов.

Есть и эксплуатационная цена: появляется внешний слой принятия решений, ключи провайдера и зависимость от доступности шлюза или TypeSafe API. Вся идея держится не на количестве подключенных моделей, а на точности одного маленького решения: насколько хорошо Jev понимает, когда экономить уже нельзя.

Ранее мы разбирали, как параллельные агенты Claude Code могут улучшать ревью PR, контролируя гонки и стоимость моделей. Такой дизайн процесса хорошо дополняет плагин-роутер, который назначает подходящую модель Claude для каждой задачи агента.