ADAPTIVE MODEL ORCHESTRATION

Plyrum помогает выбрать правильную модель для каждого шага

В аккаунте вы разрешаете конкретные GPT/Claude модели. В каждом CLI-чате Plyrum будет отдельно спрашивать приоритет: скорость, качество и стоимость.

01

Войдите

Создайте аккаунт и войдите — единый login для сайта и CLI.

02

Выберите модель

На сайте и в CLI доступен один каталог: /api/models и команда /models.

03

Запустите задачу

CLI отправляет запрос в /api/stream/run, пишет lifecycle events и usage.

04

Проверьте стоимость

Billing считает micro-RUB, FX snapshot и canonical_usage.

Model Pool · 19 моделей

Все доступные модели

Каталог синхронизирован с runtime: /api/models и CLI-команда /models возвращают те же данные.

Claude Opus 5
architectочень высокаяxhigh

Флагманская модель для архитектуры, критического ревью и финального синтеза сложных задач.

Плюсы

  • +глубокое рассуждение
  • +сильное ревью и безопасность
  • +два независимых маршрута

Минусы

  • -высокая стоимость
  • -избыточна для простых запросов
Лучше всего: архитектура, P0-аудит, сложные решения и финальная проверка
Reasoning: Используйте xhigh для решений с высокой ценой ошибки, high — для обычного глубокого ревью.
ctx: 200klatency: normaltoolsregion: unknown
Claude Sonnet 5
coderвысокаяhigh

Основная Claude-модель для реализации, планирования и ежедневного инженерного ревью.

Плюсы

  • +сильна в коде
  • +хороший баланс качества и скорости
  • +два независимых маршрута

Минусы

  • -дороже быстрых scout-моделей
  • -для критичного аудита лучше Opus 5
Лучше всего: реализация, рефакторинг, ревью и техническое планирование
Reasoning: High подходит для кода и ревью; medium — для быстрых итераций с понятным контекстом.
ctx: 200klatency: normaltoolsregion: unknown
DeepSeek V4 Flash
scoutнизкаяhigh

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 128klatency: interactivetoolsregion: unknown
DeepSeek V4 Pro
architectвысокаяxhigh

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 1000klatency: normaltoolsregion: unknown
Gemini 3.1 Pro High
architectвысокаяxhigh

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 1000klatency: batchvisiontoolsregion: unknown
Gemini 3.1 Pro Low
plannerвысокаяmedium

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 1000klatency: normalvisiontoolsregion: unknown
Gemini 3.1 Pro Preview
architectвысокаяhigh

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 1000klatency: normalvisiontoolsregion: unknown
Gemini 3.5 Flash
coderсредняяmedium

Быстрая мультимодальная модель для кода, анализа документов и интерактивных задач.

Плюсы

  • +быстрый ответ
  • +длинный контекст
  • +поддерживает изображения на входе

Минусы

  • -не основной выбор для критической архитектуры
  • -качество зависит от сложности задачи
Лучше всего: быстрый кодинг, анализ больших документов, мультимодальные запросы
Reasoning: Medium достаточно для большинства задач; high используйте для сложного кода.
ctx: 1000klatency: interactivevisiontoolsregion: unknown
GLM-5.2
coderвысокаяhigh

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 203klatency: normaltoolsregion: unknown
GPT Image 2
finalizerвысокаяmedium

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 128klatency: normalvisiontoolsregion: unknown
GPT-5.4
coderвысокаяhigh

Рабочая модель для реализации, ревью, планирования и строгих structured outputs.

Плюсы

  • +сильный баланс цена/качество
  • +стабильный JSON
  • +хороша для coding passes

Минусы

  • -дороже mini
  • -для глубокого аудита слабее 5.5 и Opus
Лучше всего: код, ревью, план исправлений, JSON-контракты
Reasoning: Рекомендуется high. Medium подходит для простых правок и быстрых проверок.
ctx: 192klatency: normaltoolsregion: us
GPT-5.4 Mini
scoutнизкаяlow

Дешёвый scout для чтения кодовой базы, извлечения фактов и сжатия контекста.

Плюсы

  • +низкая стоимость
  • +быстрый первый проход
  • +хороша для EvidencePacket

Минусы

  • -не финализировать критичные решения
  • -ниже качество сложного reasoning
Лучше всего: сканирование файлов, краткие сводки, первичная маршрутизация
Reasoning: Рекомендуется low. None включайте для простого извлечения фактов без анализа.
ctx: 128klatency: interactivetoolsregion: us
GPT-5.5
architectочень высокаяxhigh

Лучше всего для архитектуры, сложного анализа, security review и финального синтеза.

Плюсы

  • +самое глубокое рассуждение
  • +сильна в архитектуре и рисках
  • +хороший агрегатор после scouts

Минусы

  • -очень дорогая
  • -избыточна для простых задач
Лучше всего: P0-аудит, архитектурные решения, сложные баги
Reasoning: Рекомендуется xhigh. Снижайте до high, если нужен быстрый черновик без финального решения.
ctx: 256klatency: normaltoolsregion: us
Grok 4.3
architectвысокаяhigh

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 256klatency: normaltoolsregion: unknown
Grok 4.5
architectвысокаяhigh

Сильная универсальная модель для анализа, архитектуры, кода и независимой критики.

Плюсы

  • +сильный анализ
  • +хороша как reviewer
  • +полезна для альтернативного взгляда в council

Минусы

  • -единственный маршрут
  • -выше задержка, чем у Flash-моделей
Лучше всего: архитектура, ревью, сложный анализ и council-проверка
Reasoning: High рекомендуется для анализа и ревью; medium подходит для обычных ответов.
ctx: 256klatency: normaltoolsregion: unknown
Kimi K2.6
architectвысокаяxhigh

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 262klatency: normalvisiontoolsregion: unknown
MiniMax M2.5
scoutсредняяhigh

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 197klatency: interactivetoolsregion: unknown
NVIDIA Nemotron 3 Super
plannerсредняяhigh

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 262klatency: interactivetoolsregion: unknown
Qwen3.6 Plus
coderсредняяhigh

Автоматическая политика Plyrum для выбора модели под риск, бюджет и задержку.

Плюсы

  • +минимум ручной настройки
  • +подходит для CLI и web
  • +использует общий runtime-каталог

Минусы

  • -меньше ручного контроля
  • -зависит от настроенных ключей провайдера
Лучше всего: повседневные задачи через auto-routing
Reasoning: Оставьте рекомендованный уровень; повышайте только для задач с высокой ценой ошибки.
ctx: 128klatency: normalvisiontoolsregion: unknown
plyrum
$ plyrum config --set api_base_url=http://localhost:3000
$ plyrum
/login
/models
/model openai/gpt-5.4
Опиши архитектуру auth и найди риски

Что уже можно использовать

  • Единый login для сайта и CLI на реальных аккаунтах.
  • Модельный каталог с прямым выбором GPT/Claude и account allowlist.
  • Streaming run, lifecycle events, canonical usage и расчёт стоимости.
  • История чатов, возобновление фоновых задач, cost display и context diagnostics в CLI.
Plyrum