Перейти к основному содержимому

Настройка моделей

VibeOS использует два типа слотов моделей:

  • Основная модель — чем думает агент. Каждое пользовательское сообщение, каждый цикл вызова инструмента, каждый потоковый ответ проходит через эту модель.
  • Вспомогательные модели — небольшие дополнительные работы, которые агент разгружает. Сжатие контекста, видение (анализ изображений), обобщение веб-страниц, оценка одобрения, маршрутизация инструментов MCP, генерация названий сеансов и поиск навыков. Каждый из них имеет свой собственный слот и может быть переопределен независимо.

На этой странице описана настройка обоих с панели управления. Если вы предпочитаете файлы конфигурации или CLI, перейдите к Альтернативные методы внизу.

Самый быстрый путь: Портал Ноус

Nous Portal предоставляет более 300 моделей по одной подписке. При новой установке запустите vibeos setup --portal, чтобы войти в систему и установить Nous в качестве провайдера одной командой. Проверьте, что подключено к vibeos portal info.

  • Подписчики портала также получают скидку 10 % от поставщиков услуг, оплачивающих токены.
Схема model: — пустая строка или сопоставление

При новой установке включенная конфигурация по умолчанию имеет model: "" (пустая строка, означающая «еще не настроено»). При первом запуске vibeos setup или vibeos model этот ключ на месте обновляется до сопоставления с подключами provider, default, base_url и api_mode — форма, показанная на этой странице и в profiles.md / configuration.md. Если вы когда-нибудь увидите пустую строку в config.yaml, запустите vibeos model (или нажмите Изменить на панели управления), и VibeOS напишет за вас форму dict.

Страница моделей​

Откройте панель управления и нажмите Модели на боковой панели. Вы получаете два раздела:

  1. Настройки модели — верхняя панель, где вы назначаете модели слотам.
  2. Аналитика использования – ранжированные карточки, показывающие каждую модель, запустившую сеанс в выбранный период, с указанием количества токенов, стоимости и значков возможностей.

Обзор страницы моделей

Верхняя карточка — это панель Настройки модели. В главной строке всегда показано, что агент будет раскручивать для новых сессий. Нажмите Изменить, чтобы открыть окно выбора.

Установка основной модели​

Нажмите Изменить в строке «Основная модель»:

Диалоговое окно выбора модели

В средстве выбора есть два столбца:

  • Слева — проверенные поставщики. Здесь отображаются только те поставщики, которые вы настроили (набор ключей API, OAuth или определенные как настраиваемая конечная точка). Если поставщик отсутствует, перейдите в раздел Ключи и добавьте его учетные данные.
  • Право — список курируемых моделей для выбранного поставщика. Это агентные модели, которые VibeOS рекомендует для этого провайдера, а не необработанный дамп /models (который в OpenRouter включает более 400 моделей, включая TTS, генераторы изображений и средства изменения ранжирования).

Введите в поле фильтра, чтобы сузить список по имени поставщика, пулу или идентификатору модели.

Выберите модель, нажмите Switch, и VibeOS запишет ее в ~/.vibeos/config.yaml в разделе model. Это относится только к новым сеансам — любая вкладка чата, которая у вас уже открыта, продолжает работать в той же модели, с которой она началась. Чтобы выполнить горячую замену текущего чата, используйте внутри него команду /model.

Переключения в середине сеанса и контекстные предупреждения​

Когда вы переключаете модели внутри активного сеанса (выбор модели Herm TUI, vibeos CLI или /model в Telegram/Discord), VibeOS оценивает, будет ли ваше следующее сообщение выполнять предпечатное сжатие контекста для окна новой модели. Если сеанс уже близок к порогу сжатия этой модели или превышает его (см. Сжатие контекста), ответ коммутатора включает предупреждение — тот же путь warning_message, который используется для уведомлений о дорогой модели. Переключение по-прежнему применяется немедленно; сжатие выполняется для первого сообщения пользователя после переключения, прежде чем модель ответит.

Установка вспомогательных моделей​

Нажмите Показать вспомогательные, чтобы отобразить 11 ячеек для задач:

Вспомогательная панель развернута

Для каждой вспомогательной задачи по умолчанию используется auto — это означает, что VibeOS также использует вашу основную модель для этого задания. Если этот маршрут недоступен или возникает сбой в стиле емкости, auto следует за любой конкретной задачей auxiliary.<task>.fallback_chain, затем по основной цепочке fallback_providers / fallback_model, а затем по встроенной вспомогательной цепочке обнаружения VibeOS. Отмените конкретную задачу, если вам нужна более дешевая или быстрая модель для подработки.

Общие шаблоны переопределения​

ЗадачаКогда переопределить
Титул GenПочти всегда. Флэш-модель стоимостью 0,10 доллара за миллион записывает названия сессий так же хорошо, как и Opus. Конфигурация по умолчанию устанавливает для этого параметра значение google/gemini-3-flash-preview на OpenRouter.
ВидениеКогда в вашей основной модели отсутствует поддержка машинного зрения. Наведите его на google/gemini-2.5-flash или gpt-4o-mini.
СжатиеКогда вы сжигаете жетоны рассуждений на Opus/M2.7, просто чтобы обобщить контекст. Модель быстрого чата выполняет работу за 1/50 стоимости.
ОдобрениеДля approval_mode: smart — быстрая/дешевая модель (haiku, flash, gpt-5-mini) решает, следует ли автоматически утверждать команды с низким уровнем риска. Дорогие модели здесь – мусор.
Веб-извлечениеКогда вы часто используете web_extract. Та же логика, что и при сжатии — обобщение не требует рассуждений.
Центр навыковvibeos skills search использует это. Обычно нормально при auto.
MCPМаршрутизация инструмента MCP. Обычно нормально при auto.
Спецификатор сортировкиНаправляет спецификатор сортировки Канбана (vibeos kanban specify), который превращает грубую однострочную строку в конкретную спецификацию. Дешевая, функциональная модель работает хорошо.
Разлагатель КанбанаМаршруты декомпозиции задач Канбана — разбивает задачу сортировки на граф дочерних задач для профилей специалистов.
Описатель профиляФормирование профиля-описания маршрутов (vibeos profile describe --auto/кнопка автогенерации приборной панели). Короткий и дешевый звонок.
КураторНаправляет проход проверки использования навыков куратора. Может работать несколько минут над моделями рассуждений, поэтому часто стоит использовать более дешевую дополнительную модель.

Переопределение для каждой задачи​

Нажмите Изменить в любой вспомогательной строке. Откроется то же средство выбора, то же поведение — выберите поставщика + модель, нажмите «Переключить». Строка обновляется и показывает provider · model вместо auto (use main model).

Сбросить все в автоматический режим​

Если вы перенастроили и хотите начать заново, нажмите Сбросить все в автоматический режим вверху вспомогательного раздела. Каждый слот возвращается к использованию вашей основной модели.

Ярлык «Использовать как»​

На каждой карточке модели на странице есть раскрывающийся список Использовать как. Это быстрый путь — выберите модель, которую вы видите в своей аналитике, нажмите Использовать как и одним щелчком мыши назначьте ее основному слоту или любой конкретной вспомогательной задаче:

Использовать как раскрывающийся список

В раскрывающемся списке есть:

  • Основная модель — то же самое, что нажать «Изменить» в главной строке.
  • Все вспомогательные задачи — назначает эту модель сразу на все 11 дополнительных слотов. Полезно, когда вам просто нужна дополнительная работа на дешевой флеш-модели.
  • Индивидуальные параметры задачи — «Видение», «Веб-извлечение», «Сжатие» и т. д. Назначенная в данный момент модель для каждой задачи отмечена current.

Карты помечаются значком main или aux · <task>`, когда они в данный момент чему-то назначены — так что вы можете сразу увидеть, какая из ваших исторических моделей куда подключена.

Что записывается в config.yaml​

При сохранении через панель управления VibeOS записывает в ~/.vibeos/config.yaml:

Основная модель:

model:
provider: openrouter
default: anthropic/claude-opus-4.7
base_url: '' # cleared on provider switch
api_mode: chat_completions

Вспомогательное переопределение (пример — видение на Gemini-Flash):

auxiliary:
vision:
provider: openrouter
model: google/gemini-2.5-flash
base_url: ''
api_key: ''
timeout: 120
extra_body: {}
download_timeout: 30

Вспомогательный режим в автоматическом режиме (по умолчанию):

auxiliary:
compression:
provider: auto
model: ''
base_url: ''
# ... other fields unchanged

provider: auto с model: '' указывает VibeOS использовать основную модель для этой задачи, сохраняя при этом резервную политику, если основной маршрут не может обслуживать вспомогательный вызов.

Дополнительные цепочки отступлений для конкретных задач находятся в рамках одной и той же вспомогательной задачи:

auxiliary:
title_generation:
provider: auto
model: ''
fallback_chain:
- provider: openrouter
model: inclusionai/ring-2.6-1t:free

Когда fallback_chain отсутствует, auto использует цепочку fallback_providers верхнего уровня перед встроенной вспомогательной цепочкой обнаружения.

Когда это вступит в силу?​

  • CLI (vibeos chat): следующий вызов vibeos chat.
  • Шлюз (Telegram, Discord, Slack и т. д.): следующий новый сеанс. Существующие сеансы сохраняют свою модель. Перезапустите шлюз (vibeos gateway restart), если вы хотите, чтобы все сеансы приняли изменения.
  • Вкладка чата на панели управления (/chat): следующий новый PTY. Открытый в данный момент чат сохраняет свою модель — используйте внутри него /model для горячей замены.

Изменения никогда не делают недействительными кэши подсказок во время запущенных сеансов. Это намеренно: замена основной модели внутри сеанса требует сброса кэша (системное приглашение содержит контент, специфичный для модели), и мы резервируем это для явной slash-команды /model внутри чата.

Поиск неисправностей​

«Нет проверенных поставщиков» в средстве выбора​

VibeOS указывает поставщика только в том случае, если у него есть рабочие учетные данные. Проверьте Ключи на боковой панели: вы должны увидеть одно из следующих значений: ключ API, успешный OAuth или собственный URL-адрес конечной точки. Если нужного вам провайдера нет, запустите vibeos setup, чтобы подключить его, или перейдите в раздел Ключи и добавьте переменную env.

Основная модель не изменилась в моем беговом чате​

Ожидал. Приборная панель записывает config.yaml, который считываются новыми сеансами. Открытый в данный момент чат — это процесс живого агента — он сохраняет любую модель, с которой был создан. Используйте /model <name>` внутри чата, чтобы выполнить горячую замену этого конкретного сеанса.

Вспомогательное переопределение «не вступило в силу»​

Три вещи, которые нужно проверить:

  1. Вы начали новый сеанс? Существующие чаты не перечитывают конфигурацию.
  2. Разрешено ли для provider значение, отличное от auto? Если в поле указано auto, задача по-прежнему использует вашу основную модель. Нажмите Изменить и выберите реального провайдера.
  3. Аутентифицирован ли поставщик? Если вы назначили minimax задаче, но у вас нет ключа MiniMax API, эта задача возвращается к значению по умолчанию openrouter и регистрирует предупреждение в agent.log.

Я выбрал модель, но VibeOS переключила меня на провайдера​

В OpenRouter (или любом агрегаторе) имена голых моделей сначала разрешаются внутри агрегатора. Таким образом, claude-sonnet-4 на OpenRouter становится anthropic/claude-sonnet-4.6, оставаясь при вашей аутентификации OpenRouter. Но если вы наберете claude-sonnet-4 при встроенной аутентификации Anthropic, он останется как claude-sonnet-4-6. Если вы видите неожиданное переключение поставщика, убедитесь, что ваш текущий поставщик соответствует вашим ожиданиям — средство выбора всегда показывает текущий основной поставщик в верхней части диалогового окна.

Альтернативные методы​

Slash-команда CLI​

Внутри любого сеанса vibeos chat:

/model gpt-5.4 --provider openrouter             # session-only
/model gpt-5.4 --provider openrouter --global # also persists to config.yaml

--global делает то же самое, что и кнопка Изменить на информационной панели, плюс переключает текущий сеанс на месте.

Пользовательские псевдонимы​

Определите свои собственные короткие имена для моделей, к которым вы часто обращаетесь, а затем используйте /model <alias>` в CLI или любой платформе обмена сообщениями. Существует два эквивалентных формата — выберите тот, который соответствует вашему рабочему процессу.

Канонический (верхний уровень model_aliases:) — полный контроль над провайдером + base_url:

# ~/.vibeos/config.yaml
model_aliases:
fav:
model: claude-sonnet-4.6
provider: anthropic
grok:
model: grok-4
provider: x-ai

Короткая строковая форма (model.aliases.&lt;name&gt;: provider/model) — удобна из оболочки, поскольку vibeos config set записывает только скалярные значения, но не может содержать специальный base_url:

vibeos config set model.aliases.fav anthropic/claude-opus-4.6
vibeos config set model.aliases.grok x-ai/grok-4

Оба пути используют один и тот же загрузчик (vibeos_cli/model_switch.py). Записи, объявленные в model_aliases:, имеют приоритет над записями model.aliases: с тем же именем.

Затем /model fav или /model grok в чате. Псевдонимы пользователей дублируют встроенные короткие имена (sonnet, kimi, opus и т. д.). Полную информацию см. в разделе Псевдонимы пользовательских моделей.

vibeos model субкоманда​

vibeos model            # Interactive provider + model picker (the canonical way to switch defaults)

vibeos model поможет вам выбрать поставщика, пройти аутентификацию (потоки OAuth открывают браузер; поставщики ключей API запрашивают ключ), а затем выбрать конкретную модель из курируемого каталога этого поставщика. Выбор записывается в model.provider и model.model в ~/.vibeos/config.yaml.

Чтобы составить список поставщиков/моделей без запуска средства выбора, используйте панель мониторинга или конечные точки REST ниже. Чтобы проверить, что именно CLI будет использовать прямо сейчас: vibeos config show | grep '^model\.' и vibeos status.

Прямое редактирование конфигурации​

Отредактируйте ~/.vibeos/config.yaml и перезапустите все, что его читает. Полную схему см. в Справочнике по конфигурации.

ОТДЫХ API​

Панель мониторинга использует три конечные точки. Полезно для сценариев:

# List authenticated providers + curated model lists
curl -H "X-VibeOS-Session-Token: $TOKEN" http://localhost:PORT/api/model/options

# Read current main + auxiliary assignments
curl -H "X-VibeOS-Session-Token: $TOKEN" http://localhost:PORT/api/model/auxiliary

# Set the main model
curl -X POST -H "Content-Type: application/json" -H "X-VibeOS-Session-Token: $TOKEN" \
-d '{"scope":"main","provider":"openrouter","model":"anthropic/claude-opus-4.7"}' \
http://localhost:PORT/api/model/set

# Override a single auxiliary task
curl -X POST -H "Content-Type: application/json" -H "X-VibeOS-Session-Token: $TOKEN" \
-d '{"scope":"auxiliary","task":"vision","provider":"openrouter","model":"google/gemini-2.5-flash"}' \
http://localhost:PORT/api/model/set

# Assign one model to every auxiliary task
curl -X POST -H "Content-Type: application/json" -H "X-VibeOS-Session-Token: $TOKEN" \
-d '{"scope":"auxiliary","task":"","provider":"openrouter","model":"google/gemini-2.5-flash"}' \
http://localhost:PORT/api/model/set

# Reset all auxiliary tasks to auto
curl -X POST -H "Content-Type: application/json" -H "X-VibeOS-Session-Token: $TOKEN" \
-d '{"scope":"auxiliary","task":"__reset__","provider":"","model":""}' \
http://localhost:PORT/api/model/set

Токен сеанса вводится в HTML-код панели управления при запуске и меняется при каждом перезапуске сервера. Загрузите его из инструментов разработчика браузера (window.__VIBEOS_SESSION_TOKEN__ или устаревшей версии window.__VIBEOS_SESSION_TOKEN__), если вы пишете сценарии для работающей информационной панели. Заголовок X-VibeOS-Session-Token также принимается для совместимости с VibeOS.