Настройка моделей
VibeOS использует два типа слотов моделей:
- Основная модель — чем думает агент. Каждое пользовательское сообщение, каждый цикл вызова инструмента, каждый потоковый ответ проходит через эту модель.
- Вспомогательные модели — небольшие дополнительные работы, которые агент разгружает. Сжатие контекста, видение (анализ изображений), обобщение веб-страниц, оценка одобрения, маршрутизация инструментов MCP, генерация названий сеансов и поиск навыков. Каждый из них имеет свой собственный слот и может быть переопределен независимо.
На этой странице описана настройка обоих с панели управления. Если вы предпочитаете файлы конфигурации или CLI, перейдите к Альтернативные методы внизу.
Nous Portal предоставляет более 300 моделей по одной подписке. При новой установке запустите vibeos setup --portal, чтобы войти в систему и установить Nous в качестве провайдера одной командой. Проверьте, что подключено к vibeos portal info.
- Подписчики портала также получают скидку 10 % от поставщиков услуг, оплачивающих токены.
model: — пустая строка или сопоставлениеПри новой установке включенная конфигурация по умолчанию имеет model: "" (пустая строка, означающая «еще не настроено»). При первом запуске vibeos setup или vibeos model этот ключ на месте обновляется до сопоставления с подключами provider, default, base_url и api_mode — форма, показанная на этой странице и в profiles.md / configuration.md. Если вы когда-нибудь увидите пустую строку в config.yaml, запустите vibeos model (или нажмите Изменить на панели управления), и VibeOS напишет за вас форму dict.
Страница моделей
Откройте панель управления и нажмите Модели на боковой панели. Вы получаете два раздела:
- Настройки модели — верхняя панель, где вы назначаете модели слотам.
- Аналитика использования – ранжированные карточки, показывающие каждую модель, запустившую сеанс в выбранный период, с указанием количества токенов, стоимости и значков возможностей.

Верхняя карточка — это панель Настройки модели. В главной строке всегда показано, что агент будет раскручивать для новых сессий. Нажмите Изменить, чтобы открыть окно выбора.
Установка основной модели
Нажмите Изменить в строке «Основная модель»:

В средстве выбора есть два столбца:
- Слева — проверенные поставщики. Здесь отображаются только те поставщики, которые вы настроили (набор ключей API, OAuth или определенные как настраиваемая конечная точка). Если поставщик отсутствует, перейдите в раздел Ключи и добавьте его учетные данные.
- Право — список курируемых моделей для выбранного поставщика. Это агентные модели, которые VibeOS рекомендует для этого провайдера, а не необработанный дамп
/models(который в OpenRouter включает более 400 моделей, включая TTS, генераторы изображений и средства изменения ранжирования).
Введите в поле фильтра, чтобы сузить список по имени поставщика, пулу или идентификатору модели.
Выберите модель, нажмите Switch, и VibeOS запишет ее в ~/.vibeos/config.yaml в разделе model. Это относится только к новым сеансам — любая вкладка чата, которая у вас уже открыта, продолжает работать в той же модели, с которой она началась. Чтобы выполнить горячую замену текущего чата, используйте внутри него команду /model.
Переключения в середине сеанса и контекстные предупреждения
Когда вы переключаете модели внутри активного сеанса (выбор модели Herm TUI, vibeos CLI или /model в Telegram/Discord), VibeOS оценивает, будет ли ваше следующее сообщение выполнять предпечатное сжатие контекста для окна новой модели. Если сеанс уже близок к порогу сжатия этой модели или превышает его (см. Сжатие контекста), ответ коммутатора включает предупреждение — тот же путь warning_message, который используется для уведомлений о дорогой модели. Переключение по-прежнему применяется немедленно; сжатие выполняется для первого сообщения пользователя после переключения, прежде чем модель ответит.
Установка вспомогательных моделей
Нажмите Показать вспомогательные, чтобы отобразить 11 ячеек для задач:

Для каждой вспомогательной задачи по умолчанию используется auto — это означает, что VibeOS также использует вашу основную модель для этого задания. Если этот маршрут недоступен или возникает сбой в стиле емкости, auto следует за любой конкретной задачей auxiliary.<task>.fallback_chain, затем по основной цепочке fallback_providers / fallback_model, а затем по встроенной вспомогательной цепочке обнаружения VibeOS. Отмените конкретную задачу, если вам нужна более дешевая или быстрая модель для подработки.
Общие шаблоны переопределения
| Задача | Когда переопределить |
|---|---|
| Титул Gen | Почти всегда. Флэш-модель стоимостью 0,10 доллара за миллион записывает названия сессий так же хорошо, как и Opus. Конфигурация по умолчанию устанавливает для этого параметра значение google/gemini-3-flash-preview на OpenRouter. |
| Видение | Когда в вашей основной модели отсутствует поддержка машинного зрения. Наведите его на google/gemini-2.5-flash или gpt-4o-mini. |
| Сжатие | Когда вы сжигаете жетоны рассуждений на Opus/M2.7, просто чтобы обобщить контекст. Модель быстрого чата выполняет работу за 1/50 стоимости. |
| Одобрение | Для approval_mode: smart — быстрая/дешевая модель (haiku, flash, gpt-5-mini) решает, следует ли автоматически утверждать команды с низким уровнем риска. Дорогие модели здесь – мусор. |
| Веб-извлечение | Когда вы часто используете web_extract. Та же логика, что и при сжатии — обобщение не требует рассуждений. |
| Центр навыков | vibeos skills search использует это. Обычно нормально при auto. |
| MCP | Маршрутизация инструмента MCP. Обычно нормально при auto. |
| Спецификатор сортировки | Направляет спецификатор сортировки Канбана (vibeos kanban specify), который превращает грубую однострочную строку в конкретную спецификацию. Дешевая, функциональная модель работает хорошо. |
| Разлагатель Канбана | Маршруты декомпозиции задач Канбана — разбивает задачу сортировки на граф дочерних задач для профилей специалистов. |
| Описатель профиля | Формирование профиля-описания маршрутов (vibeos profile describe --auto/кнопка автогенерации приборной панели). Короткий и дешевый звонок. |
| Куратор | Направляет проход проверки использования навыков куратора. Может работать несколько минут над моделями рассуждений, поэтому часто стоит использовать более дешевую дополнительную модель. |
Переопределение для каждой задачи
Нажмите Изменить в любой вспомогательной строке. Откроется то же средство выбора, то же поведение — выберите поставщика + модель, нажмите «Переключить». Строка обновляется и показывает provider · model вместо auto (use main model).
Сбросить все в автоматический режим
Если вы перенастроили и хотите начать заново, нажмите Сбросить все в автоматический режим вверху вспомогательного раздела. Каждый слот возвращается к использованию вашей основной модели.
Ярлык «Использовать как»
На каждой карточке модели на странице есть раскрывающийся список Использовать как. Это быстрый путь — выберите модель, которую вы видите в своей аналитике, нажмите Использовать как и одним щелчком мыши назначьте ее основному слоту или любой конкретной вспомогательной задаче:

В раскрывающемся списке есть:
- Основная модель — то же самое, что нажать «Изменить» в главной строке.
- Все вспомогательные задачи — назначает эту модель сразу на все 11 дополнительных слотов. Полезно, когда вам просто нужна дополнительная работа на дешевой флеш-модели.
- Индивидуальные параметры задачи — «Видение», «Веб-извлечение», «Сжатие» и т. д. Назначенная в данный момент модель для каждой задачи отмечена
current.
Карты помечаются значком main или aux · <task>`, когда они в данный момент чему-то назначены — так что вы можете сразу увидеть, какая из ваших исторических моделей куда подключена.
Что записывается в config.yaml
При сохранении через панель управления VibeOS записывает в ~/.vibeos/config.yaml:
Основная модель:
model:
provider: openrouter
default: anthropic/claude-opus-4.7
base_url: '' # cleared on provider switch
api_mode: chat_completions
Вспомогательное переопределение (пример — видение на Gemini-Flash):
auxiliary:
vision:
provider: openrouter
model: google/gemini-2.5-flash
base_url: ''
api_key: ''
timeout: 120
extra_body: {}
download_timeout: 30
Вспомогательный режим в автоматическом режиме (по умолчанию):
auxiliary:
compression:
provider: auto
model: ''
base_url: ''
# ... other fields unchanged
provider: auto с model: '' указывает VibeOS использовать основную модель для этой задачи, сохраняя при этом резервную политику, если основной маршрут не может обслуживать вспомогательный вызов.
Дополнительные цепочки отступлений для конкретных задач находятся в рамках одной и той же вспомогательной задачи:
auxiliary:
title_generation:
provider: auto
model: ''
fallback_chain:
- provider: openrouter
model: inclusionai/ring-2.6-1t:free
Когда fallback_chain отсутствует, auto использует цепочку fallback_providers верхнего уровня перед встроенной вспомогательной цепочкой обнаружения.
Когда это вступит в силу?
- CLI (
vibeos chat): следующий вызовvibeos chat. - Шлюз (Telegram, Discord, Slack и т. д.): следующий новый сеанс. Существующие сеансы сохраняют свою модель. Перезапустите шлюз (
vibeos gateway restart), если вы хотите, чтобы все сеансы приняли изменения. - Вкладка чата на панели управления (
/chat): следующий новый PTY. Открытый в данный момент чат сохраняет свою модель — используйте внутри него/modelдля горячей замены.
Изменения никогда не делают недействительными кэши подсказок во время запущенных сеансов. Это намеренно: замена основной модели внутри сеанса требует сброса кэша (системное приглашение содержит контент, специфичный для модели), и мы резервируем это для явной slash-команды /model внутри чата.
Поиск неисправностей
«Нет проверенных поставщиков» в средстве выбора
VibeOS указывает поставщика только в том случае, если у него есть рабочие учетные данные. Проверьте Ключи на боковой панели: вы должны увидеть одно из следующих значений: ключ API, успешный OAuth или собственный URL-адрес конечной точки. Если нужного вам провайдера нет, запустите vibeos setup, чтобы подключить его, или перейдите в раздел Ключи и добавьте переменную env.
Основная модель не изменилась в моем беговом чате
Ожидал. Приборная панель записывает config.yaml, который считываются новыми сеансами. Открытый в данный момент чат — это процесс живого агента — он сохраняет любую модель, с которой был создан. Используйте /model <name>` внутри чата, чтобы выполнить горячую замену этого конкретного сеанса.
Вспомогательное переопределение «не вступило в силу»
Три вещи, которые нужно проверить:
- Вы начали новый сеанс? Существующие чаты не перечитывают конфигурацию.
- Разрешено ли для
providerзначение, отличное отauto? Если в поле указаноauto, задача по-прежнему использует вашу основную модель. Нажмите Изменить и выберите реального провайдера. - Аутентифицирован ли поставщик? Если вы назначили
minimaxзадаче, но у вас нет ключа MiniMax API, эта задача возвращается к значению по умолчанию openrouter и регистрирует предупреждение вagent.log.
Я выбрал модель, но VibeOS переключила меня на провайдера
В OpenRouter (или любом агрегаторе) имена голых моделей сначала разрешаются внутри агрегатора. Таким образом, claude-sonnet-4 на OpenRouter становится anthropic/claude-sonnet-4.6, оставаясь при вашей аутентификации OpenRouter. Но если вы наберете claude-sonnet-4 при встроенной аутентификации Anthropic, он останется как claude-sonnet-4-6. Если вы видите неожиданное переключение поставщика, убедитесь, что ваш текущий поставщик соответствует вашим ожиданиям — средство выбора всегда показывает текущий основной поставщик в верхней части диалогового окна.
Альтернативные методы
Slash-команда CLI
Внутри любого сеанса vibeos chat:
/model gpt-5.4 --provider openrouter # session-only
/model gpt-5.4 --provider openrouter --global # also persists to config.yaml
--global делает то же самое, что и кнопка Изменить на информационной панели, плюс переключает текущий сеанс на месте.
Пользовательские псевдонимы
Определите свои собственные короткие имена для моделей, к которым вы часто обращаетесь, а затем используйте /model <alias>` в CLI или любой платформе обмена сообщениями. Существует два эквивалентных формата — выберите тот, который соответствует вашему рабочему процессу.
Канонический (верхний уровень model_aliases:) — полный контроль над провайдером + base_url:
# ~/.vibeos/config.yaml
model_aliases:
fav:
model: claude-sonnet-4.6
provider: anthropic
grok:
model: grok-4
provider: x-ai
Короткая строковая форма (model.aliases.<name>: provider/model) — удобна из оболочки, поскольку vibeos config set записывает только скалярные значения, но не может содержать специальный base_url:
vibeos config set model.aliases.fav anthropic/claude-opus-4.6
vibeos config set model.aliases.grok x-ai/grok-4
Оба пути используют один и тот же загрузчик (vibeos_cli/model_switch.py). Записи, объявленные в model_aliases:, имеют приоритет над записями model.aliases: с тем же именем.
Затем /model fav или /model grok в чате. Псевдонимы пользователей дублируют встроенные короткие имена (sonnet, kimi, opus и т. д.). Полную информацию см. в разделе Псевдонимы пользовательских моделей.
vibeos model субкоманда
vibeos model # Interactive provider + model picker (the canonical way to switch defaults)
vibeos model поможет вам выбрать поставщика, пройти аутентификацию (потоки OAuth открывают браузер; поставщики ключей API запрашивают ключ), а затем выбрать конкретную модель из курируемого каталога этого поставщика. Выбор записывается в model.provider и model.model в ~/.vibeos/config.yaml.
Чтобы составить список поставщиков/моделей без запуска средства выбора, используйте панель мониторинга или конечные точки REST ниже. Чтобы проверить, что именно CLI будет использовать прямо сейчас: vibeos config show | grep '^model\.' и vibeos status.
Прямое редактирование конфигурации
Отредактируйте ~/.vibeos/config.yaml и перезапустите все, что его читает. Полную схему см. в Справочнике по конфигурации.
ОТДЫХ API
Панель мониторинга использует три конечные точки. Полезно для сценариев:
# List authenticated providers + curated model lists
curl -H "X-VibeOS-Session-Token: $TOKEN" http://localhost:PORT/api/model/options
# Read current main + auxiliary assignments
curl -H "X-VibeOS-Session-Token: $TOKEN" http://localhost:PORT/api/model/auxiliary
# Set the main model
curl -X POST -H "Content-Type: application/json" -H "X-VibeOS-Session-Token: $TOKEN" \
-d '{"scope":"main","provider":"openrouter","model":"anthropic/claude-opus-4.7"}' \
http://localhost:PORT/api/model/set
# Override a single auxiliary task
curl -X POST -H "Content-Type: application/json" -H "X-VibeOS-Session-Token: $TOKEN" \
-d '{"scope":"auxiliary","task":"vision","provider":"openrouter","model":"google/gemini-2.5-flash"}' \
http://localhost:PORT/api/model/set
# Assign one model to every auxiliary task
curl -X POST -H "Content-Type: application/json" -H "X-VibeOS-Session-Token: $TOKEN" \
-d '{"scope":"auxiliary","task":"","provider":"openrouter","model":"google/gemini-2.5-flash"}' \
http://localhost:PORT/api/model/set
# Reset all auxiliary tasks to auto
curl -X POST -H "Content-Type: application/json" -H "X-VibeOS-Session-Token: $TOKEN" \
-d '{"scope":"auxiliary","task":"__reset__","provider":"","model":""}' \
http://localhost:PORT/api/model/set
Токен сеанса вводится в HTML-код панели управления при запуске и меняется при каждом перезапуске сервера. Загрузите его из инструментов разработчика браузера (window.__VIBEOS_SESSION_TOKEN__ или устаревшей версии window.__VIBEOS_SESSION_TOKEN__), если вы пишете сценарии для работающей информационной панели. Заголовок X-VibeOS-Session-Token также принимается для совместимости с VibeOS.