Vibeos Ops Health
Триаж шлюза, cron и канбана.
Метаданные навыка
| Источник | Встроенный (устанавливается по умолчанию) |
| Путь | skills/devops/vibeos-ops-health |
| Версия | 1.0.0 |
| Автор | VibeOS |
| Лицензия | MIT |
| Платформы | linux, macos, windows |
| Теги | ops, gateway, cron, kanban, health |
| Связанные навыки | git-local-workflow, issue-to-pr |
Справочник: полный SKILL.md
к сведению
Ниже приведено полное описание навыка, которое VibeOS загружает при его активации. Это те инструкции, которые видит агент, когда навык активен.
VibeOS Ops Health
Операторский плейбук для рва personal-AI-OS: живость шлюза, переподключение мессенджеров, тики cron и здоровье диспетчера канбана. Предпочитайте эти CLI-проверки догадкам по тишине в чате.
Когда использовать
- Шлюз «завис» или чаты перестали отвечать
- Cron-задачи пропустили окно выполнения
- Очередь готовых задач канбана не порождает воркеров
- После сбоев Wi-Fi / DNS
Предварительные требования
- Локальная установка с
vibeos/./scripts/vibeosв PATH - Права на чтение
~/.vibeos/logs/(или домашней директории профиля)
Как запустить
- Шлюз + очередь переподключения:
vibeos gateway status
Ищите ↻ platform: reconnect in Ns и ⚠ kanban dispatcher stuck.
- Триаж cron:
vibeos cron status
vibeos cron list
cron status теперь показывает последние упавшие, с ошибками доставки и просроченные задачи.
- Канбан:
vibeos kanban list --status ready
vibeos kanban stats
vibeos kanban diagnostics
- Логи:
vibeos logs --follow --level WARNING
# или: ~/.vibeos/logs/gateway.log
Краткая справка
| Симптом | Проверка | Вероятное исправление |
|---|---|---|
| Нет ответов в чате | gateway status | vibeos gateway restart |
| Платформа переподключается | строки статуса ↻ | Дождаться backoff; исправить токен, если фатально |
| Cron не срабатывает | строки тикера cron status | Перезапустить шлюз; проверить ошибки задач |
| Готовые задачи простаивают | kanban list --status ready | Проверить venv/PATH/учётные данные профиля |
| Уведомление о сдаче | сообщение показывает N/M failures | Увеличить kanban.failure_limit или исправить spawn |
Подводные камни
- Фоновая
delegate_taskпривязана к процессу — используйтеcron/terminal(notify_on_complete)для работы, которая должна пережить перезапуск. - Для дешёвого обслуживания (гигиена FTS) предпочитайте
no_agentcron-скрипты, чтобы не тратить модельные ходы. - Не добавляйте новые основные инструменты для ops — CLI и навыков достаточно.
Верификация
gateway statusпоказывает PID под надзором и отсутствие неожиданных фаталовcron statusпоказывает свежий heartbeat и отсутствие просроченного кластера- Зависший канбан очищается после возобновления spawn (статус больше не предупреждает)