AI DevOps Assistant анализирует логи твоих серверов в реальном времени, автоматически находит причины сбоев и предлагает готовые bash-команды для исправления. Работает на базе DeepSeek V4 Flash.
Всё, что нужно для спокойного сна администратора
Система собирает логи за последние 5 минут, находит stack traces, критические паттерны и вычисляет уровень опасности по собственной шкале.
Нейросеть анализирует логи, конфиги и kernel logs, затем возвращает причину сбоя, список затронутых сервисов и команды для исправления.
WebSocket доставляет новые инциденты мгновенно. Фильтры, статистика, детальная информация и возможность закрыть инцидент в один клик.
Критические и высокие инциденты моментально прилетают в Telegram с причиной, командами и временем обнаружения в твоём часовом поясе.
Whitelist путей для чтения, JWT-аутентификация между агентом и бэкендом.
Запусти диагностику любого сервиса по требованию — агент соберёт логи и отправит их на анализ, даже если триггеров ещё не было.
Тёмная тема, минимализм, никакой рекламы
Полное руководство по установке, настройке и использованию системы
Агент AI DevOps устанавливается одной командой и не требует ручной настройки systemd — всё делается автоматически.
Выполните команду на сервере, который нужно мониторить:
⚠️ Зарегистрируйтесь для получения токена
python3, python3-venv, curl, jq/opt/ai-devops-agent/server.py) с бэкенда/etc/ai-devops/services.yml/etc/ai-devops/agent.credentialsai-devops-agent.serviceОтредактируйте /etc/ai-devops/services.yml под ваши нужды:
services:
nginx:
type: systemd
unit: nginx.service
logs:
- /var/log/nginx/error.log
- journalctl -u nginx
config_files:
- /etc/nginx/nginx.conf
myapp:
type: docker
container: myapp-prod
logs: docker logs myapp-prod
Перезапустите агента: sudo systemctl restart ai-devops-agent
Агент не отправляет на бэкенд всё подряд — встроенный LogProcessor фильтрует шум и оставляет только значимые события.
Эти паттерны не считаются ошибками:
404 not found — обычная ситуация для favicon.ico и сканеровhealth check — штатные проверки балансировщиковhandled error, connection aborted — контролируемые разрывыbroken pipe, parsing error, debugРегулярные выражения для поиска проблем:
Traceback, Exception, Error:panic:, FATAL, stack tracefailed, criticalЕсли в логах после ошибки появились эти строки — инцидент считается решённым автоматически:
connection established, recoveredfallback activated, backup connectedretry succeeded, service startedАгент читает только файлы из whitelist. Заблокированы:
/etc/shadow, /etc/ssh//root/, /home/*//etc/ssl/private/Каждое событие оценивается по шкале опасности. От суммы очков зависит действие системы.
| Событие | Очки |
|---|---|
| Stack Trace (Python/Node/Go/Java) | +50 |
| Service Down (не отвечает, crashed) | +100 |
| Service Degraded (flapping, restarting, unhealthy) | +30 |
| Критический паттерн (OOM, kernel panic, deadlock) | +50 |
| Уникальная базовая ошибка | +10 |
| Повтор одинаковой ошибки | +5 (макс. +40) |
При достижении порога 70+ система ждёт 3 минуты, проверяя статус сервиса каждые 10 секунд. Если за это время:
Вы можете принудительно запустить диагностику любого сервиса, даже если триггеров ещё не было.
services.yml (например, nginx).Если сервис не пишет логи за последние 5 минут — создаётся информационная запись с пометкой "Логи отсутствуют". Это нормально для стабильно работающих сервисов.
Критические и высокие инциденты мгновенно отправляются в Telegram.
Если кнопка не сработала (например, вы уже общались с ботом ранее) — воспользуйтесь ручной привязкой через команду /link.
В Telegram приходит сообщение с:
В любой момент можно отвязать Telegram через ту же модалку настроек → кнопка 🔕 Отвязать уведомления.
Сейчас мы тестируем систему на реальных инфраструктурах и подбираем оптимальную модель монетизации. Информация о тарифах появится здесь в ближайшее время.
Intelligent Infrastructure Monitoring