OneUptime когда надоело платить зоопарку сервисов мониторинга
Представьте типичный вечер пятницы. Вы сидите в баре, и тут телефон начинает вибрировать как сумасшедший. Сначала прилетает письмо от Pingdom: «Сайт лежит». Следом — пуш от Sentry: «500-е ошибки посыпались пачками». Потом оживает Slack, где дежурный инженер пытается выяснить, чья сейчас очередь разгребать завалы, потому что график в PagerDuty опять кто-то забыл обновить. Знакомая ситуация?
Проблема даже не в самих инцидентах, а в том, что данные о них размазаны по пяти разным вкладкам браузера. Чтобы понять, почему упала база, нужно сопоставить графики из Datadog с логами из Loggly и сообщениями в StatusPage. Разработчики OneUptime решили, что так жить нельзя, и собрали всё это в один опенсорсный комбайн.
Что это вообще такое
OneUptime — это попытка создать единую точку правды для всей вашей инфраструктуры. Проект позиционирует себя как полноценная замена сразу нескольким платформaм: от простого мониторинга доступности до сложных систем управления инцидентами и трекинга ошибок.
Главная фишка здесь в интеграции. Когда у вас мониторинг, логи, APM и графики дежурств живут в одной базе, вам не нужно настраивать десятки вебхуков, чтобы они просто начали «общаться» друг с другом. Если мониторинг видит падение, он сам создает инцидент, оповещает нужного человека по графику и выводит плашку на страницу статуса для клиентов.
Что интересного внутри
Разработчики не стали мелочиться и реализовали практически всё, что нужно для спокойного сна SRE-инженера.
Мониторинг и страницы статуса
Это база. Инструмент проверяет доступность ваших API и сайтов из разных точек мира. Если что-то идет не так, OneUptime не просто шлет письмо, а подтягивает информацию на публичную или приватную Status Page. Это избавляет поддержку от сотен одинаковых вопросов «а почему ничего не работает?».

Дежурства и алерты
Вместо того чтобы держать отдельную подписку на PagerDuty, можно настроить политики эскалации прямо здесь. Вы определяете, кто дежурит в субботу, а кто — в воскресенье. Если первый номер не ответил на звонок или SMS в течение пяти минут, система сама пойдет «будить» следующего по списку.

Логи и APM
Тут OneUptime заходит на территорию тяжеловесов вроде New Relic или Datadog. Платформа умеет собирать трейсы, метрики и логи. Вы видите не просто «сайт тормозит», а конкретный медленный запрос к базе данных, который вызвал цепочку задержек.
AI Copilot: SRE, который не спит
Самая любопытная и современная часть проекта — это встроенный ИИ-агент. По задумке авторов, он не просто шлет уведомления об аномалиях, а пытается найти первопричину. В описании заявлено, что AI может даже создать Pull Request с исправлением уязвимости или оптимизацией медленного участка кода. Звучит амбициозно, хотя на практике в сложных легаси-проектах такие правки стоит проверять трижды.

Техническая сторона вопроса
Проект написан преимущественно на TypeScript. Для хранения данных используются серьезные инструменты: ClickHouse для логов и метрик (что логично, учитывая объемы данных в observability), PostgreSQL для основных данных и Redis для очередей.
Установить всё это добро можно тремя способами:
- Cloud-версия — для тех, кто хочет просто нажать кнопку и начать работать.
- Docker Compose — подойдет, чтобы потыкать систему локально или поднять на одном сервере для небольшого проекта.
- Kubernetes (Helm) — рекомендуемый путь для продакшена.
Для быстрого старта авторы предлагают скрипт:
curl -sSL https://oneuptime.com/install.sh | bash
Хотя я бы советовал сначала изучить содержимое скрипта или сразу смотреть в сторону Helm-чартов, если у вас серьезная инфраструктура.
Кому стоит попробовать OneUptime
Если вы работаете в стартапе, где бюджет на софт ограничен, а список необходимых инструментов (Sentry + PagerDuty + Pingdom + Datadog) уже перевалил за тысячу долларов в месяц, OneUptime может стать спасением. Вы получаете всё в одном флаконе и платите только за свои сервера (или за одну подписку, если выбрали облако).
Также проект интересен компаниям с жесткими требованиями к безопасности данных. Поскольку это опенсорс, вы можете развернуть его полностью внутри своего контура, и никакие логи или трейсы не покинут пределы вашей сети.
С другой стороны, если ваша команда уже плотно «сидит» на экосистеме AWS или Azure и использует их нативные инструменты мониторинга, переезд на OneUptime может потребовать слишком много усилий на перенастройку всех пайплайнов.
OneUptime подкупает своей целостностью. Это не просто «еще один мониторинг», а попытка навести порядок в хаосе инструментов. Да, замена Sentry или PagerDuty — задача непростая, и к качеству алертов в self-hosted решениях всегда много вопросов. Но возможность видеть всю картину происходящего в одном интерфейсе без необходимости переключать контекст — это именно то, чего часто не хватает в пылу борьбы с очередным инцидентом.
Если вы ищете способ упростить свой стек мониторинга или просто хотите уйти от проприетарных SaaS-решений, загляните в репозиторий проекта. Семь тысяч звезд на GitHub намекают, что тема «всё в одном» сейчас актуальна как никогда.