Описание услуги
Я выстраиваю полную наблюдаемость вашего продукта, чтобы вы узнавали о проблемах раньше пользователей, а не из гневных обращений в поддержку. Я связываю метрики, логи и трейсы в единую картину и настраиваю Datadog либо связку Grafana и Prometheus, если вы хотите держать всё на собственной инфраструктуре. В итоге у вас появляются дашборды, где состояние каждого сервиса видно с одного взгляда, и алертинг, который срабатывает только тогда, когда действительно что-то пошло не так, а не на каждый случайный всплеск.

Работу я начинаю с ваших реальных болей. Инструментирую приложения нужными SDK, настраиваю сбор логов с разумным парсингом и подключаю распределённый трейсинг, чтобы медленный запрос можно было проследить через все сервисы. Затем описываю SLO и бюджеты ошибок под ваши обязательства перед клиентами и подбираю пороги оповещений по историческим данным, чтобы вы не тонули в шуме. О стоимости забочусь не меньше, чем о покрытии: сокращаю кардинальность, разумно сэмплирую трейсы и держу счёт за ingestion под контролем. На выходе вы получаете задокументированную систему с runbook и понятной передачей дел.

— Метрики, логи и трейсы в одном месте
— Дашборды, SLO, бюджеты ошибок и умный алертинг
— Инструментирование, контроль затрат и передача дел
Связаться с фрилансером

Закажите услугу или задайте вопрос исполнителю.

Контакты фрилансера
E-mailПоказать
Автор объявления: Yulia