О сервисе
Платформа наблюдаемости, где метрики, логи, трассировки и события складываются в одну базу телеметрии, а поверх неё работает слой прикладного интеллекта. Машинное обучение само учит нормальный профиль сервиса по реальному трафику — с суточными и недельными циклами — и отмечает отклонения, вместо того чтобы ждать заданного порога. Логи автоматически группируются в шаблоны, так что миллионы строк сжимаются до нескольких повторяющихся картин, а связанные срабатывания склеиваются в один инцидент с разбором вероятной причины. Отдельный агент для дежурства подключается к Slack и звонкам, отвечает на вопросы по телеметрии прямо из комнаты разбора и собирает отчёт по инциденту. Есть и наблюдаемость за самими ИИ-приложениями: видно вызовы агентов и инструментов, их задержки и ошибки.