О сервисе
Автономный инженер надёжности для Kubernetes: наблюдаемость и разбор инцидентов в одном месте, причём телеметрию собирает eBPF — технология ядра Linux, поэтому код приложений трогать не надо и контейнеры не перезапускаются. Сразу после установки видно семь видов сигналов: журналы из стандартного вывода и структурированный JSON, метрики по методикам RED и USE, распределённые трассы без правки кода, непрерывное профилирование с картами пламени по процессору и памяти, события Kubernetes, версии ресурсов кластера и контекст выката — вплоть до коммита, автора и пул-реквеста. Дальше подключается ИИ: он сам замечает просадку или аномалию, сам расследует сработавшее оповещение, проверяет свежий выкат на влияние на прод, выдаёт разбор первопричины и может открыть пул-реквест с исправлением. В комплекте карта сервисов кластера, дашборды, оповещения, наблюдение за расходами, доступностью и заданиями cron, а также отдельный контроль работы ИИ-агентов. Ставится одной командой Helm и выходит на рабочий режим за считаные минуты, одинаково работает на EKS, GKE, AKS, OpenShift и обычном Kubernetes на своём железе, совместим с OpenTelemetry и Prometheus, оповещает в Slack, а исправления отдаёт в GitHub. Развернуть можно облачным сервисом, внутри вашего облака под управлением вендора или полностью у себя.