Обнаружение аномалий и анализ причин на основе ИИ: использование машинного обучения на логах, метриках и трейсах для выявления скрытых аномалий производительности, угроз безопасности или сбоев в сложных облачных средах
Статьи автора
Инцидент в ИТ-инфраструктуре стоит компании денег с первой минуты простоя. Пользователи не могут работать, SLA нарушается, служба поддержки завалена обращениями
В статье разобраны конкретные сценарии применения AIOps в телеком-секторе, показано, как платформа меняет работу SRE-специалистов и специалистов отделов мониторинга, какой эффект получает бизнес и на что обращать внимание при выборе решения.
Что такое AIOps и зачем он нужен Представьте дежурного инженера в 3 часа ночи. На экране — 200 алертов за последние 5 минут. Упала база данных, залогировались ошибки в трёх микросервисах, Zabbix прислал предупреждение о нагрузке на CPU, wiSLA зафиксировал деградацию SLA по двум сервисам. Все сигналы приходят одновременно, каждый требует внимания — но ни […]
Запись доклада «Как мы приручали хаос логов: ML-кластеризация на пути от сырых событий к инцидентам»
В апреле руководитель продукта Artimate Никита Гладких выступил на конференции DevOps Conf 2026 с докладом “Как мы приручали хаос логов: ML-кластеризация на пути от сырых событий к инцидентам”
Как объединить разрозненные системы мониторинга, сократить MTTR до 50% и снизить информационный шум на 95% на базе AIOps-платформы Artimate
Искусственный интеллект в observability — это не замена систем мониторинга. Это интеллектуальный слой над ними: инструмент, который обрабатывает поток данных из разных источников, устраняет шум, связывает разрозненные события в единую картину и помогает инженеру быстрее выйти на причину сбоя
Руководитель платформы интеллектуального анализа событий мониторинга Artimate Никита Гладких принял участие в новом выпуске проекта Business FM Петербург «Высокие технологии для бизнеса»
В периоды распродаж, сезонных акций и праздничных пиков эта зависимость становится особенно заметной: трафик на витринах федеральных ритейлеров в дни «Черной пятницы» и «Киберпонедельника» вырастает в десять и более раз по сравнению с обычным будним днем, а любая некорректно настроенная база данных или неоптимизированный кэш превращаются в источник массовых отказов
ИТ-мониторинг и информационная безопасность работают с одной телеметрией, но традиционно используют разные системы, команды и логику обработки событий. ITOps-команда отвечает за состояние инфраструктуры, SOC — за выявление и расследование инцидентов безопасности. Передача контекста между двумя контурами выполняется через тикеты, ручные согласования и e-mail-коммуникации. В 2026 году такая модель перестает соответствовать масштабу задач. Растущая сложность инфраструктуры, […]

