Анализ и прогноз аварий по вашим данным

Вам это нужно, если

вы ищете причины и оптимальные способы решения проблем аварийности и хотите получать прогнозы по ним.

Как это работает?

Три шага: ступень по опросу -> анализ журнала статистическими моделями и ИИ -> ссылка на результаты разбора.

Что умеет модуль?

Восемь проверенных методов: где копится простой, когда и по какому циклу случаются сбои, что изменилось, какие сбои тянут за собой другие, и прогноз.

Безопасность

Без вмешательства в инфраструктуру. Изолированная обработка, автоматическая маскировка чувствительных данных.

Сколько стоит

Начальный анализ - бесплатно. Дальше все зависит от результатов, ступени в мониторинге, автоматизации и ваших пожеланий.

Запустить анализ

Пришлите выгрузку инцидентов - заберите бесплатный базовый разбор, сделанный на ключевых статистических моделях.

Заметки об эксплуатации

Эксплуатация

Пять ступеней зрелости эксплуатации

От «об авариях узнаём от потребителя» до улучшений с измеренным эффектом. Где на этой лестнице стоит ваша служба и какой шаг следующий.

Сбои

Какие инциденты дают больше всего простоя

Немногие инциденты дают большую часть потерянных часов. Парето-анализ находит их - с них и начинать.

Метрики

MTBF и MTTR без агента

Время между сбоями и время восстановления - из выгрузки инцидентов, без установки агента мониторинга.

Эксплуатация

Как выглядит идеальная эксплуатация

Обычная компания, а не Google: один рядовой вторник по часам, восемь признаков зрелой службы и десять вопросов для самопроверки.

Сбои

Какие сбои вредят сильнее всего

Плановые работы, провайдеры, электропитание, уровень организации эксплуатации - двенадцать источников отказов по потерянным часам, а не по частоте.

Метрики

Сколько ещё будет сбоев и когда

Сколько инцидентов ждать на следующей неделе и насколько вероятен долгий простой - прогноз по вашей истории.

Эксплуатация

Матрица эскалации и шум оповещений

Почему большая часть сигналов не стоит чтения, чем измерить долю шума и кого будить ночью - по записанному правилу, а не по ощущению.

Сбои

Когда случаются сбои

Мониторинг ловит сбой в моменте, журнал показывает закономерность: в какие часы и дни копятся инциденты.

Метрики

Почему цифрам можно верить

Все числа считает статистический движок. ИИ только пишет текст вокруг них и не может их изменить.

Эксплуатация

Практики, которые видит бизнес

Двенадцать практик ITIL по убыванию отдачи: удержанная выручка, доверие клиента, допуск к контрактам, свободная ёмкость команды.

Сбои

Сбои по расписанию

Один и тот же сбой будто возвращается раз в несколько дней или в конце месяца. Движок проверяет, есть ли цикл, и когда ждать следующий сбой.

Эксплуатация

Что дальше

Какие проблемы анализ находит чаще всего и что делать с каждой - в терминах ITIL / ITSM.

Сбои

Какие сбои тянут за собой другие

После отказа одной системы открываются заявки по другим. Движок находит такие пары и считает, сколько заявок - продолжение одной аварии.

Сбои

Стало ли хуже после релиза

Сбоев больше после релиза или миграции? Сравнение «до и после» скажет, реальна разница или это случайность.

Сбои

Какие объекты ломаются снова и снова

Касса одного магазина, сервер из трёх: движок находит объект, который ломается чаще соседей или возвращается сразу после починки.

Сбои

Какая метрика предупреждает о сбое

Процессор, память, трафик: движок сравнивает журнал с метриками мониторинга и находит ту, что меняется за часы до сбоя.

Сбои

Сколько в журнале не сбоев, а запросов

Сброс пароля и выдача доступа в одной очереди со сбоями завышают число аварий и простой. Движок находит их и убирает из расчётов.

Вам это нужно, если

Сети и площадки

Вы - провайдер, хостер, дата-центр, узел обмена трафиком

Наш проект, созданный профильными специалистами с многолетним опытом + ключевые ITIL-практики = полезный для вас результат и/или второе мнение.

Эксплуатация ИТ

У вас аутсорс сетей или МСП, ИТ-отделы со службой заявок и др.

Даже первичный анализ нашим модулем покажет основные группы проблем, дающие 80% даунтайма, и пути их решения.

Не ИТ

У вас на балансе энергосети и ЖКХ, водоканал, транспорт, производство и т.п.

Если ведёте учет аварий (время, объект, событие), то это значит, что наш модуль будет вам полезным.

Как это работает?

Что ищет статистический модуль проекта

Девять методов, которые вы увидите в отчёте. Каждый проверен на базах с известным ответом, а в статье сказано, что он видит и чего нет. Новый метод появится здесь только после такой же проверки.

Приоритет
Приоритет (ранжирование Парето)
Какие 20% инцидентов дают 80% простоя - чтобы чинить немногие важные. Коэффициент Джини (мера неравенства: 0 - все инциденты одинаково вредны, 1 - весь простой дал один) показывает, насколько проблема сконцентрирована.
Закономерности
Когда случаются сбои
Показывает, в какие часы и дни недели идут сбои, и отличает обычную нагрузку рабочего дня от сбоя по расписанию: ночной задачи, бэкапа, регламента. Находит час, который выбивается из вашего собственного ритма, и главную систему в нём.
Цикличность
Циклы (периодичность)
Находит сбои одной системы, которые возвращаются каждые N дней или в одни и те же числа месяца, проверяет, что это не случайность, и называет дату следующего, если ничего не менять.
Проверка
Что изменилось и когда
Показывает, менялась ли частота сбоев за период: когда, насколько и какой это случай - ступенька после изменения, постепенный рост или всплеск, который прошёл. Если по данным не различить, так и говорит.
Прогноз
Прогноз частоты
Оценивает, сколько сбоев ждать в ближайшие 7 и 30 дней, по вашей собственной истории. Ответ - всегда интервал, а не ложно точное одно число.
Связи событий
Связи событий
Находит сбой-триггер: после отказа одной системы в течение 15 минут открываются заявки по другим - чаще, чем совпало бы случайно. Показывает, сколько заявок - продолжение одной аварии.
Надёжность
MTBF и MTTR без агента
Средняя наработка на отказ (MTBF) и среднее время восстановления (MTTR) прямо из выгрузки - без агента и без доступа к вашим серверам. Среднее, медиана и P95 (значение, хуже которого только 5% случаев) вместе показывают не только типичный, но и плохой день.
Риск
Риск долгого простоя
Какова вероятность редкого, но очень длинного простоя - того самого, который ломает SLA. Средняя доступность его прячет, этот расчёт показывает отдельно.
Повторы
Объекты, которые ломаются снова и снова
Находит сервер или магазин, который ломается чаще соседей или возвращается через день-три после починки. Сравнивает это со случаем, чтобы просто загруженную систему не назвать проблемой.
Предвестник
Метрика, которая предупреждает о сбое
Сравнивает журнал инцидентов с метриками мониторинга и находит метрику, которая за часы до сбоя уходит от обычного уровня. Сверяет с теми же часами в обычные дни, чтобы не назвать предупреждением загруженный рабочий день или тревогу по той же метрике.
Скоро
Ритмы метрик
Какой суточный или недельный ритм метрики объясняет повторяющиеся сбои. Метод проходит проверку на базах с известным ответом, статья выйдет вместе с ним.
Статьи
Все статьи и методы
Как работает каждый метод, что он видит и чего нет, с примерами на реальных данных. А так же информация о результатах исследований и авторские заметки об эксплуатации.

Запустить анализ

CSV, JSON, TXT, XLSX - до 20 МБ; файл больше - в ZIP до 100 МБ.

Ещё не знаете свою ступень?
Двенадцать вопросов, несколько минут: ступень и что подготовить к выгрузке.
Пройти опрос
Уже есть выгрузка? Пришлите её здесь
📂
Перетащите сюда журнал инцидентов - и выгрузку метрик, если она есть
До 3 файлов · CSV · JSON · NDJSON · TXT · XLSX · до 20 МБ каждый · ZIP до 100 МБ

Данные не могут покинуть контур? Обезличьте файл сами (бесплатный офлайн-скрипт)

или
Отправить через Telegram
✓ Файл получен. Отчёт придёт на {email} с адреса {from} в течение рабочего дня - запрос после 12:00 уходит на следующий рабочий день. Если письма нет - проверьте папку «Спам».
Не больше 3 файлов за раз. Больше - упакуйте их в один zip.
Что-то пошло не так. Попробуйте ещё раз или отправьте файл в Telegram-бот.

Безопасность

✓

Без доступа к инфраструктуре

Никаких агентов, VPN и доступов к серверам. Только файл, который вы сами решили прислать.

✓

Изолированная обработка

Каждый файл анализируется в отдельной сессии. Между клиентами данные не пересекаются.

✓

Удаление через 30 дней или раньше по запросу

Файл и страница отчёта доступны только вам на сайте до 30 дней.

✓

Никакого обучения на ваших данных

Ваши данные - только для обезличенной аналитики и только с вашего согласия.

✓

Автомаскирование

IP, имена хостов и почты маскируются автоматически до анализа.

✓

Обезличивание перед отправкой

Запустите офлайн-скрипт: он заменяет имена сервисов, узлов и людей на коды.

Скачать скрипт · Как запустить

Кто анализирует

За результат анализа отвечает основатель проекта. Главный инструмент: аналитический модуль и многолетний опыт в телекоме и банкинге. Там, где задача требует консилиума и дополнительных компетенций, подключаются дополнительные эксперты.

Основатель

20+ лет в эксплуатации

Построил несколько центров управления сетью и крупных инфраструктур, вёл проекты обновления ИТ в банке, ритейле. Регулярно проводит независимые аудиты надёжности. Разработал методику анализа и прогнозирования - основу работы модуля аналитики.

Сети

Сетевые инженеры высокого уровня

Имеют экспертный уровень по Cisco, Juniper и Huawei и еще не менее 10 линеек известных производителей. Проектируют и эксплуатируют сети для банков и операторов связи.

Мониторинг

Наблюдение и контроль сетей

Эксперты по транспортным, мультисервисным, объектовым и распределительным сетям: что измерять и как увидеть проблему до того, как она станет аварией. Руководители и специалисты по мониторингу клиентских сервисов и диспетчеризации.

Поддержка

Техническая поддержка и три её линии

Эксперты, которые строят службу поддержки с нуля и обеспечивают правила их работы и совершенствование алгоритмов, отчетов, показателей.

Процессы

Практики ITSM и ITIL

Эксперты по управлению ИТ-услугами: работа с инцидентами, проблемами, изменениями и уровнями услуг по ITIL 4. Делают процесс измеримым: что считается, у кого владелец, какой срок обещан.

Учёт активов

ITAM, CMDB и DCIM

Специалисты по учёту оборудования, конфигураций и инженерной инфраструктуры: собирают базу конфигураций, связывают услуги с железом, от которого они зависят, ведут жизненный цикл активов.

Сколько стоит

Первый разбор бесплатный и без условий. Дальше цена зависит от объёма журнала и глубины работы - счёт выставляем письмом.

Первый разбор €0
бесплатно, без условий
  • Разбор на ваших данных по базовой программе
  • Страница отчёта по ссылке - выводы и графики
  • Ключевые показатели: наработка между отказами, время восстановления, где копится простой
  • Список того, что нужно в ваших данных для полного анализа
Платный разбор (от €250)
разово или ежемесячно
  • Все методы движка, применимые к предоставленным данным
  • Графики, подтверждающие ключевые наблюдения
  • План действий и сверка с порогами вашей отрасли
  • Предложения по оптимизации учёта событий, чтобы следующий разбор был глубже
  • Ежемесячно - тот же документ плюс динамика к прошлому месяцу

Получим ваше сообщение, ответим максимально быстро и предложим варианты.

или просто напишите нам: