Технологии анализа процессов: от бизнес-аналитики к процессной аналитике

Какой формат данных нужен для Process Mining

Для процессного майнинга минимально необходимы данные в формате таблицы с тремя ключевыми столбцами: ID экземпляра процесса, название операции и время её завершения. Желательно добавить информацию об исполнителе, а дополнительные атрибуты (тип заказа, регион и др.) расширят возможности анализа. Такой структуры достаточно для построения графа процесса и его дальнейшего изучения.

Основные мысли

  1. Минимальные требования данных – для процессного майнинга достаточно трёх столбцов: ID экземпляра процесса, название операции и время её завершения (таймстамп).

  2. Важность ID экземпляра – он группирует операции в рамках одного процесса, позволяя анализировать последовательность и длительность этапов.

  3. Дополнительные данные – информация об исполнителе и атрибутах (тип заказа, регион) углубляет анализ, но не обязательна для базового графа.

  4. Готовность данных – если есть лог операций с указанными полями, его уже можно использовать для процессного майнинга.

  5. Гибкость подхода – структуру данных можно расширять для более детального анализа, но минимальный набор позволяет начать работу.

Показывать лекцию целиком
Краткое изложение

Так, давайте разберёмся, в каком же формате нужно подготовить данные для процессного майнинга, чтобы у нас собрался граф процесса. Я снова нарисую табличку. Понятно, что в сложных проектах это не Excel, но в простых проектах это может выглядеть достаточно просто.

Итак, что нам нужно?

  1. Первая операция — здесь я поставлю ID. Фактически, нам в этой таблице Excel нужен так называемый идентификатор экземпляра процесса — это некий номер, который показывает, что все операции в этих строках относятся к одному конкретному экземпляру процесса.

  2. Название операции. Чаще всего его можно сформулировать на основе событий, которые есть в системе.

Например:

Если продолжить дальше, у нас может появиться ID экземпляра процесса №2, у которого тоже будет операция Создан заказ, но это уже другой экземпляр процесса.

Номер ID экземпляра процесса определяет:

Что ещё нужно для процессного майнинга?Нам необходим таймстамп (время). Я не буду сейчас писать год, но, допустим:

Вот наш процесс выполнен: три операции. Я указываю здесь именно время завершения каждой операции. На этих данных процессный майнинг уже сможет построить граф процесса.

То есть система видит:

Этих трёх основных столбцов достаточно, чтобы собрать граф процесса.

Что ещё желательно добавить?

  1. Исполнитель — без этого анализировать процесс сложно.

  2. Тип заказа (а также регион, товар и т. д.).

В принципе, можно добавлять бесконечное количество аналитических разрезов, которые потом пригодятся для анализа. Но для этого их нужно заранее загрузить в систему.

Итог:

Если у вас есть лог процесса, значит, вы уже готовы к процессному майнингу.

Тема: Подготовка данных для процессного майнинга

  1. Основные данные для анализа процесса:

    • ID экземпляра процесса – уникальный номер, связывающий операции в рамках одного процесса.

    • Название операции (например, "Создан заказ", "Согласован заказ").

    • Таймстамп – время выполнения операции.

  2. Дополнительные данные (желательные):

    • Исполнитель – кто выполнил операцию.

    • Аналитические разрезы (тип заказа, регион, товар и др.) – помогают в детальном анализе.

  3. Минимальные требования:

    • Без ID, названия операции и времени граф процесса построить нельзя.

    • Без данных об исполнителе анализ будет неполным.

  4. Вывод:

    • Если есть лог процесса с основными полями, можно приступать к процессному майнингу.

Вопросы для самопроверки

  1. Какие три столбца данных обязательны для процессного майнинга?

  2. Почему важно указывать таймстамп операций?

  3. Какой дополнительный столбец сильно упрощает анализ процесса?

  4. Можно ли построить граф процесса, если в данных нет ID экземпляра?

  5. Зачем нужны аналитические разрезы (например, тип заказа)?

Вернуться к учебному плану