Mineração de processos (process mining): o que é, como funciona e exemplos

18 min de leitura

O que é mineração de processos (process mining), como o log de eventos do ERP vira o mapa do processo real, os três tipos de análise, um exemplo numérico, a diferença para BI, BPM e task mining e um roteiro para começar.

Mineração de processos (process mining): o que é, como funciona e exemplos

Mineração de processos, ou process mining, é a técnica que reconstrói como um processo acontece de verdade a partir dos registros que os sistemas gravam a cada etapa. Todo ERP, sistema hospitalar ou CRM anota quem fez o quê e quando: a requisição criada, o pedido aprovado, a nota lançada, o pagamento feito. Juntando esses registros caso a caso, o process mining desenha o caminho real de cada pedido, conta ou atendimento, com as variantes, os gargalos, o retrabalho e os desvios que nenhum fluxograma mostra.

A diferença para um mapa desenhado em workshop está na origem da informação. O fluxograma descreve como as pessoas acham que o processo funciona. A mineração de processos mostra como ele funcionou, evento por evento, em todos os casos do período, e não numa amostra. Este guia explica o conceito, o dado que ele exige, os três tipos de análise, um exemplo com números, a diferença para BI, BPM e task mining, os limites da técnica e um roteiro para começar.

O que é mineração de processos (process mining)

Mineração de processos é uma disciplina que fica entre a ciência de dados e a gestão de processos. Ela usa o log de eventos dos sistemas transacionais para descobrir o processo real, compará-lo com o processo desenhado e medir onde ele perde tempo e dinheiro. O resultado mais conhecido é o mapa do processo, mas o mapa é o começo: o que dá valor é a leitura caso a caso, que permite dizer quantos pedidos seguiram o caminho previsto, quantos deram voltas e quanto cada volta custou.

"Mineração de processos" é a tradução de process mining, e no Brasil os dois nomes convivem. A palavra "mineração" vem de mineração de dados: é garimpar o dado que o sistema já tem, e não minério. Por isso quem busca o tema costuma encontrar, misturados, textos sobre a indústria de mineração. Neste artigo, e no mercado de software, o termo quer dizer sempre a análise de processos a partir de dados.

A técnica nasceu na pesquisa acadêmica. O holandês Wil van der Aalst começou a desenvolvê-la no fim dos anos 1990, na Universidade Tecnológica de Eindhoven, e é até hoje a principal referência da área. Em 2009 o IEEE criou uma força-tarefa dedicada ao tema, que publicou em 2011 o Manifesto de Process Mining, com os princípios e desafios da disciplina. Na década seguinte o process mining virou categoria de software corporativo, e hoje o Gartner avalia os fornecedores no seu Magic Quadrant de Process Mining.

A imagem que melhor descreve a técnica é a de um raio-x. O processo existe no dado de qualquer forma. O process mining o torna visível, com a vantagem de que cada traço do desenho aponta para os casos reais que o formaram.

O que é um log de eventos

O log de eventos é a matéria-prima. É uma tabela em que cada linha registra que uma atividade aconteceu em um caso, em um momento. Três campos são obrigatórios:

  • Identificador do caso: o objeto que atravessa o processo, como o número do pedido, da conta médica ou do chamado.
  • Atividade: o que aconteceu, como "requisição aprovada" ou "nota fiscal lançada".
  • Carimbo de tempo: data e hora em que aconteceu.

Com esses três campos já dá para desenhar o fluxo e medir tempos. Dois grupos de campos opcionais aumentam muito o que a análise consegue responder: o recurso (usuário, área ou rotina automática que executou a atividade) e os atributos do caso (valor, fornecedor, filial, categoria, convênio, tipo de atendimento).

Veja um trecho de log de compras, com dois pedidos:

Caso Atividade Data e hora Recurso
PC-1001 Requisição criada 03/03/2026 09:12 Solicitante (manutenção)
PC-1001 Requisição aprovada 03/03/2026 16:40 Gestor da área
PC-1001 Pedido emitido 05/03/2026 10:05 Comprador 1
PC-1001 Nota fiscal lançada 12/03/2026 14:22 Fiscal
PC-1001 Pagamento 10/04/2026 08:00 Rotina automática
PC-1002 Nota fiscal lançada 04/03/2026 11:30 Fiscal
PC-1002 Pedido emitido 06/03/2026 09:47 Comprador 2
PC-1002 Pagamento 03/04/2026 08:00 Rotina automática

O PC-1001 seguiu o caminho previsto e levou 38 dias da requisição ao pagamento. O PC-1002 mostra um desvio clássico: a nota fiscal entrou antes de o pedido existir. É uma compra feita por fora, formalizada depois, que não passou por cotação. Em uma tabela de indicadores os dois pedidos aparecem iguais, como pedidos pagos. No log, a diferença salta à vista.

Como o log vira um mapa

O algoritmo ordena os eventos de cada caso pelo tempo e obtém a sequência de atividades daquele caso. Casos com a mesma sequência formam uma variante. Somando as passagens de uma atividade para a outra em todos os casos, ele desenha as setas do mapa, com a frequência de cada uma e o tempo médio entre as duas pontas. As famílias de algoritmo mais usadas (Alpha, Heuristic Miner, Inductive Miner) diferem na forma de lidar com ruído e com fluxos paralelos, mas a lógica é essa. Para trocar logs entre ferramentas existe um formato padrão, o XES, mantido pelo IEEE.

De onde vêm os dados: ERP, sistema hospitalar e CRM

Quase todo sistema transacional grava o que o process mining precisa. O trabalho está em juntar as tabelas certas e converter cada data relevante em evento.

  • SAP: requisições (EBAN), pedidos (EKKO e EKPO), histórico do pedido com entradas de mercadoria e de fatura (EKBE), verificação de faturas (RBKP e RSEG), lançamentos contábeis (BKPF e BSEG) e os documentos de modificação (CDHDR e CDPOS), que dizem quem alterou o quê e quando. Veja process mining e agentes no SAP.
  • TOTVS Protheus: solicitações de compra (SC1), cotações (SC8), pedidos de compra (SC7), aprovações por alçada (SCR), notas fiscais de entrada (SF1 e SD1) e títulos a pagar (SE2). O Datasul segue a mesma lógica, com tabelas próprias. Veja Protheus e Datasul.
  • Sistemas hospitalares: no Tasy e no MV, os registros de atendimento, prescrição, exames, alta, conta e faturamento formam a jornada do paciente e o ciclo da conta médica. Veja Tasy e MV.
  • CRM e atendimento: Salesforce e ServiceNow registram cada mudança de status de uma oportunidade ou de um chamado, o que basta para medir filas e reaberturas.

Duas regras valem para qualquer fonte. A extração é só de leitura: o process mining não altera o sistema, não grava nada nele e não exige customização. E o período precisa ser longo o bastante para mostrar o padrão, de seis a doze meses na maioria dos processos administrativos.

Os três tipos de mineração de processos

A literatura divide a técnica em três tipos de análise, e os três costumam aparecer juntos em um projeto.

  1. Descoberta (discovery). Parte só do log e reconstrói o processo, sem modelo prévio. Responde "como isto funciona de verdade?". É o tipo mais conhecido, detalhado em descoberta de processos.
  2. Conformidade (conformance checking). Compara o que aconteceu com o que deveria acontecer, seja um modelo BPMN, uma política ou uma regra de alçada. Aponta cada caso que tomou um atalho: aprovação pulada, pedido depois da nota, pagamento antes do recebimento. Veja análise de conformidade.
  3. Melhoria (enhancement). Enriquece o mapa com tempo, custo e recurso para mostrar onde o processo espera, quem está sobrecarregado e o que custa cada desvio. É a ponte para a melhoria contínua com process mining.

Com o dado atualizado com frequência, os três tipos deixam de ser um retrato de projeto e viram monitoramento: o desvio aparece enquanto o caso ainda está aberto, e não no relatório do mês seguinte.

O que a mineração de processos revela

Os achados de um projeto de process mining quase sempre caem em seis grupos:

  • Variantes. Quantos caminhos diferentes o mesmo processo tem e quanto do volume segue o caminho previsto. É comum o caminho previsto responder por menos da metade dos casos.
  • Gargalos. Onde o caso espera, e não onde ele é trabalhado. O tempo entre duas atividades costuma ser muito maior do que o tempo de executar cada uma.
  • Retrabalho. O que volta: aprovação repetida, alteração de preço, estorno, reabertura. Cada volta tem custo de gente e de prazo. Veja o custo do retrabalho.
  • Desvios de conformidade. Pedido criado depois da nota, aprovação fora da alçada, a mesma pessoa pedindo e aprovando, pagamento sem entrada de mercadoria.
  • Automação. Quanto do fluxo já roda sem toque humano e onde a intervenção manual se concentra.
  • Onde e com quem. Filial, fornecedor, categoria, convênio ou usuário que concentram o problema, que é o que transforma um achado genérico em ação específica.

Exemplo: um ano de compras lido pelo log

Os números abaixo são ilustrativos, de uma indústria hipotética, e servem para mostrar como se lê um resultado. A empresa extraiu do ERP 12 meses de compras: 18.400 pedidos e todos os eventos de cada um.

O que o log mostra Número O que significa
Variantes distintas 214 O mesmo processo acontece de 214 formas
Caminho previsto (requisição, aprovação, pedido, nota, pagamento) 41% dos pedidos (7.544) A exceção é a regra: 59% seguem outro caminho
Pedido criado depois da nota fiscal 13% (2.392) Compra feita antes de o pedido existir, sem cotação
Pedido aprovado mais de uma vez 15% (2.760) Volta de aprovação por mudança de preço ou quantidade
Tempo da requisição ao pedido 4 dias no caminho previsto e 12 com reaprovação O gargalo é esperar a segunda aprovação, não cotar

A conta do retrabalho de aprovação é direta. Se cada volta consome 25 minutos somados de comprador e aprovador, as 2.760 voltas dão 1.150 horas por ano. Com um custo carregado de R$ 85 por hora, são cerca de R$ 98 mil por ano, antes de contar o efeito do atraso sobre o preço e sobre a operação que esperava o material.

O achado mais caro, porém, é outro: os 2.392 pedidos retroativos. Eles são compras que chegaram ao fornecedor sem cotação e sem comparação com o preço que a própria empresa já pagou. O log mostra quantos são, de quais categorias e de quais filiais. O que ele não mostra é por que acontecem. Essa pergunta leva ao próximo passo, a process intelligence, que junta ao mapa o contexto, a causa e a ação.

Mineração de processos, BI, BPM, mapeamento e task mining

As cinco abordagens aparecem juntas nas conversas sobre processo e se complementam. A tabela resume o que cada uma responde:

Abordagem Pergunta que responde De onde vem a informação Limite
BI Quanto e quantos Indicadores agregados do data warehouse Não mostra a sequência nem o caminho de cada caso
Mineração de processos Como o processo aconteceu, caso a caso Log de eventos dos sistemas Só enxerga o que o sistema registra
BPM Como o processo deve ser e como geri-lo Modelos, regras e workflow O modelo pode não bater com a realidade
Mapeamento por entrevista Como as pessoas descrevem o trabalho Entrevistas e workshops Amostra pequena, memória e opinião
Task mining O que a pessoa faz na tela Captura da área de trabalho Exige instalação no computador e vê cliques, não o processo

Diferença entre BI e mineração de processos

O BI soma e divide: tempo médio de pagamento, número de pedidos, valor por categoria. O process mining segue cada caso do começo ao fim. A média de 38 dias para pagar pode esconder dois processos, um de 20 dias e outro de 70, e só a leitura caso a caso mostra quais pedidos estão em cada grupo e o que eles têm em comum. Um não substitui o outro: o indicador diz que algo mudou, o mapa diz onde e por quê.

Process mining e BPM

BPM é a gestão por processos: desenhar, padronizar, executar e melhorar. O process mining entrega ao BPM o que ele mais precisa, que é a realidade medida. Em vez de revisar o modelo em workshop, o time compara o modelo com o log e ajusta onde a diferença é maior. O guia de BPM cobre o ciclo completo.

Process mining e mapeamento de processos

O mapeamento de processos tradicional ouve as pessoas. O process mining lê o sistema. Os dois veem coisas diferentes: o log é exato sobre o que passou pelo sistema e cego para o que passou por fora dele, e a entrevista alcança o que o sistema não registra, mas depende da memória de quem responde. Os melhores diagnósticos usam os dois.

Task mining e RPA

Task mining registra as ações de cada pessoa na tela e mostra tarefas manuais repetitivas, boas candidatas a automação. RPA é outra coisa: não analisa, executa, repetindo uma sequência de cliques por regra. Os dois costumam ser o passo seguinte a um process mining, quando o mapa já mostrou onde vale automatizar.

Onde a mineração de processos é usada

Qualquer processo que deixa rastro em sistema pode ser minerado. Os mais comuns:

  • Compras (procure-to-pay): pedido depois da nota, preço fora do histórico, fracionamento para fugir da alçada, lead time de requisição. Veja procure-to-pay.
  • Contas a pagar: pagamento duplicado, antecipado ou com multa por atraso, e o custo de cada fatura bloqueada. Veja IA no contas a pagar.
  • Order-to-cash: pedido travado em análise de crédito, faturamento parcial, prazo de recebimento. Veja order-to-cash.
  • Saúde: jornada do paciente, pronto atendimento, giro de leitos e o ciclo da conta médica, da prescrição ao faturamento e à glosa. Veja process mining na saúde e auditoria de contas médicas.
  • Indústria: ordens de produção, manutenção e o fluxo de materiais. Veja process mining na indústria 4.0.
  • Melhoria contínua: Lean, Six Sigma e DMAIC usam o process mining como régua de medição antes e depois de cada mudança. Veja ciclo DMAIC.

Como começar um projeto de mineração de processos

  1. Escolha um processo e uma pergunta. "Por que 13% dos pedidos nascem depois da nota?" rende mais do que "mapear tudo". A pergunta define o período, os campos e quem precisa participar.
  2. Defina o caso e as atividades. O caso é o pedido, a requisição ou o item? Quando uma requisição vira vários pedidos, a escolha muda o mapa. Essa é a questão que a mineração de processos centrada em objetos (object-centric process mining) resolve, ao analisar vários objetos ligados de uma vez.
  3. Extraia o log com leitura. Consulta ou export das tabelas, de seis a doze meses, sem alterar o sistema.
  4. Valide o dado. Confira fuso horário, datas digitadas à mão, lançamentos em lote que carimbam o mesmo horário em centenas de casos e eventos duplicados. Um log ruim desenha um processo que não existe.
  5. Descubra e confira com quem executa. O mapa mostra o quê. Quem trabalha no processo explica o porquê, e costuma reconhecer na hora as variantes estranhas.
  6. Quantifique em reais. Tempo multiplicado pelo custo da hora, valor dos casos com desvio, multa, juro, preço pago acima do histórico. Achado sem número não disputa prioridade.
  7. Aja e meça no mesmo log. Corrija a regra, treine, automatize ou coloque um agente para executar a etapa. O mesmo log que mostrou o problema mede se ele diminuiu.

Limites: o que o log não mostra

O process mining é exato dentro do que o sistema registra, e é preciso saber onde isso termina.

  • O que acontece fora do sistema não aparece. Negociação por WhatsApp, aprovação por e-mail, controle em planilha e ligação para o fornecedor ficam invisíveis. Para essa parte existem o task mining e o mapeamento de processos com IA, em que um agente entrevista todas as pessoas da área.
  • A qualidade do carimbo de tempo manda. Se o sistema registra a data do lançamento e não a do fato, o tempo medido é o do registro.
  • Um caso pode ter vários objetos. Pedido com várias notas, conta com várias guias. Sem tratar isso, o mapa duplica ou esconde eventos.
  • O log diz o quê, não o porquê. A causa vem das pessoas e do contexto do negócio.
  • Há dado pessoal no log. Usuário, paciente e fornecedor são dados protegidos pela LGPD. Pseudonimizar quem executa e restringir o acesso é parte do projeto, especialmente em saúde.

Como escolher uma ferramenta de process mining

Para aprender a técnica, as ferramentas de código aberto são o melhor ponto de partida: o ProM, criado na Universidade de Eindhoven, e as bibliotecas PM4Py, em Python, e bupaR, em R. Para uso corporativo, o Magic Quadrant do Gartner avaliou 18 fornecedores na edição de 2024. Na hora de escolher, sete critérios separam uma ferramenta que gera relatório de uma que muda o processo:

  • Conectores para os sistemas que você usa. SAP é o caso comum. Protheus, Datasul, Tasy e MV não são, e o tempo de integração decide o prazo do projeto.
  • Tempo até o primeiro mapa. Semanas, e não meses, a partir do export do sistema.
  • Leitura caso a caso e conformidade. O mapa bonito importa menos do que abrir o caso concreto que formou cada seta.
  • Valor em reais. Tempo é metade da história. O que prioriza é o dinheiro em cada desvio.
  • Caminho até a ação. O que acontece depois do achado: alerta, automação, agente que executa a etapa dentro do sistema.
  • Governança e LGPD. Quem vê o quê, e como o dado pessoal é protegido.
  • Quem opera. Um centro de excelência interno ou um serviço que opera junto com o time. As duas formas funcionam, mas precisam estar no plano desde o início.

Da mineração de processos à process intelligence e aos agentes de IA

O process mining responde onde o processo perde tempo e dinheiro. Por muito tempo o projeto terminava aí, em um relatório com recomendações. O que mudou foi o que vem depois do mapa. A process intelligence junta ao mapa o contexto de negócio, o que o sistema não registra e a ação sobre o achado. E os agentes de IA passaram a executar a parte da rotina que o mapa mostrou ser repetitiva, dentro do próprio sistema e com alçada definida. O mapa diz onde agir. O agente age. O mesmo log prova o resultado.

Perguntas frequentes

O que é mineração de processos?

Mineração de processos, ou process mining, é a técnica que reconstrói o processo real de uma empresa a partir do log de eventos dos sistemas, como ERP, sistema hospitalar e CRM. Com o identificador do caso, a atividade e a data e hora de cada evento, ela desenha o caminho que cada pedido, conta ou atendimento percorreu, com as variantes, os gargalos, o retrabalho e os desvios em relação ao processo desenhado.

Mineração de processos e process mining são a mesma coisa?

São. Mineração de processos é a tradução de process mining, e no Brasil os dois nomes são usados. A palavra mineração vem de mineração de dados: a técnica garimpa o dado que os sistemas já gravam. Não tem relação com a indústria de mineração.

Quais são os tipos de process mining?

São três. A descoberta reconstrói o processo só a partir do log. A conformidade compara o que aconteceu com o modelo ou a regra e aponta cada desvio. A melhoria acrescenta tempo, custo e recurso ao mapa para mostrar gargalos e o custo de cada variante. Com dado atualizado com frequência, os três viram monitoramento contínuo.

Qual a diferença entre process mining e BI?

O BI mostra indicadores agregados, como tempo médio e volume, e responde quanto e quantos. O process mining segue cada caso do começo ao fim e responde como o processo aconteceu. Uma média de 38 dias pode esconder um grupo de pedidos de 20 dias e outro de 70, e só a leitura caso a caso mostra quais pedidos estão em cada grupo e por quê.

Quais dados são necessários para fazer process mining?

No mínimo, três campos por evento: o identificador do caso, a atividade e a data e hora. Com o recurso que executou cada atividade e atributos como valor, fornecedor, filial ou convênio, a análise passa a dizer onde e com quem o problema se concentra. Esses campos já existem nas tabelas do ERP e dos sistemas de gestão, e de seis a doze meses de histórico bastam na maioria dos processos.

Process mining precisa alterar o ERP?

Não. A extração é só de leitura, por consulta ou export das tabelas, e nada é gravado no sistema. Não há customização nem migração. O trabalho está em juntar as tabelas certas e converter cada data relevante em evento.

Quanto tempo leva para ter o primeiro mapa de processo?

Depende mais do dado do que da ferramenta. Com o export do sistema disponível e um processo bem delimitado, o primeiro mapa sai em semanas, e na UpFlux em cerca de duas. O que alonga o prazo é a integração com sistemas pouco padronizados e a validação do dado, por isso a escolha do primeiro processo deve considerar onde o dado está mais limpo.

Process mining substitui o mapeamento de processos por entrevista?

Não, complementa. O process mining é exato sobre o que passa pelo sistema e não vê o que acontece fora dele, como planilhas, e-mails e mensagens. O mapeamento com pessoas alcança essa parte e explica o porquê dos desvios. Um diagnóstico completo usa os dois.

O que é task mining?

Task mining é a captura das ações de cada pessoa no computador, como cliques, telas e digitação, por um software instalado na estação de trabalho. Ele mostra tarefas manuais repetitivas e é usado para decidir o que automatizar. O process mining olha o processo inteiro pelo sistema, o task mining olha a tarefa pela tela.

Como a UpFlux faz

A UpFlux começou com mineração de processos, em 2017, auditando contas médicas na Unimed Paraná, e é a única empresa brasileira no Magic Quadrant de Process Mining do Gartner, na edição de 2024, entre 18 fornecedores avaliados. Hoje o process mining é a primeira de três camadas. Na primeira, a UpFlux entende o processo real a partir dos dados do SAP, do Protheus, do Datasul, do Tasy e do MV. Na segunda, os agentes de IA agem sobre o que o mapa encontrou: cotam, negociam, auditam e acompanham dentro desses mesmos sistemas, com alçada definida e especialistas por trás. Na terceira, o RoAI prova o resultado, medindo em reais cada ação.

O primeiro mapa sai em cerca de duas semanas a partir do export do sistema, sem alterar nada nele, e o diagnóstico entrega o processo real, o alvo em reais e o plano do primeiro agente. Para o que o sistema não registra, o censo de processos por agente de IA entrevista todas as pessoas da área em paralelo. Veja a camada de Process Intelligence ou comece pelo diagnóstico.

Onde isto vira operação

Leia também