Mineração de processos (process mining): o que é, como funciona e exemplos
O que é mineração de processos (process mining), como o log de eventos do ERP vira o mapa do processo real, os três tipos de análise, um exemplo numérico, a diferença para BI, BPM e task mining e um roteiro para começar.

Mineração de processos, ou process mining, é a técnica que reconstrói como um processo acontece de verdade a partir dos registros que os sistemas gravam a cada etapa. Todo ERP, sistema hospitalar ou CRM anota quem fez o quê e quando: a requisição criada, o pedido aprovado, a nota lançada, o pagamento feito. Juntando esses registros caso a caso, o process mining desenha o caminho real de cada pedido, conta ou atendimento, com as variantes, os gargalos, o retrabalho e os desvios que nenhum fluxograma mostra.
A diferença para um mapa desenhado em workshop está na origem da informação. O fluxograma descreve como as pessoas acham que o processo funciona. A mineração de processos mostra como ele funcionou, evento por evento, em todos os casos do período, e não numa amostra. Este guia explica o conceito, o dado que ele exige, os três tipos de análise, um exemplo com números, a diferença para BI, BPM e task mining, os limites da técnica e um roteiro para começar.
O que é mineração de processos (process mining)
Mineração de processos é uma disciplina que fica entre a ciência de dados e a gestão de processos. Ela usa o log de eventos dos sistemas transacionais para descobrir o processo real, compará-lo com o processo desenhado e medir onde ele perde tempo e dinheiro. O resultado mais conhecido é o mapa do processo, mas o mapa é o começo: o que dá valor é a leitura caso a caso, que permite dizer quantos pedidos seguiram o caminho previsto, quantos deram voltas e quanto cada volta custou.
"Mineração de processos" é a tradução de process mining, e no Brasil os dois nomes convivem. A palavra "mineração" vem de mineração de dados: é garimpar o dado que o sistema já tem, e não minério. Por isso quem busca o tema costuma encontrar, misturados, textos sobre a indústria de mineração. Neste artigo, e no mercado de software, o termo quer dizer sempre a análise de processos a partir de dados.
A técnica nasceu na pesquisa acadêmica. O holandês Wil van der Aalst começou a desenvolvê-la no fim dos anos 1990, na Universidade Tecnológica de Eindhoven, e é até hoje a principal referência da área. Em 2009 o IEEE criou uma força-tarefa dedicada ao tema, que publicou em 2011 o Manifesto de Process Mining, com os princípios e desafios da disciplina. Na década seguinte o process mining virou categoria de software corporativo, e hoje o Gartner avalia os fornecedores no seu Magic Quadrant de Process Mining.
A imagem que melhor descreve a técnica é a de um raio-x. O processo existe no dado de qualquer forma. O process mining o torna visível, com a vantagem de que cada traço do desenho aponta para os casos reais que o formaram.
O que é um log de eventos
O log de eventos é a matéria-prima. É uma tabela em que cada linha registra que uma atividade aconteceu em um caso, em um momento. Três campos são obrigatórios:
- Identificador do caso: o objeto que atravessa o processo, como o número do pedido, da conta médica ou do chamado.
- Atividade: o que aconteceu, como "requisição aprovada" ou "nota fiscal lançada".
- Carimbo de tempo: data e hora em que aconteceu.
Com esses três campos já dá para desenhar o fluxo e medir tempos. Dois grupos de campos opcionais aumentam muito o que a análise consegue responder: o recurso (usuário, área ou rotina automática que executou a atividade) e os atributos do caso (valor, fornecedor, filial, categoria, convênio, tipo de atendimento).
Veja um trecho de log de compras, com dois pedidos:
| Caso | Atividade | Data e hora | Recurso |
|---|---|---|---|
| PC-1001 | Requisição criada | 03/03/2026 09:12 | Solicitante (manutenção) |
| PC-1001 | Requisição aprovada | 03/03/2026 16:40 | Gestor da área |
| PC-1001 | Pedido emitido | 05/03/2026 10:05 | Comprador 1 |
| PC-1001 | Nota fiscal lançada | 12/03/2026 14:22 | Fiscal |
| PC-1001 | Pagamento | 10/04/2026 08:00 | Rotina automática |
| PC-1002 | Nota fiscal lançada | 04/03/2026 11:30 | Fiscal |
| PC-1002 | Pedido emitido | 06/03/2026 09:47 | Comprador 2 |
| PC-1002 | Pagamento | 03/04/2026 08:00 | Rotina automática |
O PC-1001 seguiu o caminho previsto e levou 38 dias da requisição ao pagamento. O PC-1002 mostra um desvio clássico: a nota fiscal entrou antes de o pedido existir. É uma compra feita por fora, formalizada depois, que não passou por cotação. Em uma tabela de indicadores os dois pedidos aparecem iguais, como pedidos pagos. No log, a diferença salta à vista.
Como o log vira um mapa
O algoritmo ordena os eventos de cada caso pelo tempo e obtém a sequência de atividades daquele caso. Casos com a mesma sequência formam uma variante. Somando as passagens de uma atividade para a outra em todos os casos, ele desenha as setas do mapa, com a frequência de cada uma e o tempo médio entre as duas pontas. As famílias de algoritmo mais usadas (Alpha, Heuristic Miner, Inductive Miner) diferem na forma de lidar com ruído e com fluxos paralelos, mas a lógica é essa. Para trocar logs entre ferramentas existe um formato padrão, o XES, mantido pelo IEEE.
De onde vêm os dados: ERP, sistema hospitalar e CRM
Quase todo sistema transacional grava o que o process mining precisa. O trabalho está em juntar as tabelas certas e converter cada data relevante em evento.
- SAP: requisições (EBAN), pedidos (EKKO e EKPO), histórico do pedido com entradas de mercadoria e de fatura (EKBE), verificação de faturas (RBKP e RSEG), lançamentos contábeis (BKPF e BSEG) e os documentos de modificação (CDHDR e CDPOS), que dizem quem alterou o quê e quando. Veja process mining e agentes no SAP.
- TOTVS Protheus: solicitações de compra (SC1), cotações (SC8), pedidos de compra (SC7), aprovações por alçada (SCR), notas fiscais de entrada (SF1 e SD1) e títulos a pagar (SE2). O Datasul segue a mesma lógica, com tabelas próprias. Veja Protheus e Datasul.
- Sistemas hospitalares: no Tasy e no MV, os registros de atendimento, prescrição, exames, alta, conta e faturamento formam a jornada do paciente e o ciclo da conta médica. Veja Tasy e MV.
- CRM e atendimento: Salesforce e ServiceNow registram cada mudança de status de uma oportunidade ou de um chamado, o que basta para medir filas e reaberturas.
Duas regras valem para qualquer fonte. A extração é só de leitura: o process mining não altera o sistema, não grava nada nele e não exige customização. E o período precisa ser longo o bastante para mostrar o padrão, de seis a doze meses na maioria dos processos administrativos.
Os três tipos de mineração de processos
A literatura divide a técnica em três tipos de análise, e os três costumam aparecer juntos em um projeto.
- Descoberta (discovery). Parte só do log e reconstrói o processo, sem modelo prévio. Responde "como isto funciona de verdade?". É o tipo mais conhecido, detalhado em descoberta de processos.
- Conformidade (conformance checking). Compara o que aconteceu com o que deveria acontecer, seja um modelo BPMN, uma política ou uma regra de alçada. Aponta cada caso que tomou um atalho: aprovação pulada, pedido depois da nota, pagamento antes do recebimento. Veja análise de conformidade.
- Melhoria (enhancement). Enriquece o mapa com tempo, custo e recurso para mostrar onde o processo espera, quem está sobrecarregado e o que custa cada desvio. É a ponte para a melhoria contínua com process mining.
Com o dado atualizado com frequência, os três tipos deixam de ser um retrato de projeto e viram monitoramento: o desvio aparece enquanto o caso ainda está aberto, e não no relatório do mês seguinte.
O que a mineração de processos revela
Os achados de um projeto de process mining quase sempre caem em seis grupos:
- Variantes. Quantos caminhos diferentes o mesmo processo tem e quanto do volume segue o caminho previsto. É comum o caminho previsto responder por menos da metade dos casos.
- Gargalos. Onde o caso espera, e não onde ele é trabalhado. O tempo entre duas atividades costuma ser muito maior do que o tempo de executar cada uma.
- Retrabalho. O que volta: aprovação repetida, alteração de preço, estorno, reabertura. Cada volta tem custo de gente e de prazo. Veja o custo do retrabalho.
- Desvios de conformidade. Pedido criado depois da nota, aprovação fora da alçada, a mesma pessoa pedindo e aprovando, pagamento sem entrada de mercadoria.
- Automação. Quanto do fluxo já roda sem toque humano e onde a intervenção manual se concentra.
- Onde e com quem. Filial, fornecedor, categoria, convênio ou usuário que concentram o problema, que é o que transforma um achado genérico em ação específica.
Exemplo: um ano de compras lido pelo log
Os números abaixo são ilustrativos, de uma indústria hipotética, e servem para mostrar como se lê um resultado. A empresa extraiu do ERP 12 meses de compras: 18.400 pedidos e todos os eventos de cada um.
| O que o log mostra | Número | O que significa |
|---|---|---|
| Variantes distintas | 214 | O mesmo processo acontece de 214 formas |
| Caminho previsto (requisição, aprovação, pedido, nota, pagamento) | 41% dos pedidos (7.544) | A exceção é a regra: 59% seguem outro caminho |
| Pedido criado depois da nota fiscal | 13% (2.392) | Compra feita antes de o pedido existir, sem cotação |
| Pedido aprovado mais de uma vez | 15% (2.760) | Volta de aprovação por mudança de preço ou quantidade |
| Tempo da requisição ao pedido | 4 dias no caminho previsto e 12 com reaprovação | O gargalo é esperar a segunda aprovação, não cotar |
A conta do retrabalho de aprovação é direta. Se cada volta consome 25 minutos somados de comprador e aprovador, as 2.760 voltas dão 1.150 horas por ano. Com um custo carregado de R$ 85 por hora, são cerca de R$ 98 mil por ano, antes de contar o efeito do atraso sobre o preço e sobre a operação que esperava o material.
O achado mais caro, porém, é outro: os 2.392 pedidos retroativos. Eles são compras que chegaram ao fornecedor sem cotação e sem comparação com o preço que a própria empresa já pagou. O log mostra quantos são, de quais categorias e de quais filiais. O que ele não mostra é por que acontecem. Essa pergunta leva ao próximo passo, a process intelligence, que junta ao mapa o contexto, a causa e a ação.
Mineração de processos, BI, BPM, mapeamento e task mining
As cinco abordagens aparecem juntas nas conversas sobre processo e se complementam. A tabela resume o que cada uma responde:
| Abordagem | Pergunta que responde | De onde vem a informação | Limite |
|---|---|---|---|
| BI | Quanto e quantos | Indicadores agregados do data warehouse | Não mostra a sequência nem o caminho de cada caso |
| Mineração de processos | Como o processo aconteceu, caso a caso | Log de eventos dos sistemas | Só enxerga o que o sistema registra |
| BPM | Como o processo deve ser e como geri-lo | Modelos, regras e workflow | O modelo pode não bater com a realidade |
| Mapeamento por entrevista | Como as pessoas descrevem o trabalho | Entrevistas e workshops | Amostra pequena, memória e opinião |
| Task mining | O que a pessoa faz na tela | Captura da área de trabalho | Exige instalação no computador e vê cliques, não o processo |
Diferença entre BI e mineração de processos
O BI soma e divide: tempo médio de pagamento, número de pedidos, valor por categoria. O process mining segue cada caso do começo ao fim. A média de 38 dias para pagar pode esconder dois processos, um de 20 dias e outro de 70, e só a leitura caso a caso mostra quais pedidos estão em cada grupo e o que eles têm em comum. Um não substitui o outro: o indicador diz que algo mudou, o mapa diz onde e por quê.
Process mining e BPM
BPM é a gestão por processos: desenhar, padronizar, executar e melhorar. O process mining entrega ao BPM o que ele mais precisa, que é a realidade medida. Em vez de revisar o modelo em workshop, o time compara o modelo com o log e ajusta onde a diferença é maior. O guia de BPM cobre o ciclo completo.
Process mining e mapeamento de processos
O mapeamento de processos tradicional ouve as pessoas. O process mining lê o sistema. Os dois veem coisas diferentes: o log é exato sobre o que passou pelo sistema e cego para o que passou por fora dele, e a entrevista alcança o que o sistema não registra, mas depende da memória de quem responde. Os melhores diagnósticos usam os dois.
Task mining e RPA
Task mining registra as ações de cada pessoa na tela e mostra tarefas manuais repetitivas, boas candidatas a automação. RPA é outra coisa: não analisa, executa, repetindo uma sequência de cliques por regra. Os dois costumam ser o passo seguinte a um process mining, quando o mapa já mostrou onde vale automatizar.
Onde a mineração de processos é usada
Qualquer processo que deixa rastro em sistema pode ser minerado. Os mais comuns:
- Compras (procure-to-pay): pedido depois da nota, preço fora do histórico, fracionamento para fugir da alçada, lead time de requisição. Veja procure-to-pay.
- Contas a pagar: pagamento duplicado, antecipado ou com multa por atraso, e o custo de cada fatura bloqueada. Veja IA no contas a pagar.
- Order-to-cash: pedido travado em análise de crédito, faturamento parcial, prazo de recebimento. Veja order-to-cash.
- Saúde: jornada do paciente, pronto atendimento, giro de leitos e o ciclo da conta médica, da prescrição ao faturamento e à glosa. Veja process mining na saúde e auditoria de contas médicas.
- Indústria: ordens de produção, manutenção e o fluxo de materiais. Veja process mining na indústria 4.0.
- Melhoria contínua: Lean, Six Sigma e DMAIC usam o process mining como régua de medição antes e depois de cada mudança. Veja ciclo DMAIC.
Como começar um projeto de mineração de processos
- Escolha um processo e uma pergunta. "Por que 13% dos pedidos nascem depois da nota?" rende mais do que "mapear tudo". A pergunta define o período, os campos e quem precisa participar.
- Defina o caso e as atividades. O caso é o pedido, a requisição ou o item? Quando uma requisição vira vários pedidos, a escolha muda o mapa. Essa é a questão que a mineração de processos centrada em objetos (object-centric process mining) resolve, ao analisar vários objetos ligados de uma vez.
- Extraia o log com leitura. Consulta ou export das tabelas, de seis a doze meses, sem alterar o sistema.
- Valide o dado. Confira fuso horário, datas digitadas à mão, lançamentos em lote que carimbam o mesmo horário em centenas de casos e eventos duplicados. Um log ruim desenha um processo que não existe.
- Descubra e confira com quem executa. O mapa mostra o quê. Quem trabalha no processo explica o porquê, e costuma reconhecer na hora as variantes estranhas.
- Quantifique em reais. Tempo multiplicado pelo custo da hora, valor dos casos com desvio, multa, juro, preço pago acima do histórico. Achado sem número não disputa prioridade.
- Aja e meça no mesmo log. Corrija a regra, treine, automatize ou coloque um agente para executar a etapa. O mesmo log que mostrou o problema mede se ele diminuiu.
Limites: o que o log não mostra
O process mining é exato dentro do que o sistema registra, e é preciso saber onde isso termina.
- O que acontece fora do sistema não aparece. Negociação por WhatsApp, aprovação por e-mail, controle em planilha e ligação para o fornecedor ficam invisíveis. Para essa parte existem o task mining e o mapeamento de processos com IA, em que um agente entrevista todas as pessoas da área.
- A qualidade do carimbo de tempo manda. Se o sistema registra a data do lançamento e não a do fato, o tempo medido é o do registro.
- Um caso pode ter vários objetos. Pedido com várias notas, conta com várias guias. Sem tratar isso, o mapa duplica ou esconde eventos.
- O log diz o quê, não o porquê. A causa vem das pessoas e do contexto do negócio.
- Há dado pessoal no log. Usuário, paciente e fornecedor são dados protegidos pela LGPD. Pseudonimizar quem executa e restringir o acesso é parte do projeto, especialmente em saúde.
Como escolher uma ferramenta de process mining
Para aprender a técnica, as ferramentas de código aberto são o melhor ponto de partida: o ProM, criado na Universidade de Eindhoven, e as bibliotecas PM4Py, em Python, e bupaR, em R. Para uso corporativo, o Magic Quadrant do Gartner avaliou 18 fornecedores na edição de 2024. Na hora de escolher, sete critérios separam uma ferramenta que gera relatório de uma que muda o processo:
- Conectores para os sistemas que você usa. SAP é o caso comum. Protheus, Datasul, Tasy e MV não são, e o tempo de integração decide o prazo do projeto.
- Tempo até o primeiro mapa. Semanas, e não meses, a partir do export do sistema.
- Leitura caso a caso e conformidade. O mapa bonito importa menos do que abrir o caso concreto que formou cada seta.
- Valor em reais. Tempo é metade da história. O que prioriza é o dinheiro em cada desvio.
- Caminho até a ação. O que acontece depois do achado: alerta, automação, agente que executa a etapa dentro do sistema.
- Governança e LGPD. Quem vê o quê, e como o dado pessoal é protegido.
- Quem opera. Um centro de excelência interno ou um serviço que opera junto com o time. As duas formas funcionam, mas precisam estar no plano desde o início.
Da mineração de processos à process intelligence e aos agentes de IA
O process mining responde onde o processo perde tempo e dinheiro. Por muito tempo o projeto terminava aí, em um relatório com recomendações. O que mudou foi o que vem depois do mapa. A process intelligence junta ao mapa o contexto de negócio, o que o sistema não registra e a ação sobre o achado. E os agentes de IA passaram a executar a parte da rotina que o mapa mostrou ser repetitiva, dentro do próprio sistema e com alçada definida. O mapa diz onde agir. O agente age. O mesmo log prova o resultado.
Perguntas frequentes
O que é mineração de processos?
Mineração de processos, ou process mining, é a técnica que reconstrói o processo real de uma empresa a partir do log de eventos dos sistemas, como ERP, sistema hospitalar e CRM. Com o identificador do caso, a atividade e a data e hora de cada evento, ela desenha o caminho que cada pedido, conta ou atendimento percorreu, com as variantes, os gargalos, o retrabalho e os desvios em relação ao processo desenhado.
Mineração de processos e process mining são a mesma coisa?
São. Mineração de processos é a tradução de process mining, e no Brasil os dois nomes são usados. A palavra mineração vem de mineração de dados: a técnica garimpa o dado que os sistemas já gravam. Não tem relação com a indústria de mineração.
Quais são os tipos de process mining?
São três. A descoberta reconstrói o processo só a partir do log. A conformidade compara o que aconteceu com o modelo ou a regra e aponta cada desvio. A melhoria acrescenta tempo, custo e recurso ao mapa para mostrar gargalos e o custo de cada variante. Com dado atualizado com frequência, os três viram monitoramento contínuo.
Qual a diferença entre process mining e BI?
O BI mostra indicadores agregados, como tempo médio e volume, e responde quanto e quantos. O process mining segue cada caso do começo ao fim e responde como o processo aconteceu. Uma média de 38 dias pode esconder um grupo de pedidos de 20 dias e outro de 70, e só a leitura caso a caso mostra quais pedidos estão em cada grupo e por quê.
Quais dados são necessários para fazer process mining?
No mínimo, três campos por evento: o identificador do caso, a atividade e a data e hora. Com o recurso que executou cada atividade e atributos como valor, fornecedor, filial ou convênio, a análise passa a dizer onde e com quem o problema se concentra. Esses campos já existem nas tabelas do ERP e dos sistemas de gestão, e de seis a doze meses de histórico bastam na maioria dos processos.
Process mining precisa alterar o ERP?
Não. A extração é só de leitura, por consulta ou export das tabelas, e nada é gravado no sistema. Não há customização nem migração. O trabalho está em juntar as tabelas certas e converter cada data relevante em evento.
Quanto tempo leva para ter o primeiro mapa de processo?
Depende mais do dado do que da ferramenta. Com o export do sistema disponível e um processo bem delimitado, o primeiro mapa sai em semanas, e na UpFlux em cerca de duas. O que alonga o prazo é a integração com sistemas pouco padronizados e a validação do dado, por isso a escolha do primeiro processo deve considerar onde o dado está mais limpo.
Process mining substitui o mapeamento de processos por entrevista?
Não, complementa. O process mining é exato sobre o que passa pelo sistema e não vê o que acontece fora dele, como planilhas, e-mails e mensagens. O mapeamento com pessoas alcança essa parte e explica o porquê dos desvios. Um diagnóstico completo usa os dois.
O que é task mining?
Task mining é a captura das ações de cada pessoa no computador, como cliques, telas e digitação, por um software instalado na estação de trabalho. Ele mostra tarefas manuais repetitivas e é usado para decidir o que automatizar. O process mining olha o processo inteiro pelo sistema, o task mining olha a tarefa pela tela.
Como a UpFlux faz
A UpFlux começou com mineração de processos, em 2017, auditando contas médicas na Unimed Paraná, e é a única empresa brasileira no Magic Quadrant de Process Mining do Gartner, na edição de 2024, entre 18 fornecedores avaliados. Hoje o process mining é a primeira de três camadas. Na primeira, a UpFlux entende o processo real a partir dos dados do SAP, do Protheus, do Datasul, do Tasy e do MV. Na segunda, os agentes de IA agem sobre o que o mapa encontrou: cotam, negociam, auditam e acompanham dentro desses mesmos sistemas, com alçada definida e especialistas por trás. Na terceira, o RoAI prova o resultado, medindo em reais cada ação.
O primeiro mapa sai em cerca de duas semanas a partir do export do sistema, sem alterar nada nele, e o diagnóstico entrega o processo real, o alvo em reais e o plano do primeiro agente. Para o que o sistema não registra, o censo de processos por agente de IA entrevista todas as pessoas da área em paralelo. Veja a camada de Process Intelligence ou comece pelo diagnóstico.
Onde isto vira operação
- Process IntelligenceO processo real como o ERP registrou: onde ele trava, quanto custa cada volta e o que vale automatizar.
- Do processo medido ao agente que executaDepois de enxergar o processo real, o passo seguinte é o agente que trabalha dentro do sistema — e prova o que devolveu.
- Capacidade em comprasDo diagnóstico do processo ao agente que executa a rotina dentro do sistema.


