← Insights
Supply Chain na prática 2 de setembro de 2026 4 min de leitura

A reclassificação manual de spend é o gargalo do diagnóstico de sourcing

Em diagnóstico de sourcing, antes de qualquer análise valer alguma coisa, existe uma etapa que raramente aparece no cronograma do projeto: reclassificar o spend na mão. Perfil de categoria, dimensionamento de oportunidade e posicionamento por quadrante dependem de um baseline pronto, e o baseline não fica pronto enquanto a base estiver como o ERP a entrega.

Nos projetos que toquei, essa etapa consome as duas primeiras semanas do diagnóstico com uma regularidade que virou parte do meu planejamento de escopo. A base sempre chega suja, e historicamente ficava assim até um analista dedicado passar dias reclassificando linha a linha, numa planilha, contra uma árvore de categorias montada para outro propósito.

No caso mais recente que conduzi, a base chegou em oito arquivos, com quase sete milhões de linhas de dois anos de compras. Recortado o ano em análise, sobraram quase 900 mil linhas, seis mil fornecedores e mais de 400 subfamílias sob doze categorias macro, somando um spend na casa dos bilhões de reais.

Três sujeiras na mesma base

A classificação original foi feita pelos requisitantes ao longo dos anos, lançada sobre uma taxonomia herdada da contabilidade, montada para fechar balanço. Essa origem desalinha categoria e realidade de compra em boa parte das linhas.

A isso se soma um problema técnico: cerca de um terço dos registros tinha encoding corrompido, sintoma comum de bases que passaram por mais de uma migração de sistema ao longo dos dois anos cobertos. E os fornecedores apareciam duplicados por variação de grafia, incluindo casos do mesmo fornecedor cadastrado duas vezes, uma pelo nome fantasia e outra pela razão social. Só na consolidação dos oito arquivos originais, 250 mil linhas eram duplicata.

Nenhuma dessas três sujeiras se resolve isoladamente. Corrigir encoding sem tratar duplicidade de fornecedor deixa o spend fragmentado entre dois cadastros do mesmo fornecedor; consolidar fornecedores sem corrigir a taxonomia mantém categorias erradas, só que agora com dado limpo.

O que o agente faz

Fiz esse trabalho de reclassificação em dois dias. O que antes exigia um analista dedicado por etapa, com script sob medida para cada uma, hoje descrevo em linguagem natural e rodo sobre a base inteira.

O agente cruza a base contra uma árvore de categorias de três níveis, identifica caracteres corrompidos pelo contexto da palavra ao redor, consolida as variantes de nome de um mesmo fornecedor e devolve o delta contra a classificação anterior, linha a linha. Cada uma dessas quatro frentes era, até pouco tempo, um projeto pequeno dentro do projeto maior, com analista dedicado e script sob medida.

A árvore de categorias não nasce do zero: chega montada a partir de taxonomias de mercado e das árvores que sobraram de diagnósticos anteriores em outras indústrias. Partir de uma referência externa é o que permite comparar o cliente contra o mercado.

Onde o nome do fornecedor não basta para decidir a categoria, o agente busca fora o que a empresa realmente faz. A conferência nome a nome continua comigo, mas só nos fornecedores que concentram 80% do spend, onde um erro de categoria custa dinheiro na negociação. O tail entra direto na validação com os compradores.

O que a velocidade destrava

A reclassificação assistida por agente resultou em cerca de 3% a mais de spend endereçável do que a classificação anterior enxergava. Num escopo de bilhões, três por cento de diferença é o que decide se uma categoria inteira entra na conversa de sourcing daquele ciclo.

O segundo ganho pesa tanto quanto o primeiro: rastreabilidade. Cada linha que mudou de lugar carrega o critério que a moveu e o valor deslocado. Quando um comprador contesta a categoria de uma linha, a resposta é uma consulta ao registro.

A validação com os donos de categoria não encolheu com a reclassificação mais rápida. As entrevistas mudaram de posição no cronograma: entram depois, como segundo cross-check na montagem da apresentação, confrontando a árvore de spend e as oportunidades por categoria contra o que cada dono de categoria conhece da própria operação.

Implicação para gestores

A decisão que importa aqui não é se confiar em classificação automática. É onde manter o julgamento humano ancorado e onde deslocá-lo para conferência. Neste projeto, o corte foi pela concentração de spend: 80% do valor sob checagem nome a nome, o restante validado em lote com quem compra no dia a dia. Um gestor avaliando adotar esse tipo de reclassificação no próprio time precisa definir esse corte antes de rodar a primeira base, não depois de encontrar o primeiro erro caro.

O segundo ponto é sobre o que fazer com o tempo que sobra. Duas semanas saindo do caminho crítico de um diagnóstico geram valor na medida em que são redirecionadas para as entrevistas e para as hipóteses que de fato movem a decisão de sourcing. Um time que ganha duas semanas e as gasta olhando a mesma base de outro jeito trocou de gargalo, sem avançar no diagnóstico.

O terceiro ponto é sobre a confiabilidade do registro. A rastreabilidade linha a linha muda a natureza da conversa com o dono de categoria. Ele recebe o critério e o valor de cada movimentação e usa esse registro para contestar ou confirmar a mudança. É esse registro, mais do que a velocidade, que determina se a validação subsequente é rápida ou vira uma nova rodada de negociação sobre o próprio baseline.

As duas semanas que saíram do caminho crítico eram trabalho manual. A pergunta que levo para a primeira entrevista com o dono de categoria continua custando o mesmo tempo de sempre, e é ela que decide se o tempo ganho vira análise ou vira mais tempo olhando a base.

Este artigo foi publicado originalmente no LinkedIn — ver post original ↗