Classificação de produtos: como criar categorias claras para Retail Media
A classificação por categoria de produtos é o ato de decidir a qual categoria cada produto pertence dentro de um sistema de categorização. Parece simples até que um produto possa, com razão, se encaixar em três categorias, os dados de origem estejam incompletos ou o mesmo item seja descrito de maneiras diferentes por um fornecedor, um varejista e uma plataforma de Retail Media.
A Retail Media torna essas divergências dispendiosas. A classificação determina quais produtos se qualificam para uma audiência, quais vendas contam para uma campanha, quais concorrentes aparecem em uma comparação e quais itens um planejador pode ativar. Se as atribuições estiverem erradas, a campanha pode ser executada exatamente como planejada e, mesmo assim, responder à pergunta comercial errada.
Este guia enfoca como um varejista ou plataforma atribui produtos a grupos bem definidos e testa essas atribuições. A camada mais ampla de taxonomia de produtos e mapeamento de SKUs define a hierarquia, a identidade do SKU e as relações entre sistemas das quais a classificação depende. Uma vez que esses conjuntos de produtos sejam confiáveis, eles podem dar suporte a usos posteriores, como audiências com afinidade por categoria.
Classificação, taxonomia e mapeamento de SKUs são tarefas diferentes
Uma taxonomia é a estrutura de categorias: por exemplo, Mercearia > Lanches > Barras > Barras de proteína. A classificação é a decisão de que um determinado produto pertence a um ou mais nós nessa estrutura. O mapeamento de SKUs conecta os identificadores de produto, variantes e embalagens do varejista aos registros corretos de produto e taxonomia.
Essa distinção é importante porque cada tarefa apresenta falhas de maneiras diferentes. Uma taxonomia pode ser mal projetada, mesmo quando todos os itens a seguem de forma consistente. Uma taxonomia sensata ainda pode conter milhares de produtos classificados incorretamente. Atribuições corretas de categoria também podem estar vinculadas a registros de SKUs duplicados ou obsoletos.
A Classificação Global de Produtos da GS1 oferece aos parceiros comerciais uma hierarquia comum para agrupar produtos (Classificação Global de Produtos da GS1). Um varejista pode usar a GPC, uma hierarquia proprietária ou ambas. O Google também mantém um sistema predefinido de categorias de produtos para feeds de compras, ao mesmo tempo em que permite que os comerciantes enviem sua própria hierarquia de `product_type` (orientação do Google sobre categorias de produtos). Esses exemplos mostram o padrão prático: uma classificação externa controlada pode coexistir com uma visão interna específica da empresa, mas a relação entre elas deve ser explícita.
Comece pela decisão que a classe deve apoiar
Não existe uma atribuição de categoria universalmente perfeita. A atribuição útil depende da decisão.
Uma barra de proteína pode ser analisada como um lanche, um produto de nutrição esportiva, um substituto de refeição ou um alimento voltado para a saúde. A resposta errada é forçar todos os casos de uso a se enquadrarem em um único rótulo. A melhor resposta é estabelecer uma classe de mercadoria principal e, em seguida, adicionar facetas ou mapeamentos regulamentados para usos alternativos.
Antes de alterar as regras, defina as funções que a classificação deve apoiar:
- navegação e descoberta de produtos;
- gestão de sortimento e categorias;
- criação de público-alvo;
- definição do conjunto competitivo;
- elegibilidade da campanha;
- relatórios de vendas e incrementalidade;
- requisitos de feeds externos.
Se se espera que um único campo execute todas as sete tarefas, os conflitos são inevitáveis. Uma hierarquia é boa para agrupamentos. Atributos e facetas são melhores para descrever características como vegano, premium, embalagem familiar, pele sensível ou compatível com um determinado dispositivo.
Crie um contrato de classificação
Um contrato de classificação é uma especificação breve e testável para cada categoria importante. Ele deve incluir:
- Escopo: o que a categoria significa em linguagem simples.
- Regras de inclusão: os atributos ou funções do produto que qualificam um item.
- Regras de exclusão: produtos semelhantes que não devem ser incluídos.
- Evidências necessárias: quais campos de origem sustentam a decisão.
- Regra de desempate: o que acontece quando várias categorias se encaixam.
- Mapeamentos secundários permitidos: onde visões analíticas alternativas são permitidas.
- Responsável e data de revisão: quem resolve disputas e quando a regra é reconsiderada.
Considere uma classe hipotética de “bebidas à base de plantas”. A inclusão pode exigir uma bebida cuja base principal seja aveia, soja, amêndoa, coco ou outro ingrediente não lácteo. As exclusões podem abranger leite com aditivos vegetais, suplementos em pó e bebidas à base de iogurte. A classe principal poderia seguir a forma do produto, enquanto uma faceta alimentar separada captasse o status vegano. Isso é muito mais seguro do que classificar apenas com base em palavras-chave do título.
Use evidências em uma ordem definida
Os títulos dos produtos são úteis, mas pouco confiáveis. “Infantil”, “light”, “proteína” ou “natural” podem descrever o posicionamento, e não o tipo de produto. A classificação deve basear-se nas evidências mais sólidas disponíveis, em uma ordem fixa, como:
- tipo de fabricante ou fornecedor verificado;
- atributos regulamentados ou padronizados do produto;
- especificações de ingredientes, materiais ou técnicas;
- dados sobre embalagem e uso;
- mapeamentos controlados entre marcas e linhas de produtos;
- texto de título e descrição;
- evidências comportamentais ou de compras associadas para análise, e não reatribuição automática.
A especificação de dados de produtos do Google exige dados precisos e formatados corretamente, além de informações consistentes sobre preço e disponibilidade (especificação de dados de produtos do Google). A mesma disciplina se aplica internamente. Um classificador não deve inferir uma característica do produto que contradiga o registro oficial do produto.
O aprendizado de máquina pode acelerar o trabalho, mas não elimina a necessidade de um acordo. Um modelo pode propor rótulos e índices de confiança. Ele não pode decidir, sem regras de negócios, se um item de dupla finalidade deve ser classificado por ingredientes, localização na prateleira, uso dos shoppers ou necessidade de relatório.
Um fluxo de trabalho prático de classificação
Um fluxo de trabalho robusto separa o trabalho determinístico do julgamento.
1. Normalize o registro
Padronize unidades, quantidades por embalagem, nomes de marcas e valores de atributos controlados. Remova marcações e ruídos óbvios dos fornecedores sem excluir distinções significativas. Preserve o valor de origem e sua proveniência.
2. Resolver a identidade primeiro
Confirme se o registro representa o produto e a variante corretos. A GS1 observa que os GTINs identificam de forma exclusiva os itens comerciais (padrão GS1 GTIN). A classificação realizada antes da resolução de duplicatas e variantes pode gerar várias etiquetas conflitantes para o mesmo item.
3. Aplique regras de alta certeza
Utilize regras para casos com evidências explícitas: um tipo de produto declarado, uma classe regulamentada, uma linha de marcas conhecida ou uma combinação de atributos inequívoca. Crie versões das regras e registre qual delas foi acionada.
4. Classifique registros ambíguos
Utilize um modelo estatístico ou de linguagem para classificar as classes candidatas. Armazene as principais candidatas, o nível de confiança e as características utilizadas. Um limite de confiança deve encaminhar produtos incertos ou comercialmente sensíveis para revisão, em vez de forçar a atribuição de uma etiqueta.
5. Revise as exceções
Os revisores humanos precisam ter as evidências do produto, as categorias candidatas e a explicação da regra em uma única tela. Eles devem selecionar uma classe, indicar o motivo e decidir se o caso revela uma nova regra ou apenas uma exceção pontual.
6. Publique com histórico
O registro de produção deve conter a classe atribuída, o método de classificação, a versão de origem, o carimbo de data/hora e a regra ou o identificador do revisor. Sem o histórico, as equipes não conseguem explicar por que a audiência de ontem difere da de hoje.
Teste o impacto nos negócios, não apenas a precisão do modelo
Uma pontuação global de precisão pode ocultar os erros mais importantes. Uma alta precisão agregada ainda pode esconder erros graves em uma categoria em rápido crescimento, pacotes promocionais ou toda a linha de produtos de uma marca.
Utilize várias verificações:
- cobertura: proporção de produtos ativos com uma classe válida;
- precisão por categoria importante: proporção de itens atribuídos que realmente pertencem à categoria;
- recall por categoria importante: proporção de itens relevantes que foram encontrados;
- taxa de abstenção: proporção encaminhada para revisão;
- desvio: alteração nas atribuições após atualizações de feed, regras ou modelos;
- erro ponderado comercialmente: classificação incorreta ponderada por vendas, exposição da campanha ou importância estratégica;
- reconciliação a jusante: diferenças nas contagens de audiências e nas vendas relatadas causadas por mudanças na classificação.
As diretrizes de medição de Retail Media enfatizam um escopo definido de produtos e limites consistentes para a geração de relatórios (Diretrizes de Medição de Retail Media da IAB/MRC). O controle de qualidade da classificação faz parte desse controle de limites. Os conjuntos de produtos promovidos e produtos de halo de uma campanha devem ser congelados ou versionados antes do lançamento, e não reconstruídos a partir de uma taxonomia alterada após o resultado ser conhecido.
Exemplo prático: classificação de uma linha de lanches proteicos
Imagine que uma marca lança uma linha contendo uma única barra proteica, um multipack, um shake em pó e um shake pronto para beber.
Um classificador baseado em título e palavra-chave pode colocar todos os quatro na categoria “barras proteicas”. Um processo mais claro separa forma e finalidade:
- a barra individual e o multipack compartilham a família de produtos “barras”, mas possuem registros de item comercial distintos;
- o em pó pertence à categoria de nutrição em pó;
- o item pronto para beber pertence à categoria de bebidas funcionais ou nutrição pronta para beber na hierarquia principal do varejista;
- todos os quatro podem receber uma faceta analítica regulamentada de “nutrição esportiva”;
- apenas as barras participam de uma campanha cujo escopo de produto seja barras proteicas;
- uma audiência mais ampla de nutrição esportiva pode utilizar a faceta em todos os quatro.
Esse projeto evita a pretensão de que uma única árvore de categorias possa expressar todas as relações comerciais. Ele também oferece ao planejador uma resposta reproduzível quando questionado sobre quais vendas foram incluídas.
Questões de governança que os compradores devem fazer
Antes de usar dados de produtos classificados para mídia, pergunte:
- Quais hierarquia e versão estão ativas?
- Qual porcentagem dos produtos foi atribuída por regras, modelos e pessoas?
- Quais categorias apresentam o maior erro ponderado?
- Um produto pode ter mapeamentos analíticos secundários?
- Como são tratados pacotes, variantes, marcas próprias e itens sazonais?
- O que acontece quando os dados do fornecedor entram em conflito com os dados do varejista?
- Os conjuntos de produtos de campanha recebem versões no momento do lançamento?
- A plataforma consegue reproduzir uma audiência ou relatório antigo a partir do estado de classificação utilizado na época?
Essas perguntas transformam a classificação de uma simples promessa de limpeza do catálogo em um processo operacional auditável.
Perguntas frequentes
A classificação de produtos é a mesma coisa que taxonomia de produtos?
Não. A taxonomia define as categorias disponíveis e suas relações. A classificação atribui os produtos a essas categorias.
Todo produto deve ter apenas uma categoria?
Normalmente, um produto precisa de uma classe primária regulamentada para agrupamentos, mas também pode precisar de mapeamentos secundários controlados ou facetas para usos analíticos e de ativação válidos.
A IA pode classificar um catálogo inteiro automaticamente?
Ela pode classificar muitos casos claros e classificar candidatos para os casos mais difíceis. Registros de alto impacto e baixa confiança ainda precisam de regras, revisão e monitoramento.
Com que frequência as classificações devem ser atualizadas?
Atualize quando produtos, atributos, feeds de origem ou regras de categoria forem alterados. Monitore continuamente os produtos não classificados e os desvios de atribuição, em vez de depender apenas de uma limpeza anual.
O que as equipes de Retail Media devem congelar antes de uma campanha?
Congele ou crie versões do conjunto de SKUs promovidos, do escopo da categoria, do conjunto definido de produtos de halo, das exclusões e da versão de classificação usada para construir audiências e relatórios.
Conclusão
Grupos de produtos bem organizados não surgem apenas ao definir uma hierarquia e esperar que os fornecedores a sigam. Eles resultam de definições explícitas de classes, regras baseadas em evidências, resolução de identidade, tratamento de exceções e testes posteriores. Trate a classificação como um sistema de decisão com versões. Assim, as audiências e os relatórios poderão explicar exatamente quais produtos foram incluídos e por quê.
Quer ver como isso funciona na prática?
A Footprints AI ajuda marcas e varejistas a medir o que realmente importa. Conheça nossos cases de sucesso ou entre em contato para conversar sobre sua estratégia de Retail Media.



