Klasyfikacja produktów: jak tworzyć przejrzyste kategorie dla Retail Media
Klasyfikacja kategorii produktów polega na ustaleniu, do której kategorii należy dany produkt w ramach systemu kategoryzacji. Brzmi to prosto, dopóki nie pojawi się sytuacja, w której produkt mógłby zasadniczo znaleźć się w trzech miejscach, dane źródłowe są niekompletne lub ten sam produkt jest różnie opisywany przez dostawcę, sprzedawcę detalicznego i platformę Retail Media.
W przypadku Retail Media takie rozbieżności generują wysokie koszty. Klasyfikacja określa, które produkty kwalifikują się do danej audiencji, które transakcje sprzedaży są uwzględniane w kampanii, którzy konkurenci pojawiają się w analizie porównawczej oraz które pozycje może aktywować planista. Jeśli przypisania są błędne, kampania może zostać zrealizowana dokładnie zgodnie z planem, a mimo to udzieli błędnej odpowiedzi na pytanie biznesowe.
Niniejszy przewodnik skupia się na tym, w jaki sposób detalista lub platforma przypisuje produkty do przejrzystych grup i weryfikuje te przypisania. Szersza taksonomia produktów oraz warstwa mapowania kodów SKU definiują hierarchię, tożsamość kodów SKU oraz relacje między systemami, od których zależy klasyfikacja. Gdy te zestawy produktów są już wiarygodne, mogą wspierać dalsze zastosowania, takie jak audiencje o podobnych preferencjach kategorycznych.
Klasyfikacja, taksonomia i mapowanie SKU to różne zadania
Taksonomia to struktura kategorii: na przykład Artykuły spożywcze > Przekąski > Batony > Batony proteinowe. Klasyfikacja to decyzja, że dany produkt należy do jednego lub więcej węzłów w tej strukturze. Mapowanie kodów SKU łączy identyfikatory produktów sprzedawcy detalicznego, warianty i opakowania z właściwymi rekordami produktów i taksonomii.
To rozróżnienie ma znaczenie, ponieważ każde z tych zadań może zakończyć się niepowodzeniem z innych powodów. Taksonomia może być źle zaprojektowana, nawet jeśli wszystkie pozycje są do niej konsekwentnie przyporządkowane. Rozsądna taksonomia może nadal zawierać tysiące błędnie sklasyfikowanych produktów. Prawidłowe przypisania do kategorii mogą być również powiązane z zduplikowanymi lub nieaktualnymi rekordami SKU.
Globalna klasyfikacja produktów GS1 (GS1 Global Product Classification) zapewnia partnerom handlowym wspólną hierarchię do grupowania produktów. Sprzedawca detaliczny może korzystać z GPC, własnej hierarchii lub obu tych rozwiązań. Google również utrzymuje predefiniowany system kategorii produktów dla plików danych zakupowych, jednocześnie umożliwiając sprzedawcom przesyłanie własnej hierarchii `product_type` (wytyczne Google dotyczące kategorii produktów). Przykłady te pokazują praktyczny schemat: kontrolowana klasyfikacja zewnętrzna może współistnieć z wewnętrznym modelem specyficznym dla danej firmy, ale relacja między nimi musi być jasno określona.
Zacznij od decyzji, którą klasa musi wspierać
Nie ma uniwersalnego, idealnego przyporządkowania do kategorii. Przydatne przyporządkowanie zależy od konkretnej decyzji.
Batony proteinowe można analizować jako przekąski, produkty odżywcze dla sportowców, zamienniki posiłków lub żywność prozdrowotną. Błędnym podejściem jest wtłaczanie każdego przypadku użycia w jedną etykietę. Lepszym rozwiązaniem jest ustalenie głównej klasy towarowej, a następnie dodanie regulowanych aspektów lub mapowań dla alternatywnych zastosowań.
Przed zmianą zasad należy określić zadania, które klasyfikacja musi wspierać:
- nawigacja i wyszukiwanie produktów;
- zarządzanie asortymentem i kategoriami;
- budowanie grupy docelowej;
- określenie grupy konkurentów;
- kwalifikowalność do kampanii;
- raportowanie sprzedaży i inkrementalności;
- wymagania dotyczące zewnętrznych plików danych.
Jeśli oczekuje się, że jedno pole będzie pełniło wszystkie siedem funkcji, konflikty są nieuniknione. Hierarchia sprawdza się dobrze w agregowaniu danych. Atrybuty i aspekty lepiej nadają się do opisywania cech, takich jak wegański, premium, opakowanie rodzinne, dla skóry wrażliwej lub kompatybilny z konkretnym urządzeniem.
Stwórz umowę klasyfikacyjną
Umowa klasyfikacyjna to krótka, sprawdzalna specyfikacja dla każdej ważnej kategorii. Powinna zawierać:
- Zakres: co oznacza dana kategoria w prostym języku.
- Zasady włączenia: atrybuty lub funkcje produktu, które kwalifikują dany element.
- Zasady wykluczenia: podobne produkty, które nie mogą zostać uwzględnione.
- Wymagane dowody: które pola źródłowe stanowią podstawę decyzji.
- Zasada rozstrzygania remisów: co się dzieje, gdy pasuje kilka kategorii.
- Dopuszczalne mapowania dodatkowe: gdzie dozwolone są alternatywne ujęcia analityczne.
- Właściciel i data przeglądu: kto rozstrzyga spory i kiedy zasada jest ponownie rozpatrywana.
Rozważmy hipotetyczną klasę „napojów pochodzenia roślinnego”. Włączenie do tej klasy może wymagać, aby napój miał jako główną bazę owies, soję, migdały, kokos lub inny składnik niebędący nabiałem. Wykluczenia mogą obejmować mleko zwierzęce z dodatkami roślinnymi, suplementy w proszku oraz napoje jogurtowe. Główna klasa mogłaby opierać się na formie produktu, podczas gdy oddzielny aspekt dietetyczny uwzględniałby status wegański. Jest to znacznie bezpieczniejsze niż klasyfikowanie wyłącznie na podstawie słów kluczowych w tytule.
Wykorzystaj dowody w określonej kolejności
Nazwy produktów są przydatne, ale niewiarygodne. Słowa takie jak „dla dzieci”, „light”, „białkowe” czy „naturalne” mogą opisywać raczej pozycjonowanie produktu niż jego rodzaj. Klasyfikacja powinna opierać się na najsilniejszych dostępnych dowodach w ustalonej kolejności, na przykład:
- zweryfikowany typ producenta lub dostawcy;
- regulowane lub znormalizowane cechy produktu;
- składniki, materiały lub specyfikacje techniczne;
- dane dotyczące opakowania i sposobu użycia;
- kontrolowane powiązania między markami a asortymentem;
- tytuł i tekst opisu;
- dane behawioralne lub dotyczące zakupów powiązanych do weryfikacji, a nie cichego przypisywania.
Specyfikacja danych produktowych Google wymaga dokładnych, poprawnie sformatowanych danych o produkcie oraz spójnych informacji o cenie i dostępności (specyfikacja danych produktowych Google). Te same zasady obowiązują również wewnętrznie. Klasyfikator nie powinien wyciągać wniosków dotyczących produktu, które są sprzeczne z autorytatywnym rekordem produktu.
Uczenie maszynowe może przyspieszyć pracę, ale nie eliminuje potrzeby zawarcia umowy. Model może proponować etykiety i wskaźniki pewności. Nie może jednak, bez reguł biznesowych, zdecydować, czy produkt o podwójnym przeznaczeniu powinien zostać przypisany na podstawie składników, lokalizacji na półce, zastosowania przez shoppers czy potrzeby raportowania.
Praktyczny proces klasyfikacji
Solidny proces oddziela zadania deterministyczne od tych wymagających osądu.
1. Normalizacja rekordu
Ujednolicenie jednostek miary, liczby opakowań, nazw marek i wartości atrybutów podlegających kontroli. Usunięcie nadmiarowych oznaczeń i oczywistych zakłóceń pochodzących od dostawców bez usuwania istotnych różnic. Zachowanie wartości źródłowej i jej pochodzenia.
2. Najpierw ustal tożsamość
Należy upewnić się, że rekord odnosi się do właściwego produktu i wariantu. GS1 zwraca uwagę, że kody GTIN jednoznacznie identyfikują pozycje handlowe (standard GS1 GTIN). Klasyfikacja przeprowadzona przed rozróżnieniem duplikatów i wariantów może spowodować powstanie kilku sprzecznych etykiet dla tej samej pozycji.
3. Zastosuj reguły o wysokim stopniu pewności
W przypadkach, w których istnieją wyraźne dowody, zadeklarowany typ produktu, klasa podlegająca regulacjom, znana gama marek lub jednoznaczna kombinacja atrybutów, należy stosować reguły. Należy tworzyć wersje reguł i rejestrować, która z nich została uruchomiona.
4. Ocena rekordów niejednoznacznych
Wykorzystaj model statystyczny lub językowy do uszeregowania potencjalnych klas. Zapisz najlepsze kandydatury, poziom pewności oraz wykorzystane cechy. Próg pewności powinien kierować produkty niepewne lub wrażliwe pod względem handlowym do weryfikacji, zamiast wymuszać przypisanie etykiety.
5. Sprawdzaj wyjątki
Osoby dokonujące weryfikacji potrzebują mieć na jednym ekranie informacje o produkcie, kategorie kandydujące oraz wyjaśnienie reguły. Powinny wybrać klasę, zaznaczyć powód i zdecydować, czy dany przypadek wskazuje na nową regułę, czy jest to tylko jednorazowy wyjątek.
6. Publikuj z informacją o pochodzeniu
Rekord produkcyjny powinien zawierać przypisaną klasę, metodę klasyfikacji, wersję źródłową, sygnaturę czasową oraz identyfikator reguły lub recenzenta. Bez historii pochodzenia zespoły nie są w stanie wyjaśnić, dlaczego wczorajsza audiencja różni się od dzisiejszej.
Sprawdzaj wpływ na biznes, a nie tylko dokładność modelu
Ogólny wskaźnik dokładności może ukrywać błędy, które mają największe znaczenie. Wysoka zbiorcza dokładność może nadal maskować poważne błędy w szybko rozwijającej się kategorii, pakietach promocyjnych lub pełnej ofercie marki.
Zastosuj kilka rodzajów kontroli:
- zasięg: odsetek aktywnych produktów z prawidłową klasą;
- precyzja według ważnych kategorii: odsetek przypisanych pozycji, które rzeczywiście do nich należą;
- odzyskiwalność według ważnych kategorii: odsetek znalezionych odpowiednich pozycji;
- wskaźnik wstrzymania się od oceny: odsetek pozycji skierowanych do weryfikacji;
- odchylenie: zmiana przypisania po aktualizacji danych wejściowych, reguł lub modelu;
- błąd ważony komercyjnie: błędna klasyfikacja ważona sprzedażą, ekspozycją kampanii lub znaczeniem strategicznym;
- uzgodnienie na dalszym etapie: różnice w liczbie audiencji i zgłoszonej sprzedaży spowodowane zmianami w klasyfikacji.
Wytyczne dotyczące pomiaru Retail Media kładą nacisk na zdefiniowany zakres produktów i spójne granice raportowania (Wytyczne IAB/MRC dotyczące pomiaru Retail Media). Kontrola jakości klasyfikacji stanowi część tej kontroli granic. Zbiory produktów promowanych i produktów halo w ramach kampanii powinny zostać zamrożone lub opatrzone numerami wersji przed uruchomieniem, a nie odtwarzane na podstawie zmienionej taksonomii po poznaniu wyników.
Przykład praktyczny: klasyfikacja asortymentu przekąsek białkowych
Wyobraźmy sobie, że marka wprowadza na rynek asortyment zawierający jeden baton proteinowy, opakowanie zbiorcze, koktajl w proszku oraz gotowy do spożycia koktajl.
Klasyfikator oparty na słowach kluczowych w nazwie może umieścić wszystkie cztery produkty w kategorii „batony białkowe”. Bardziej przejrzysty proces rozdziela formę od przeznaczenia:
- pojedynczy baton i opakowanie zbiorcze należą do tej samej rodziny produktów „batony”, ale mają odrębne rekordy asortymentowe;
- koktajl w proszku należy do kategorii odżywek w proszku;
- produkt gotowy do spożycia należy do kategorii napojów funkcjonalnych lub odżywek gotowych do spożycia w ramach głównej hierarchii sprzedawcy detalicznego;
- wszystkie cztery mogą otrzymać regulowany aspekt analityczny „odżywianie sportowe”;
- tylko batony są uwzględniane w kampanii, której zakres produktowy obejmuje batony proteinowe;
- szersza grupa odbiorców odżywek sportowych może korzystać z tego aspektu w odniesieniu do wszystkich czterech produktów.
Taki projekt pozwala uniknąć sytuacji, w której jedno drzewo kategorii miałoby odzwierciedlać wszystkie relacje handlowe. Daje to również planistom powtarzalną odpowiedź na pytanie, które wyniki sprzedaży zostały uwzględnione.
Kwestie związane z zarządzaniem, o które powinni zapytać nabywcy
Przed wykorzystaniem sklasyfikowanych danych o produktach w mediach należy zapytać:
- Która hierarchia i wersja są aktywne?
- Jaki procent produktów został przypisany na podstawie reguł, modeli i przez ludzi?
- Które kategorie mają najwyższy błąd ważony?
- Czy produkt może mieć dodatkowe mapowania analityczne?
- W jaki sposób obsługiwane są zestawy, warianty, marki własne i produkty sezonowe?
- Co się dzieje, gdy dane dostawcy są sprzeczne z danymi sprzedawcy detalicznego?
- Czy zestawy produktów w kampanii są wersjonowane w momencie uruchomienia?
- Czy platforma może odtworzyć dawną audiencję lub raport na podstawie stanu klasyfikacji obowiązującego w tamtym czasie?
Te pytania sprawiają, że klasyfikacja przestaje być jedynie obietnicą uporządkowania katalogu, a staje się procesem operacyjnym podlegającym audytowi.
Często zadawane pytania
Czy klasyfikacja produktów to to samo, co taksonomia produktów?
Nie. Taksonomia definiuje dostępne kategorie i relacje między nimi. Klasyfikacja przypisuje produkty do tych kategorii.
Czy każdy produkt powinien należeć tylko do jednej kategorii?
Produkt zazwyczaj wymaga jednej, regulowanej klasy głównej do tworzenia zestawień zbiorczych, ale może również wymagać kontrolowanych przyporządkowań drugorzędnych lub aspektów w celu zapewnienia prawidłowej analizy i aktywacji.
Czy sztuczna inteligencja może automatycznie sklasyfikować cały katalog?
Może sklasyfikować wiele oczywistych przypadków i uszeregować kandydatów w trudnych przypadkach. Rekordy o dużym znaczeniu i niskim poziomie pewności nadal wymagają reguł, weryfikacji i monitorowania.
Jak często należy aktualizować klasyfikacje?
Należy je aktualizować, gdy zmieniają się produkty, atrybuty, źródła danych lub reguły kategoryzacji. Należy stale monitorować produkty niesklasyfikowane oraz odchylenia w przypisaniach, zamiast polegać wyłącznie na corocznym porządkowaniu.
Co zespoły ds. Retail Media powinny zamrozić przed rozpoczęciem kampanii?
Należy zablokować lub utworzyć wersję zestawu promowanych jednostek magazynowych (SKU), zakresu kategorii, zestawu produktów halo, wykluczeń oraz wersji klasyfikacji wykorzystywanej do tworzenia audiencji i raportów.
Podsumowanie
Uporządkowane grupy produktów nie powstają poprzez nadanie nazwy hierarchii i liczenie na to, że dostawcy będą się do niej stosować. Powstają one w wyniku jasnych definicji klas, reguł opartych na dowodach, identyfikacji produktów, obsługi wyjątków oraz testów na dalszych etapach procesu. Należy traktować klasyfikację jako system decyzyjny z wersjonowaniem. Wówczas audiencje i raporty będą mogły dokładnie wyjaśnić, które produkty zostały uwzględnione i dlaczego.
Chcesz zobaczyć, jak to działa w praktyce?
Footprints AI pomaga markom i detalistom mierzyć to, co naprawdę ma znaczenie. Zobacz nasze historie sukcesu klientów lub skontaktuj się z nami, aby porozmawiać o strategii Retail Media.



