Analyzovali jsme 2,1 milionu produktů na Amazonu a 31 000 produktů největšího českého e-shopu. Šest našich studií: inflace hodnocení, strop predikce reklamovanosti, opravitelnost jako signál, selhání reputace, engagement signály — a rotace katalogu. Včetně odkazů na plné texty.
Proč zkoumáme e-commerce signály
Hvězdičky a recenze jsou dnes hlavním signálem kvality při online nákupu. Jenže kolik informace tento signál skutečně nese? Šest našich studií zkoumá, co veřejně viditelné údaje na produktové stránce doopravdy říkají o kvalitě a riziku nespokojenosti — a co už ne. Níže shrnujeme hlavní kvantitativní výsledky a odkazujeme na plné texty rukopisů.
1. Inflace hodnocení a cenově-kvalitativní paradox na Amazonu
Analýza 2,1 milionu produktových záznamů z korpusu Amazon Reviews 2023. Průměrné hodnocení je 4,23/5 a méně než 1 % produktů má průměr pod 3,0 — reálně použitelná škála se smrskla zhruba na rozsah jedné hvězdičky (3,8–4,8). Pozornost recenzentů se navíc extrémně koncentruje u malé skupiny produktů („winner-take-all") a vazba mezi cenou a viditelnými signály kvality recenzí je slabá. Studie tak přerámovává cenově-kvalitativní paradox: nejde o anomálii jednotlivých produktů, ale o vlastnost celé distribuce signálů.
Proč to je důležité: pětibodová škála je fakticky jednobodová. Průměrné hodnocení proto nemůže sloužit jako srovnávací nástroj — a doporučovací systémy, které ho berou jako vstup, pracují se zborceným měřidlem.
Plný text studie: Rating Inflation on Amazon (Google Drive)
2. Strop predikce: co reklamovanost prozradí o informační asymetrii
Studie testuje horní hranici toho, jak přesně lze z veřejně viditelných signálů produktové stránky predikovat reklamovanost — pomocí strojového učení nad daty na úrovni jednotlivých listingů, s interpretací přes SHAP. Výsledek: predikční výkon má strukturální strop. To není selhání modelů, ale zjištění o trhu samotném: veřejné informace jsou příliš chudé na to, aby nesly skutečné riziko nespokojenosti. Studie tím odlišuje informační hodnotu veřejných signálů od bohatších proprietárních dat, se kterými pracuje většina literatury o predikci reklamovanosti.
Proč to je důležité: informační asymetrie v e-commerce je měřitelná. Kupující z produktové stránky zkrátka nemá šanci poznat, co ho čeká — a to je argument pro externí datové signály, jako je skóre opravitelnosti.
Plný text studie: The Predictive Ceiling of Public Signals (Google Drive)
3. Predikce reklamovanosti z engagement signálů: evidence z Alza.cz
Studie (spoluautoři Radim Dolák a Lucie Waleczek Zotyková, SU OPF) testuje, zda zákaznické signály — průměrné hodnocení, míra doporučení, počet recenzí — spolu s cenou a prodejním objemem vysvětlují reklamovanost napříč šesti kategoriemi na Alza.cz, největším českém online prodejci. Výsledek: některé signály, zejména hodnocení a míra doporučení, jsou asociované s nižší reklamovaností — ale síla i směr vztahů se mezi kategoriemi výrazně liší. Pooled i kategoriově specifické analýzy tak vymezují praktické limity používání zákaznických metrik jako proxy rizika reklamace.
Proč to je důležité: e-shopy i spotřebitelé berou hodnocení jako univerzální indikátor. Naše data ukazují, že jeho vypovídací hodnota je kategoriově podmíněná — co funguje u jedné kategorie, u jiné neplatí.
Plný text studie: Predicting Product Return Rates from Customer-Engagement Signals (Google Drive)
4. Opravitelnost jako signál: vyměnitelnost vs. reklamovanost
Studie na ~31 000 produktech s reálnou reklamovaností testuje, zda viditelné signály vyměnitelnosti (typicky rozdíl mezi kabelovými a bateriovými produkty) souvisejí s nižší pravděpodobností reklamace. Jde o jeden z prvních empirických testů „right-to-repair" signálů na skutečných post-nákupních výsledcích — a zároveň ukázku, že levné, na produktové stránce viditelné signály lze vyhodnocovat bez proprietárních konstrukčních dat. Studie současně vyjasňuje limity: jeden viditelný signál není plnohodnotnou náhradou za skutečné skóre opravitelnosti.
Proč to je důležité: politika práva na opravu předpokládá, že signály opravitelnosti odpovídají lepším výsledkům. Naše data ukazují, jak tento předpoklad testovat empiricky.
Plný text studie: Repairability Cues vs Returns (Google Drive)
5. Když reputace selhává: vysoké hodnocení, vysoká reklamovanost
Na datasetu více než 31 000 produktů z 12 kategorií největšího středoevropského e-shopu studie profiluje produkty, které kombinují vysoké hodnocení a zároveň vysokou reklamovanost. V průměru platí, že vyšší hodnocení znamená nižší reklamovanost — ale nesoulad je značný a systematicky se koncentruje u novinek, prémiově positionovaných produktů a zboží závislého na osobním „fitu" (zkušenostní statky). Kategoriově adjustované modely ukazují, že nejde o šum: selhání reputace má předvídatelnou strukturu.
Proč to je důležité: hodnocení nejsou měřítkem realizované kvality, ale nedokonalým signálem pozornosti a očekávání. U některých typů zboží selhávají předvídatelně — a právě tam je potřeba objektivní doplňkový signál.
Plný text studie: When Reputation Fails (Google Drive)
6. Proč produkty mizí: rotace katalogu a stabilita signálů na Alza.cz
Výzkum obvykle bere produktové listingy jako stabilní pozorovací jednotky. Naše tříválnová panelová studie (13 měsíců, devět kategorií spotřebičů a elektroniky na Alza.cz) ukazuje opak: šestiměsíční riziko zmizení listingu je vysoké a silně heterogenní podle kategorie. V kategoriově stratifikovaných hazardních modelech je nejkonzistentnějším prediktorem delistingu cena — ne hvězdičky, počet recenzí ani reklamovanost. A u listingů, které přežily všechny vlny, se signály liší v časové stabilitě: cena a hodnocení zůstávají relativně stabilní, zatímco reklamovanost je v čase výrazně méně spolehlivá.
Proč to je důležité: každé skóre kvality postavené na e-commerce datech musí počítat s tím, že produkty z trhu průběžně mizí a některé signály „stárnou" rychleji než jiné. Tato studie je metodologický základ, na kterém stavíme aktualizace naší databáze.
Plný text studie: Why Products Vanish: Catalog Churn on Alza.cz (Google Drive)
Co z toho plyne
Veřejné signály v e-commerce — hvězdičky, recenze, cena — nesou méně informace, než se zdá. Inflace hodnocení zbortila škálu, predikce reklamovanosti má strukturální strop, reputace selhává systematicky (ne náhodně) a signály navíc nejsou stabilní v čase. Spotřebitel i e-shop potřebují externí, objektivní datový signál. Přesně to je role našeho skóre opravitelnosti a API pro e-shopy.
Poznámka k odkazovaným textům: odkazy vedou na plné texty autorských rukopisů (preprintů) sdílené přes Google Drive. Některé z nich aktuálně procházejí recenzním řízením v odborných časopisech — pokud existuje publikovaná verze, citujte prosím ji.
Další čtení
Jak dlouho doopravdy vydrží spotřebiče? Shrnutí našeho výzkumu životnosti
Šest našich studií o životnosti spotřebičů: co očekávají čeští spotřebitelé, jak se vyvíjí skutečná životnost praček, proč víra v plánované zastarávání nemění nákupní chování — a kolik vysloužilých spotřebičů mizí mimo oficiální evidenci. Včetně odkazů na plné texty.
Shodnou se testovací agentury na tom, co je kvalitní? Shrnutí našeho výzkumu
Porovnali jsme 16 978 testů od čtyř evropských spotřebitelských organizací. Čtyři naše studie: jak silně se agentury shodují (ρ = 0,84–0,92), zda vyšší cena znamená vyšší kvalitu, proč trh odměňuje značku víc než testované parametry — a kdy se dav shoduje s experty. Včetně odkazů na plné texty.