Weet wat “AI-klaar om te verkopen” echt betekent.
Product Readiness test representatieve koopsituaties van klanten tegen je productcatalogus en beoordeelt of een AI-winkelagent een passend product kan vinden, de vragen van de klant kan beantwoorden, betrouwbaar bewijs kan gebruiken en een geldige weg naar aankoop kan bieden. Deze pagina legt uit wat die metingen betekenen, hoe vergelijkingen worden gemaakt en wat Herm bewust niet beweert.
Leidend principe: controleerbare methodologie, beschermde implementatie. Elk begrip, elke eenheid en elke grens op deze pagina is openbaar. De implementaties van de evaluator, de scoring en het genereren van intenties zijn dat niet.
- Behoefte van de shopper Een representatieve koopsituatie van een klant
- Gedrag van de agent Zoeken, vergelijken, aanbevelen, uitleggen
- Waarneembare uitkomst Wat de agent werkelijk aanbeval en zei
- Gezaghebbend bewijs + Merkintentie Wat het merk kan onderbouwen, en wat het toestaat
- Herm-evaluatie Onafhankelijk oordeel over de uitkomst
- Find · Answer · Trust · Close Vier dimensies, apart gescoord
- Geslaagd / mislukt Eén geteste intentie, één resultaat, met bewijs erbij
Herm beoordeelt waarneembaar winkelgedrag en commerciële correctheid die met bewijs is onderbouwd. Herm leest geen verborgen modelredenering.
Begin bij een koopsituatie, niet bij een productveld.
Product Readiness begint niet bij je feed. Het begint bij een shopperintentie: een representatieve koopsituatie van een klant die een behoefte beschrijft, de relevante voorwaarden en de beslissing die de shopper probeert te nemen. Alles wat volgt, dus vinden, bewijs, juistheid en bestemming, wordt tegen die situatie beoordeeld.
“Ik zoek een parfumvrije vitamine C onder £45 in een milde vorm, geschikt voor dagelijks gebruik op een gevoelige huid in het VK.”
Een shopperintentie is een meeteenheid. Eén geteste intentie levert één Winkeltest-resultaat op.
Testen van buitenaf, versterkt met eigen klantinzicht.
Herm kan representatieve shoppersituaties opstellen op basis van alleen categorie- en productcontext. Merken die hun eigen klantkennis inbrengen, brengen het panel dichter bij de klanten die ze echt bedienen.
Hoe beter de test de klanten weerspiegelt die het merk echt bedient, hoe commercieel betekenisvoller Product Readiness wordt.
Vraagt niets van je behalve gekoppelde productinformatie. Dit draait standaard, en maakt een eerste resultaat mogelijk nog vóór een workshop.
Precisienoot. Geteste intenties zijn representatieve koopsituaties van klanten, geen logs van letterlijke gebruikersvragen. Waar een intentie is afgeleid van waargenomen klantinput, staat dat zo vermeld in het resultaat.
De agent wordt getest op de informatie die het merk echt aanlevert.
Product Readiness werkt met gekoppelde commerce- en productinformatie. Herm normaliseert gekoppelde informatie tot een consistente testomgeving, zodat resultaten vergelijkbaar zijn tussen runs en tussen markten.
- Product-feed URL
- XML
- CSV
- JSON
- Google Merchant Center
- API
Prijs en beschikbaarheid worden beoordeeld zoals de gekoppelde bron ze op het moment van testen aanlevert. Herm verifieert de live voorraad bij retailers niet zelfstandig.
De agent doet de aanbeveling. Herm beoordeelt die onafhankelijk.
Dit zijn twee aparte systemen met twee aparte taken. De winkelagent mag zijn eigen werk niet nakijken.
De primaire winkelsimulatieomgeving van Herm gebruikt en breidt de open-source Commerce Agents-referentie-implementatie van Anthropic uit, als geloofwaardige commerce-agentarchitectuur voor productontdekking, vergelijking en aanbeveling. De Product Readiness-methodologie van Herm, inclusief de evaluatie van shopperintenties, Merkintentie, bewijscontrole, hoofdoorzaakanalyse en hertesten, is de onafhankelijke meetlaag van Herm.
Gedraagt zich als een commerce-agent die een shopper redelijkerwijs zou kunnen gebruiken. De output is een aanbeveling en een uitleg.
Beoordeelt de aanbeveling tegen gezaghebbend productbewijs en de toepasselijke Merkintentie. De output is geslaagd of mislukt, met het bewijs erbij.
Find · Answer · Trust · Close
Elke Winkeltest wordt op vier dimensies beoordeeld. Dit zijn de canonieke openbare definities; de scoring achter elke dimensie wordt niet gepubliceerd.
Vond de agent een passend en geschikt product voor de behoefte van de shopper?
Een technisch vindbaar product is niet automatisch het juiste product. Een klant wil een parfumvrije vitamine C in een milde vorm; de agent vindt de ongebufferde versie. Find kan falen, ook al klopt de productfamilie in grote lijnen.
Kon de agent de belangrijke onderdelen van de koopbeslissing van de klant beantwoorden met gezaghebbende productinformatie?
Volledigheid van velden en Beantwoordbaarheid zijn niet hetzelfde. Een volledig gevuld record kan de vraag die de aankoop beslist nog steeds onbeantwoord laten.
Was de aanbeveling gebaseerd op product- en commerciële informatie waar het merk achter kan staan?
Herm beoordeelt prijs en beschikbaarheid zoals de gekoppelde bron ze op het moment van testen aanlevert. Herm verifieert de realtime voorraad bij retailers niet zelfstandig.
Kan de shopper van de aanbeveling doorgaan naar een passende en geldige aankoopbestemming?
Close betekent momenteel niet dat Herm de checkout afrondt of een betaling verwerkt.
Dezelfde mislukte klantreis kan op heel verschillende manieren mislukken.
Vier tests. Vier mislukkingen. Vier totaal verschillende taken voor vier verschillende teams.
| Dimensie | Wat er misging | Wat het betekent | Eigenaar |
|---|---|---|---|
| Find-fout | Een beter geschikt product werd gemist. | De agent beval een product aan dat werkt. Hij beval niet het product aan dat het best bij de voorwaarden past. | Productdata / merchandising |
| Answer-fout | Juist product, onbeantwoordbare vraag. | Het juiste product werd gevonden, maar de geschiktheidsvraag die de shopper beantwoord wilde zien, kon niet worden beantwoord. | Productinformatie |
| Trust-fout | De aanbeveling gebruikte een niet-onderbouwde claim. | De agent onderbouwde zijn aanbeveling met iets wat door geen enkel gezaghebbend productbewijs wordt vastgesteld. | Content / compliance |
| Close-fout | Juiste aanbeveling, ongeldige bestemming. | De aanbeveling klopte, maar de aankooplink was niet geldig voor de Britse markt. | Commerce / kanalen |
Eén totaalscore mag nooit verbergen waar het commerciële falen plaatsvond.
Twee getallen, en geen van beide staat op zichzelf.
De Be Sellable Score is een samenvattende Product Readiness-maat, afgeleid van de onderliggende Find-, Answer-, Trust- en Close-evaluaties. De onderliggende dimensies worden er altijd naast getoond, omdat twee merken met vergelijkbare totaalscores heel verschillende gereedheidsproblemen kunnen hebben.
De Sellable Intent Rate is het percentage geteste koopsituaties van klanten dat uitmondt in een passende, met bewijs onderbouwde en commercieel geldige productaanbeveling met een werkende weg naar aankoop.
Gewichten, formules en drempels worden niet gepubliceerd.
Gewichten, formules en drempels worden niet gepubliceerd. Het uitgewerkte voorbeeld hieronder is een verklarende berekening, geen klantbewijs. Een ratio zonder zijn panel is geen vergelijkbaar cijfer.
Hoeveel van de koopbeslissing kan het bewijs echt beantwoorden?
Agent-beantwoordbaarheid meet hoeveel van de koopbeslissing van de klant kan worden beantwoord met gezaghebbende productinformatie. Elke belangrijke vraag binnen een intentie komt uit op één status.
Volledigheid van velden en Beantwoordbaarheid zijn niet hetzelfde. Een record kan voor 100% gevuld zijn en toch de doorslaggevende vraag onbeantwoord laten.
Gezaghebbend bewijs beantwoordt de vraag.
De beschikbare gezaghebbende informatie stelt het antwoord niet vast.
Sommige, maar niet alle belangrijke aspecten kunnen worden onderbouwd.
Verschillende gezaghebbende of commerciële informatie spreekt elkaar tegen.
De vraag is terecht niet van toepassing op dit product.
Bewijsdiscipline: ontbrekend bewijs is geen negatieve bewering. “Nee” rapporteren zou een negatieve bewering verzinnen die het merk nooit heeft gedaan. Onbekend is een datagat dat je kunt dichten; “nee” is een uitspraak over het product.
Een aanbeveling heeft bewijs nodig dat het merk kan verdedigen.
Product Readiness beoordeelt tegen door het merk goedgekeurd of anderszins gezaghebbend productbewijs. Elke evaluatie toont het bewijs waarop ze steunde, zodat een resultaat kan worden gecontroleerd in plaats van blind vertrouwd.
Openbaar principe. De klant moet kunnen inzien welk bewijs de evaluatie onderbouwt.
| Bewijs | Herkomst |
|---|---|
| Gekoppelde productdata | feed · API |
| Specificaties | aangeleverd door merk |
| Productdocumentatie | aangeleverd door merk |
| Bibliotheken met goedgekeurde claims | goedgekeurd door merk |
| Marktspecifieke productinformatie | per markt |
| Ander gezaghebbend bewijs aangeleverd door de klant | aangeleverd door merk |
Wat Herm niet publiceert: hoe bewijs wordt gerangschikt, hoe conflicten tussen bronnen worden opgelost en hoe het gezag van bronnen wordt gewogen.
Feitelijke juistheid en commerciële correctheid worden apart beoordeeld.
Een aanbeveling kan volledig door productbewijs worden onderbouwd en toch commercieel verkeerd zijn voor het merk. Dat zijn twee verschillende vragen en Herm houdt ze uit elkaar.
Productbewijs vraagt: kan gezaghebbende productinformatie de bewering van de agent onderbouwen? Merkintentie vraagt: is dit een weergave of aanbeveling die het merk namens zichzelf gedaan wil zien?
In het uitgewerkte voorbeeld werd niets feitelijk onjuists gezegd. De Winkeltest faalt toch, en wel als Merkintentie-fout in plaats van als bewijsfout, omdat de oplossing bij merchandising ligt en niet bij de productdata.
Vijf voorwaarden, allemaal wezenlijk.
Een Winkeltest slaagt wanneer de resulterende aanbeveling voldoet aan de wezenlijke eisen van de shopperintentie, wordt onderbouwd door gezaghebbende productinformatie, de toepasselijke Merkintentie respecteert, geldig is voor de relevante markt en een passende aankoopbestemming biedt.
De aanbeveling voldoet aan wat de shopperintentie werkelijk vereiste.
De gedane claims worden onderbouwd door productinformatie die het merk kan verdedigen.
De toepasselijke Merkintentie wordt gerespecteerd.
De aanbeveling is geldig voor de relevante markt.
Er wordt een passende bestemming geboden.
Een test faalt wanneer aan een of meer wezenlijke eisen niet is voldaan. Materialiteitsdrempels, de omgang met zekerheid, regels voor voldoende bewijs en de rangschikking van kandidaten zijn intern en worden niet gepubliceerd.
Elf faalfamilies.
Elke mislukte Winkeltest wordt ingedeeld in een van deze families, en elke familie hoort bij een ander soort oplossing. De classificatie is openbaar; hoe fouten worden gegroepeerd en geclusterd niet.
| Familie | Definitie | |
|---|---|---|
| 01 | Ophalen | Er werd geen passend product uit de geschikte catalogus naar voren gehaald. |
| 02 | Geschiktheid | Er werd een product gevonden, maar het voldoet niet aan de wezenlijke voorwaarden van de shopper. |
| 03 | Beantwoordbaarheid | Een doorslaggevende koopvraag kon niet worden beantwoord vanuit gezaghebbende informatie. |
| 04 | Niet-onderbouwde claim | De aanbeveling rust op een uitspraak die door geen enkel bewijs wordt vastgesteld. |
| 05 | Merkintentie | De aanbeveling botst met een merkregel over positionering of gebruik. |
| 06 | Marktgeldigheid | Het product is niet geldig of wordt niet aangeboden in de geteste markt. |
| 07 | Beschikbaarheid | De aangeleverde beschikbaarheid ondersteunt de aanbeveling niet. |
| 08 | Bestemming | Geen geldige aankoopbestemming, of een bestemming die niet geldig is voor de markt. |
| 09 | Variant | De juiste familie, de verkeerde variant voor de genoemde voorwaarden. |
| 10 | Productidentiteit | Het aanbevolen product kan niet betrouwbaar worden geïdentificeerd of gekoppeld. |
| 11 | Verouderde of inconsistente informatie | Bronnen spreken elkaar tegen, of de informatie past niet meer bij het product. |
Een mislukte klantreis is bewijs. Een hoofdoorzaak maakt het bruikbaar.
Herm zoekt naar terugkerende patronen in mislukte Winkeltests om vast te stellen waar een informatieprobleem op product-, familie- of catalogusniveau verantwoordelijk kan zijn. Hoofdoorzaken worden beschreven in termen die klanten begrijpen, niet in interne veldnamen.
Illustratief patroon. Een hoofdoorzaak is een diagnose van het geteste bewijs, geen bewering over één los veld.
Een oplossing moet dezelfde test doorstaan.
Wanneer relevante productinformatie verandert, kan Product Readiness de betrokken Winkeltests opnieuw uitvoeren. Hertesten laat zien of de prestaties verbeterden binnen de evaluatieomgeving van Product Readiness. Het is geen bewijs van causaliteit voor verkopen in de echte wereld.
Hertestresultaat vastgelegd onder dezelfde testidentiteit. Beide statussen blijven zichtbaar in de geschiedenis.
- Zelfde shopperintentie
- Zelfde markt
- Zelfde relevante Merkintentie
- Vergelijkbare agent en testomgeving
- Methodologie met versiebeheer
Waar de omgeving of het model wezenlijk verandert, toont het resultaat de nieuwe context in plaats van de vergelijking als ongewijzigd te presenteren.
Vergelijk appels met appels.
Resultaten uit verschillende AI-commerceomgevingen kunnen informatief zijn, maar ze moeten niet worden gelezen als identieke experimentele omstandigheden. Elk resultaat bevat de context die nodig is om te beoordelen of een vergelijking eerlijk is.
| Omgeving | Versie / profiel | Datum | Markt | Testreikwijdte |
|---|---|---|---|---|
| Herm-simulatieomgeving | profiel + versie | per run | VK | 100 intenties |
| Secundaire commerceomgeving | profiel + versie | per run | VK | 100 intenties |
| Marktvergelijkingsrun | profiel + versie | per run | DE | 100 intenties |
Herm toont omgevingscontext in plaats van één ranglijst over alle omgevingen heen. Valse precisie is erger dan een ontbrekend getal.
Gevolgd is niet hetzelfde als gecertificeerd.
ACP, UCP en andere externe standaarden zijn ecosysteemspecificaties die Herm volgt. Dat Herm een standaard volgt, betekent niet dat Herm naleving ervan certificeert of namens de standaard officiële validatie uitvoert. Waar Herm een specifieke gereedheidstest voor een eis heeft, zegt het resultaat dat precies.
Gevolgd als ecosysteemspecificatie. Waar Herm een specifieke eis test, noemt het resultaat die eis.
Gevolgd als ecosysteemspecificatie. Volgen is geen certificering, naleving of officiële validatie.
Product- en retailerbestemmingen worden als onderdeel van Close gecontroleerd op geldigheid in de geteste markt.
Wat de meting niet beweert.
Acht uitspraken die Herm niet zal doen over een Product Readiness-resultaat, hier opgesomd zodat niemand ze hoeft af te leiden.
Een resultaat is alleen te interpreteren tegen de methodologie die het opleverde.
Historische resultaten leggen de methodologie en omgevingscontext vast die nodig zijn om ze te interpreteren. Er worden geen versienummers op deze pagina gepubliceerd totdat ze zijn bevestigd.
Dezelfde begrippen, kleinere reikwijdte.
De AI Commerce Readiness Test gebruikt dezelfde Product Readiness-begrippen, dus shopperintenties, Find / Answer / Trust / Close, bewijs en Sellable Intent Rate, op een beperkte catalogus en testreikwijdte. Het is een steekproef van de methode, niet het volledige abonnement.
| Readiness Test | Product Readiness | |
|---|---|---|
| Shopperintenties | beperkt panel | volledig panel, met input van het merk |
| Catalogusreikwijdte | beperkte reikwijdte | volledige gekoppelde catalogus |
| Gerapporteerde dimensies | Find · Answer · Trust · Close | Find · Answer · Trust · Close |
| Merkintentie | niet geconfigureerd | geconfigureerd en beoordeeld |
| Hoofdoorzaak en hertesten | alleen samenvatting | volledige diagnose en hertests |
Veelgestelde vragen
Wat wordt er precies gemeten?
Of een AI-winkelagent een representatieve koopsituatie van een klant kan vervullen met de productinformatie die het merk aanlevert: een passend product vinden, de doorslaggevende vragen beantwoorden, de aanbeveling baseren op verdedigbaar bewijs en een geldige weg naar aankoop bieden.
Leest Herm de redenering van het model?
Nee. Herm beoordeelt waarneembaar winkelgedrag en commerciële correctheid die met bewijs is onderbouwd. Herm leest geen verborgen modelredenering, en in resultaten wordt die ook niet getoond.
Waarom worden de gewichten niet gepubliceerd?
De begrippen, eenheden en grenzen zijn openbaar, zodat een resultaat kan worden geïnterpreteerd en gecontroleerd. De evaluator, de scoringsformule, de gewichten, de drempels en de implementatie voor het genereren van intenties zijn het product, en worden niet gepubliceerd.
Kunnen we onze score vergelijken met die van een ander merk?
Niet rechtstreeks. Een Sellable Intent Rate heeft alleen betekenis samen met het bijbehorende panel, de markt en de omgeving. Twee ratio’s die op verschillende intenties, markten of omgevingen zijn gemeten, zijn niet dezelfde meting.
Garandeert een geslaagde test dat een AI-assistent ons aanbeveelt?
Nee. Een geslaagde Winkeltest garandeert niet dat een externe AI-dienst altijd dezelfde aanbeveling doet, en onderbouwde productinformatie garandeert geen verkopen. Het onderdeel over grenzen somt de acht beweringen op die Herm niet zal doen.
Is de Readiness Test dezelfde meting?
Dezelfde begrippen, kleinere reikwijdte. De AI Commerce Readiness Test voert een beperkt intentiepanel uit op een beperkt deel van de catalogus, zonder geconfigureerde Merkintentie. Het is een steekproef van de methode, geen vervanging van de volledige beoordeling.
Pas de methode toe op je eigen catalogus.
Koppel een feed en bekijk je eerste Winkeltests, met het bewijs achter elke geslaagde en mislukte test.
Elke definitie op deze pagina is de definitie die in het product wordt gebruikt.