Een detailhandelsbedrijf heeft zeer weinig aankopen per klant en is afhankelijk van veel nieuwe gebruikers. Bij het splitsen van gegevens voor het trainen en testen van een aangepaste recommender, hoe moet de data scientist een testset maken die het werkelijke gebruik weerspiegelt?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: Neem voor elke gebruiker de meest recente 10% van hun interacties en gebruik die per-gebruiker recente interacties als de testset..
Waarom dit het antwoord is
De juiste aanpak is om voor elke gebruiker de meest recente interacties te gebruiken als testset. Dit simuleert een realistisch scenario waarin het model nieuwe aanbevelingen moet doen op basis van de eerdere interacties van een gebruiker. Het weerspiegelt hoe een recommender-systeem in de praktijk functioneert: het voorspelt toekomstig gedrag op basis van historisch gedrag. Het willekeurig schudden van alle interacties en de laatste 10% apart houden (optie 1) kan leiden tot data-lekkage, omdat toekomstige interacties van een gebruiker in de trainingsset kunnen belanden. Het selecteren van gebruikers met de minste interacties (optie 3) of willekeurig 10% van de gebruikers (optie 4) is minder effectief omdat dit geen rekening houdt met het sequentiële karakter van gebruikersinteracties en de noodzaak om toekomstig gedrag te voorspellen.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig