Een lineair regressiemodel vertoont een zeer hoge nauwkeurigheid op de trainingsset, maar presteert slecht op nieuwe, ongeziene data. Welke actie moet de ML engineer ondernemen om dit probleem aan te pakken?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: Pas ML-technieken toe zoals cross-validatie en regularisatie. Gebruik Amazon SageMaker Experiments om verschillende modelversies en hun prestatiestatistieken te volgen en te vergelijken..
Waarom dit het antwoord is
Het probleem van hoge nauwkeurigheid op de trainingsset maar slechte prestaties op nieuwe data duidt op overfitting. Cross-validatie helpt om de modelprestaties op ongeziene data beter in te schatten en overfitting te detecteren. Regularisatie (bijv. L1 of L2) vermindert de complexiteit van het model door grote coëfficiënten te bestraffen, wat overfitting tegengaat. Amazon SageMaker Experiments is een geschikte tool om de resultaten van verschillende modelversies en hyperparameterinstellingen, inclusief die met regularisatie, te volgen en te vergelijken, zodat de beste oplossing kan worden gekozen. De andere opties zijn minder effectief: Het verhogen van de modelcomplexiteit zou overfitting verergeren. Het direct implementeren van een overfit model in productie is onverstandig. Het vergroten van de trainingsdataset kan helpen, maar zonder regularisatie of een complexer model aan te passen, kan overfitting nog steeds optreden.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig