Un ingegnere ML addestra più modelli utilizzando lo stesso framework ML e desidera ospitarli in Amazon SageMaker riducendo al minimo i costi di inferenza. Qual è l'opzione di hosting più conveniente?
Scegli una risposta
Tocca un'opzione per controllare la tua risposta.
Risposta corretta: Creare un endpoint di inferenza multi-model per tutti i modelli..
Perché questa è la risposta
La creazione di un endpoint di inferenza multi-model (MME) è l'opzione più conveniente perché consente di ospitare più modelli su un'unica istanza SageMaker. Questo riduce significativamente i costi operativi e di infrastruttura rispetto all'utilizzo di istanze separate per ogni modello. Gli MME caricano e scaricano i modelli dalla memoria in base alla richiesta, ottimizzando l'utilizzo delle risorse. Creare un endpoint di inferenza multi-container per l'invocazione diretta o sequenziale non è l'ideale. Sebbene un multi-container possa ospitare più contenitori (e quindi potenzialmente più modelli), è progettato per scenari in cui i passaggi di inferenza sono complessi o richiedono ambienti diversi, non per l'hosting efficiente di molti modelli indipendenti. Creare più endpoint di inferenza a modello singolo per ciascun modello sarebbe l'opzione più costosa, poiché ogni endpoint richiederebbe le proprie risorse computazionali dedicate, portando a un sottoutilizzo e a costi elevati.
Supera il tuo esame — senza l'infinita caccia alle risposte
Ottieni ogni domanda e spiegazione verificata per questo esame in un unico posto, e risparmia ore di preparazione. Oltre 1.000 certificazioni · Oltre 20 lingue · Inizia gratuitamente.
Supera il tuo esame più velocemente → Nessuna carta richiesta