Adverto sta valutando SageMaker Serverless Inference rispetto a un endpoint real-time sempre attivo per un batch di modelli con traffico altamente discontinuo (molti minuti senza richieste, picchi occasionali). Quale affermazione sul modello di costo di Serverless Inference rispetto a un endpoint real-time sempre attivo è più accurata per minimizzare i costi in questo carico di lavoro?
Scegli una risposta
Tocca un'opzione per controllare la tua risposta.
Risposta corretta: Serverless Inference viene fatturato per invocazione e durata del calcolo (GB-secondi); è tipicamente più economico per traffico discontinuo e a basso duty cycle rispetto a un endpoint real-time sempre attivo che viene fatturato per ora-istanza anche quando è inattivo.
Perché questa è la risposta
L'inferenza serverless di SageMaker è fatturata in base al numero di invocazioni e alla durata del calcolo (GB-secondi), il che la rende ideale per carichi di lavoro con traffico discontinuo o a basso duty cycle. Un endpoint real-time sempre attivo, invece, viene fatturato per ora-istanza, anche quando non riceve richieste, comportando costi maggiori in scenari di utilizzo intermittente. Le altre opzioni sono errate perché: Serverless Inference non ha una tariffa mensile fissa con invocazioni gratuite illimitate; gli endpoint real-time sempre attivi comportano addebiti per ora-istanza anche quando sono inattivi; e i costi di Serverless Inference non sono identici a quelli di Lambda, né includono un livello gratuito di 1 milione di richieste per la produzione.
Supera il tuo esame — senza l'infinita caccia alle risposte
Ottieni ogni domanda e spiegazione verificata per questo esame in un unico posto, e risparmia ore di preparazione. Oltre 1.000 certificazioni · Oltre 20 lingue · Inizia gratuitamente.
Supera il tuo esame più velocemente → Nessuna carta richiesta