Развернутая модель, основанная на генетическом алгоритме, может занимать несколько минут для выдачи предсказания и должна обрабатывать запросы, включающие до 100 МБ данных. Какой вариант развертывания минимизирует операционные издержки при соблюдении этих требований?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Развернуть модель на конечной точке Amazon SageMaker Asynchronous Inference..
Почему это правильный ответ
Правильный ответ — развернуть модель на конечной точке Amazon SageMaker Asynchronous Inference. Этот вариант идеально подходит для моделей с длительным временем вывода (несколько минут) и большими входными данными (до 100 МБ), поскольку он разработан для обработки таких сценариев асинхронно. Это минимизирует операционные издержки, так как вы платите только за фактическое время обработки запросов, а не за постоянно работающие инстансы. Развертывание на инстансах Amazon EC2 в группе Auto Scaling за Application Load Balancer (ALB) или в Amazon ECS на инстансах EC2 неоптимально, поскольку эти решения требуют постоянного управления инфраструктурой и могут быть дорогими из-за необходимости поддерживать инстансы в рабочем состоянии, даже когда нет активных запросов. SageMaker real-time endpoint не подходит из-за длительного времени вывода и больших входных данных, так как он предназначен для низколатентных запросов с меньшими объемами данных.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется