Необходимо разместить пользовательскую модель прогнозирования; рабочая нагрузка предсказуема и постоянна в течение одного и того же 2-часового окна каждый день, при этом многие вызовы требуют быстрых ответов. Компания хочет, чтобы AWS управляла инфраструктурой и автомасштабированием. Какой вариант хостинга соответствует этим требованиям?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Использовать Amazon SageMaker Serverless Inference и настроить provisioned concurrency..
Почему это правильный ответ
Правильный ответ — использование Amazon SageMaker Serverless Inference с настроенной provisioned concurrency. SageMaker Serverless Inference идеально подходит для периодических или непредсказуемых рабочих нагрузок, поскольку AWS полностью управляет базовой инфраструктурой и автомасштабированием, что соответствует требованию компании. Настройка provisioned concurrency гарантирует, что запросы в пределах 2-часового окна будут получать быстрые ответы, избегая задержек холодного старта. Запланированное задание SageMaker batch transform не подходит, так как оно предназначено для пакетной обработки, а не для интерактивных запросов, требующих быстрых ответов. Использование группы EC2 Auto Scaling с запланированным масштабированием требует ручного управления инфраструктурой и автомасштабированием, что противоречит требованию AWS управлять инфраструктурой. Запуск модели на кластере Amazon EKS на EC2 также требует значительного управления инфраструктурой и настройки автомасштабирования подов, что не соответствует желанию компании, чтобы AWS полностью управляла инфраструктурой.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется