Рабочая конечная точка SageMaker для инференса в реальном времени, на которой запущена встроенная модель обнаружения объектов на инстансе P3, показывает низкую загрузку GPU. Какое изменение развертывания позволит лучше использовать выделенные ресурсы для инференса?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Переразвернуть модель на инстансе M5 и подключить акселераторы Amazon Elastic Inference..
Почему это правильный ответ
Низкая загрузка GPU на инстансе P3 указывает на то, что модель не полностью использует вычислительную мощность GPU. Инстансы P3 имеют мощные GPU, которые могут быть избыточными для некоторых моделей, особенно если модель не оптимизирована для параллельных вычислений или имеет небольшой размер. Правильный ответ: Переразвернуть модель на инстансе M5 и подключить акселераторы Amazon Elastic Inference. Инстансы M5 — это инстансы общего назначения, которые дешевле инстансов P3 и подходят для большинства рабочих нагрузок. Amazon Elastic Inference (EI) — это сервис, который позволяет добавлять ускорение GPU к инстансам EC2, SageMaker и ECS по более низкой цене, чем использование полнофункциональных инстансов GPU. Это позволяет эффективно использовать ресурсы, оплачивая только необходимое ускорение. Неправильные варианты: Переключиться на запуск модели в качестве задания пакетного преобразования на инстансе M5: Пакетное преобразование не подходит для инференса в реальном времени. Перенести развертывание на более крупный инстанс GPU, такой как P3dn: Это только усугубит проблему низкой загрузки GPU и увеличит затраты. Разместить модель в кластере Amazon ECS, используя инстанс P3 для инференса: Перенос на ECS не решит проблему низкой загрузки GPU, а лишь изменит среду развертывания.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется