Команда хочет запускать несколько версий модели прогнозирования в продакшене в течение длительного времени, контролировать долю инференсов, обслуживаемых каждой версией, и минимизировать усилия по реализации. Какое решение наилучшим образом соответствует этим потребностям?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Разместить модели в SageMaker и создать единую конфигурацию конечной точки с несколькими производственными вариантами; настроить веса вариантов для управления трафиком..
Почему это правильный ответ
Правильный ответ — разместить модели в SageMaker и создать единую конфигурацию конечной точки с несколькими производственными вариантами, настроив веса вариантов для управления трафиком. Это решение позволяет развертывать несколько версий модели под одной конечной точкой, контролировать долю трафика, направляемого на каждую версию (например, для A/B-тестирования или постепенного развертывания), и минимизирует усилия по реализации, так как не требует изменений в клиентском приложении для переключения между версиями. Остальные варианты менее оптимальны: Создание отдельных конечных точек для каждой модели требует от клиентского приложения логики выбора конечной точки, что усложняет управление. Компиляция моделей с SageMaker Neo предназначена для оптимизации производительности на конкретных устройствах, а не для управления несколькими версиями модели в продакшене. Использование пакетного преобразования (Batch Transform) не подходит для обслуживания онлайн-инференсов в реальном времени, так как оно предназначено для обработки больших объемов данных в пакетном режиме.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется