Компания хранит ежедневные записи о производительности портфеля в виде файлов .csv в Amazon S3 и использует AWS Glue crawlers для каталогизации данных. Данные должны быть доступны в AWS Glue Data Catalog каждый день. Какая конфигурация соответствует этому требованию?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Создайте роль IAM, включающую политику AWSGlueServiceRole. Прикрепите роль к crawler. Направьте crawler на исходный путь S3. Создайте ежедневное расписание для запуска crawler. Укажите имя базы данных для вывода..
Почему это правильный ответ
Правильный ответ описывает стандартную и эффективную конфигурацию для AWS Glue Crawler. Для работы crawler требуется роль IAM с политикой AWSGlueServiceRole, которая предоставляет необходимые разрешения для доступа к данным и записи в Glue Data Catalog. Указание исходного пути S3 позволяет crawler найти данные, а ежедневное расписание обеспечивает регулярное обновление каталога. Указание имени базы данных необходимо, чтобы crawler знал, куда записывать метаданные таблиц. Неправильные варианты: Вариант с AmazonS3FullAccess неоптимален, так как AWSGlueServiceRole уже включает необходимые разрешения для S3 и Glue. Также запись выходных данных crawler в новый путь S3 не является стандартной практикой; crawler записывает метаданные в Data Catalog. Вариант с выделением DPU (единиц обработки данных) не является обязательным шагом для базовой настройки crawler и не влияет на его способность каталогизировать данные. DPU относятся к заданиям Glue, а не к crawler. Вариант, который снова предлагает запись выходных данных в новый путь S3, некорректен, так как crawler записывает метаданные в Data Catalog, а не в S3.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется