Импорт CSV-файлов в BigQuery завершается успешно, но импортированные данные не совпадают с исходными байт в байт. Какова наиболее вероятная причина?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Кодировка CSV-файла отличается от кодировки BigQuery по умолчанию.
Почему это правильный ответ
Наиболее вероятная причина несовпадения данных при успешном импорте CSV в BigQuery — это различие в кодировке файла и кодировке по умолчанию, используемой BigQuery (UTF-8). Если CSV-файл использует другую кодировку (например, Latin-1 или Windows-1251), символы, отсутствующие в UTF-8 или имеющие другое представление, будут импортированы некорректно, что приведет к искажению данных, но не к ошибке импорта. Вариант "Импортированные данные не были указаны как CSV" неверен, так как в этом случае импорт, скорее всего, завершился бы ошибкой из-за неверного формата. "Недопустимые строки в CSV были пропущены" может быть причиной неполноты данных, но не их искажения байт в байт. "CSV-файлы не были обработаны с помощью ETL" — это общее утверждение, которое не объясняет конкретную проблему с кодировкой.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется