Los archivos CSV importados a BigQuery se completan correctamente, pero los datos importados no coinciden byte a byte con el origen. ¿Cuál es la causa más probable?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: La codificación del archivo CSV difiere de la codificación predeterminada de BigQuery.
Por qué esta es la respuesta
La causa más probable es que la codificación del archivo CSV difiere de la codificación predeterminada de BigQuery (UTF-8). Cuando las codificaciones no coinciden, BigQuery puede interpretar incorrectamente ciertos caracteres, lo que lleva a diferencias en los datos importados, aunque la carga se complete sin errores. Las otras opciones son menos probables: Si los datos no se especificaran como CSV, la carga probablemente fallaría por completo o resultaría en un esquema incorrecto, no solo en una discrepancia byte a byte. Si se omitieran filas no válidas, el número de filas importadas sería menor, pero los datos de las filas válidas deberían coincidir. Aunque el procesamiento ETL es una buena práctica, su ausencia no causaría una discrepancia byte a byte en los datos crudos importados, a menos que el ETL estuviera destinado a corregir problemas de codificación.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta