CSV-bestanden die in BigQuery zijn geïmporteerd, worden succesvol voltooid, maar de geïmporteerde gegevens komen niet byte-voor-byte overeen met de bron. Wat is de meest waarschijnlijke oorzaak?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: De codering van het CSV-bestand verschilt van de standaardcodering van BigQuery.
Waarom dit het antwoord is
De meest waarschijnlijke oorzaak is dat de codering van het CSV-bestand (bijvoorbeeld UTF-16) verschilt van de standaardcodering van BigQuery (UTF-8). Wanneer BigQuery een bestand laadt met een afwijkende codering zonder dat dit expliciet is opgegeven, kan dit leiden tot onjuiste interpretatie van tekens, waardoor de gegevens niet byte-voor-byte overeenkomen. De import voltooid wel succesvol omdat het proces zelf geen fouten detecteert, maar de inhoud is corrupt. "De geïmporteerde gegevens zijn tijdens het laden niet als CSV gespecificeerd" is onwaarschijnlijk, omdat dit meestal leidt tot een foutmelding of een mislukte import, niet tot een succesvolle import met afwijkende gegevens. "Ongeldige rijen in het CSV-bestand zijn overgeslagen tijdens het importeren" zou resulteren in minder rijen of ontbrekende gegevens, maar niet noodzakelijkerwijs in een byte-voor-byte mismatch van de aanwezige gegevens. "De CSV-bestanden zijn niet ETL-verwerkt vóór het laden" is te algemeen; hoewel ETL-processen gegevens kunnen transformeren, verklaart het niet waarom een directe import zonder expliciete transformatie een byte-voor-byte mismatch zou veroorzaken, tenzij het specifiek om coderingsproblemen gaat.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig