L'importazione di file CSV in BigQuery viene completata con successo, ma i dati importati non corrispondono byte per byte all'origine. Qual è la causa più probabile?
Scegli una risposta
Tocca un'opzione per controllare la tua risposta.
Risposta corretta: La codifica del file CSV differisce dalla codifica predefinita di BigQuery.
Perché questa è la risposta
La causa più probabile è che la codifica del file CSV differisce dalla codifica predefinita di BigQuery. BigQuery assume UTF-8 per impostazione predefinita. Se il file CSV è codificato in un formato diverso (ad esempio, ISO-8859-1 o UTF-16), i caratteri non ASCII potrebbero essere interpretati in modo errato, portando a dati che non corrispondono byte per byte all'origine. Le altre opzioni sono meno probabili: Se i dati non fossero stati specificati come CSV, il caricamento probabilmente fallirebbe del tutto, non solo presenterebbe una discrepanza byte per byte. Le righe non valide saltate ridurrebbero il numero totale di righe o causerebbero errori specifici, ma non altererebbero i byte delle righe importate correttamente. L'elaborazione ETL è spesso necessaria per la trasformazione dei dati, ma la sua assenza non causerebbe intrinsecamente una discrepanza byte per byte se i dati sono stati caricati direttamente e la codifica è l'unica variabile.
Supera il tuo esame — senza l'infinita caccia alle risposte
Ottieni ogni domanda e spiegazione verificata per questo esame in un unico posto, e risparmia ore di preparazione. Oltre 1.000 certificazioni · Oltre 20 lingue · Inizia gratuitamente.
Supera il tuo esame più velocemente → Nessuna carta richiesta