BigQuery にインポートされた CSV ファイルは正常に完了しますが、インポートされたデータがソースとバイト単位で一致しません。最も可能性の高い原因は何ですか?
解答を選択
オプションをタップして解答を確認してください。
正解: CSV ファイルのエンコードが BigQuery のデフォルトのエンコードと異なる.
これが解答である理由
BigQueryはデフォルトでUTF-8エンコーディングを想定しています。CSVファイルのエンコーディングがUTF-8以外(例:ShiftJISやEUC-JP)である場合、BigQueryがデータを正しく解釈できず、文字化けやデータの不一致が発生する可能性があります。この問題は、ロードジョブの作成時に--sourceformat=CSVオプションや--encodingフラグを使用して、CSVファイルの実際のエンコーディングを指定することで解決できます。他の選択肢は、バイト単位の不一致の直接的な原因としては可能性が低いです。データがCSVとして指定されていない場合、ロード自体が失敗するか、データが正しくパースされません。無効な行がスキップされても、残りの有効な行のバイト単位の不一致は発生しません。ETL処理はデータの内容を変更する可能性がありますが、エンコーディングの不一致とは別の問題です。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要