导入到 BigQuery 的 CSV 文件成功完成,但导入的数据与源数据并非逐字节匹配。最可能的原因是什么?
选择一个答案
点击一个选项来检查您的答案。
正确答案: CSV 文件编码与 BigQuery 的默认编码不同.
为什么这是答案
当导入到 BigQuery 的 CSV 文件成功完成,但数据并非逐字节匹配时,最可能的原因是 CSV 文件的编码与 BigQuery 的默认编码(通常是 UTF-8)不一致。BigQuery 会尝试使用其默认编码解析数据,如果文件使用不同的编码(例如 Latin-1 或 UTF-16),则某些字符可能无法正确解释,导致数据差异。 其他选项不正确的原因: “加载时未将导入的数据指定为 CSV”:如果未指定为 CSV,导入过程很可能失败或将整个文件视为单行,而不是成功完成并出现数据不匹配。 “导入时跳过了 CSV 中的无效行”:跳过无效行会导致数据量减少,但通常不会导致已导入行的逐字节不匹配。 “CSV 文件在加载前未经过 ETL 处理”:ETL 处理是数据转换,与加载后数据是否逐字节匹配无关。即使未进行 ETL,如果编码正确,数据也应逐字节匹配。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 → 无需银行卡