
Snowflake 的 PARSE_JSON 函数要求 JSON 字符串中的反斜杠必须双重转义(即 → \),否则 SQL 解析器会提前消费转义符,导致 JSON 格式错误。本文详解双重转义原理、正确写法及 JavaScript 动态生成时的安全处理方案。
snowflake 的 `parse_json` 函数要求 json 字符串中的反斜杠必须双重转义(即 `` → `\`),否则 sql 解析器会提前消费转义符,导致 json 格式错误。本文详解双重转义原理、正确写法及 javascript 动态生成时的安全处理方案。
在 Snowflake 中使用 PARSE_JSON 解析包含内部双引号(如 "Kethan "Ch"")的 JSON 字符串时,常见错误 Error parsing JSON: missing comma, line X, pos Y 并非 JSON 本身无效,而是 SQL 字面量字符串层面的转义未被正确处理。
根本原因在于:Snowflake 的 SQL 引擎会先对单引号或双引号包围的字符串进行一次 SQL 层级的转义解析,之后才将结果传递给 PARSE_JSON 进行 JSON 解析。因此,JSON 中本应保留的 "(表示一个字面量双引号),在 SQL 字符串中必须写作 \" —— 即每个反斜杠需写两次:第一个 用于转义第二个 ,最终传给 JSON 解析器的才是真正的 "。
✅ 正确写法(双重转义):
PARSE_JSON('{
"type": "employee",
"details": [
{
"key": "name",
"value": "Kethan \"Ch\""
}
],
"mobile": "9999999999"
}')::VARIANT
⚠️ 注意事项:
- 不要手动替换 JSON 中的 " 为 "" 或其他形式 —— 这会破坏原始语义;
- 若 JSON 来自 JavaScript 变量拼接,务必对反斜杠做二次转义(例如:JS 中原始字符串为 "Kethan "Ch"",拼入 SQL 时需变为 "Kethan \"Ch\"");
- 更安全的做法是避免硬编码 JSON 字符串,改用 PARSE_JSON(?) 绑定参数(如通过 Snowflake Connector for Node.js 的 bind 参数),由驱动自动处理转义;
- 使用 TRY_PARSE_JSON() 可捕获解析失败而不中断执行,便于调试。
? 推荐实践(JavaScript 动态生成场景):
const rawJson = {
type: "employee",
details: [{ key: "name", value: 'Kethan "Ch"' }], // 原始值含双引号,无需 JS 转义
mobile: "9999999999"
};
// 安全序列化:JSON.stringify 自动处理内部引号转义
const jsonStr = JSON.stringify(rawJson); // → '{"type":"employee","details":[{"key":"name","value":"Kethan \"Ch\""}],"mobile":"9999999999"}'
// 构建 SQL(注意:仍需对反斜杠再转义一次以适配 SQL 字面量)
const sql = `
MERGE INTO PLAY_GROUND.SAMPLE_TABLES.EMPLOYEES AS target
USING (
SELECT
'1234'::VARIANT AS EMP_ID,
'2023-10-19T09:01:42.387Z'::VARIANT AS LAST_MODIFIED,
PARSE_JSON('${jsonStr.replace(/\/g, '\\')}')::VARIANT AS DETAILS,
'india'::VARIANT AS COUNTRY
) AS source ...`;
总结:Snowflake 中 JSON 字符串的正确解析依赖于 SQL 层 + JSON 层的双重转义协同。掌握 \ → → " 的转义链条,结合 JSON.stringify() 和参数化查询,可彻底规避此类解析错误,确保结构化数据准确入库。










