"我查了半天还是不懂「JSON怎么计算」。"——收到这条留言我特别理解。这事儿确实容易被讲复杂,今天我换个角度试试。
别急着算,先搞懂「JSON怎么计算」的概念
JSON是轻量级数据交换格式,两种结构:对象{键:值}和数组[值]。键必须双引号,字符串必须双引号,不能有注释和尾逗号。JSON.parse解析、JSON.stringify序列化,格式化用缩进参数JSON.stringify(obj,null,2)。哈希和加密是两码事,前者不可逆后者可逆,别混着用。处理文本统一用UTF-8,能避免90%的乱码和编码冲突问题。
背后的算法是这样的
常见错误:单引号当字符串(不行)、键没引号(不行)、尾逗号(严格模式报错)、Tab和空格混用缩进。校验用JSON.parse试解析,能过就是合法JSON。压缩去空格换行减小体积,格式化加缩进方便阅读。编码转换先确认源编码,盲目转只会越转越乱。中文用mb_系列函数处理,旧函数容易截断半个汉字出乱码。
套个数字试试
先搞清概念。JSON怎么计算这类文本操作,本质是对字符串按某种规则转换或分析。搞懂规则(编码标准、正则语法、格式规范),操作就有章法;规则没吃透,照着抄都会出错。处理用户输入一定过滤特殊字符,防XSS和注入是基本功。字符串操作要考虑多字节字符,中文一个字不等于一个字节。
几个要注意的地方
这里头有几个雷区,我挨个点出来:
- 键和字符串必须双引号,单引号会报错
- 不能有注释和尾逗号,严格模式直接报错
- 布尔true/false、null必须小写
- 数字不带引号,带引号就变成字符串了
下次遇到类似的,先别急着搜,把今天讲的几个点过一遍,多半能自己解决。
大文件别一次性读进内存,用流式处理或逐行读取,否则容易OOM。中文用mb_系列函数处理,旧函数容易截断半个汉字出乱码。哈希和加密是两码事,前者不可逆后者可逆,别混着用。能用成熟库就别自己造轮子,特别是编码、加密、解析这种容易出错的领域。写完正则或解析逻辑,一定用边界案例测:空串、超长、特殊字符、Unicode。字符串操作要考虑多字节字符,中文一个字不等于一个字节。特殊字符在该转义的地方一定要转义,否则解析失败或被注入。处理文本统一用UTF-8,能避免90%的乱码和编码冲突问题。数据格式(JSON/XML/CSV)要先确认再解析,猜格式必出错。编码转换先确认源编码,盲目转只会越转越乱。处理用户输入一定过滤特殊字符,防XSS和注入是基本功。编码问题九成是UTF-8和GBK没统一,全链路统一UTF-8能解决一大半乱码。
常见问题
【JSON校验报错怎么排查?】常见错误:单引号字符串、键没双引号、尾逗号、注释。用JSON.parse试解析会报错位置。特别注意最后一个键值对后面不能有逗号,这是最常见错误。
【JSON格式有什么要求?】键和字符串必须用双引号(单引号不行),不能有注释和尾逗号,两种结构:对象{}和数组[]。布尔true/false、null小写。数字不带引号。
【JSON怎么格式化和压缩?】格式化用JSON.stringify(obj,null,2)加2空格缩进方便阅读;压缩用JSON.stringify(obj)不加缩进去掉空格换行减小体积。在线工具一键转换。
【JSON怎么计算是什么意思?】属于文本处理范畴,是对字符串按特定规则转换或分析的操作。具体含义要看场景,但核心都是让文本数据能在不同环境正确表示和使用。