原文、字节、候选结果的验证关系,强调可逆不等于确认来源
阅读口径

本文保留原字符串;操作在副本上进行,候选结果需由来源证据核对。

样本覆盖不同边界

使用 ASCII、中文、单个补充平面表情、含连接符的序列、组合重音与原字符串。每类都承担不同检查目的,不用大量重复字符代替边界覆盖。

规范参考:Unicode:文本分段。操作场景与排查建议为本站说明。

正确文本与异常文本都要留

原字符串作为异常候选样本应原样保留;正常表情样本用于验证系统不会产生同类变化。分别断言输入输出一致,不在测试中把异常候选无条件替换为某个解释。

每次修复留下一条复现

将真实故障缩减成无敏感数据的样本,并记录曾经失败的边界。配置修好后验证新写入,再单独评估旧数据;不要把新数据正常当成历史数据全部恢复。

可执行检查单

  1. 01列出边界样本和预期码点。
  2. 02执行输入、查询、导出、重新导入的往返。
  3. 03记录版本与失败差异,保留回滚副本。

一个常见问题

界面看起来正常就可以结束吗?

对于编码修复,还应验证保存并重新读取后的数据;显示正常可能掩盖持久化过程中的替换。

本页结论

把本次可复现故障留成小样本,后续升级时可以快速发现同类回归。