原文、字节、候选结果的验证关系,强调可逆不等于确认来源
阅读口径

本文保留原字符串;操作在副本上进行,候选结果需由来源证据核对。

一个图形可能含多个码点

表情并不总是单个字符。某些序列使用零宽连接符 U+200D 连接成员,渲染器支持时显示为组合图形;不支持时可能分别显示组成部分。

规范参考:Unicode:Emoji 序列与呈现。操作场景与排查建议为本站说明。

不要清理掉看不见的字符

U+FE0F 可请求表情呈现,U+FE0E 可请求文字呈现,具体支持取决于字符及环境。按“不可见就是垃圾”的规则删除选择符或连接符,会改变呈现意图。

规范参考:Unicode:Emoji 序列与呈现。操作场景与排查建议为本站说明。

样本与通用知识的边界

原字符串四字并不包含 ZWJ 或变体选择符。这里讨论的是排查其他表情内容的邻接知识,不能拿组合序列解释原字符串全部成因。

可执行检查单

  1. 01输出整个码点序列,包括不可见成员。
  2. 02对照 Unicode Emoji 文档核对序列组成。
  3. 03保留原序列,在支持的环境中做显示对照。

一个常见问题

拆成两个图形就说明数据坏了吗?

不一定。先确认序列是否完整,再核对平台支持;序列相同而显示不同,通常需要排查渲染环境。

本页结论

以码点为证据,以屏幕效果为现象,不用肉眼长度代替数据检查。