广州日报
字体问题和编码问题需要分开处理。更换字体只能解决“有编码但没有字形”的显示问题,不能把一串独立字符重新合成为原来的罕见字;😎Unicode规范化也主要负责字符形式🎊统一,不能根据上下文自动猜回未知汉字。
如果来源是图片,人工对照的重点应放在“辶”是否真正包围右侧部件、右侧部件是否为“喿”或形近字、末笔是否属于同一个字。若来源是网页或电子书,则应查看复制前后的字数和字体效果,判断问题发生在显示层还是文本层。
“辶喿辶喿辶臿”与“辶喿辶念”汉在没有原始出处时,适合被描述为“待识别字形串”,不适合直接当作一个已经确定的汉字词使用。
直接按当前纯文本判断,“辶喿辶喿辶臿”与“辶喿辶念”汉不是可以直接确认的固定汉字词,也不能仅凭这些相邻部件推导出唯一读音或含义。这里的“辶”更像汉字部件,“喿”“臿”“念”“汉”则是可以独立编码的字符;多个字符连续显示,不等于它们已经组合成一个新的汉字。