操作指南 · 逐位核对體體體

逐位核对體體體

确认原串、繁简副本和重复数量,避免用自动去重或长度相等代替逐字校对。

體體體:确认原串、繁简副本和重复数量,避免用自动去重或长度相等代替逐字校对。

方法与示例 · 依据见本文来源

直接答案

逐位核对體體體

确认原串、繁简副本和重复数量,避免用自动去重或长度相等代替逐字校对。

按步骤执行

操作步骤

  1. 先保存原串
  2. 建立位置表
  3. 区分去重与转换
  4. 给出能复查的结论

先保存原串

将原始输入存为A列,写明来自页面正文、输入框还是OCR。本站样本A为體體體。截图可另存,但可复制文本是查空格和码位的依据。不要先裁掉重复字,因为这会破坏要核对的对象。

建立位置表

为A列逐位置编号1、2、3,对应字符均为體。再建立B列体体体作为简体副本:每一位分别核对,不只核对总长度。若发现B为体體体,标记第2位尚未转换;若B只有体体,标记缺少第3位。

区分去重与转换

把體體體变成體是删掉两次出现;变成体体体是按繁简对应换字。这两项修改有不同目的,不能让程序默默合并。未经原文或输入过程支持,不能因字符串看起来重复就断言它是错误。

给出能复查的结论

合格记录可写:原串3字,均为U+9AD4;简体副本3字,均为U+4F53;原串保留。若另有隐藏字符,记录其位置及码位,先确认用途再决定是否删除。无法确定整串出处时直接记录“出处未确定”,无需补造解释。

数据透明度

方法依据与原始资料

已核验
  • 教育部《重編國語辭典修訂本》:體 已核验
    发布方
    教育部
    访问日期
    2026-09-10
    支持字段
    讀音與字義
    查看来源
  • Unicode Unihan 繁体对应数据 已核验
    发布方
    Unicode Consortium
    访问日期
    2026-09-10
    支持字段
    体 U+4F53 与體 U+9AD4 的对应
    查看来源

常见问题

常见问题解答

體體體是一个汉字吗?

给定文本由三个體连续组成,是三个字符。字体图标可把字画得紧密,但不会把文本自动合成一个汉字。

體體體转简体会只剩一个体吗?

按通常繁简对应逐字转换,得到体体体,仍为三个字。只剩一个体意味着还发生了删除重复,属于另一项操作。