操作指南 · 定位文档中的體體體
定位文档中的體體體
先做完整字符串定位,再分别检查繁简和空格变体;对重复抽取的命中回到原始版面。
體體體:先做完整字符串定位,再分别检查繁简和空格变体;对重复抽取的命中回到原始版面。
直接答案
定位文档中的體體體
先做完整字符串定位,再分别检查繁简和空格变体;对重复抽取的命中回到原始版面。
按步骤执行
操作步骤
- 从完整查询开始
- 扩展时保留不同组别
- 核对原始显示与抽取文本
- 记录结论的适用范围
从完整查询开始
在目标文档查找框输入體體體。记录文档名称和查询本身。若支持精确字符串匹配,核对结果是否真有三个连续字;网页搜索引擎的引号查询行为并不完全相同,不能把所有检索工具当成同一套规则。
扩展时保留不同组别
查不到再单独尝试体体体,随后才检查是否是體 體 體或跨行文字。扩展结果只提供候选位置,不改写原始查询。本站输入“體體體”能检索讨论原串的条目;输入“体体体”找到讨论简体副本的条目,两者不会被自动当作一个查询。
核对原始显示与抽取文本
若在PDF或扫描件抽取文本中命中,把命中位置与原页对齐。单个字可能因多层文本或抽取处理而重复;也可能原页本来就有三个字。只有检查原件后才能区分,不要凭抽取结果确定一个新名词。
记录结论的适用范围
可写“该文件第某处存在原串”或“只命中简体副本”;不能由此推广成某品牌或机构的官方名称。若目标是寻找出处,当前无可靠出处就保留未确定状态。本指南提供文本定位方法,不承诺找到同名实体。
数据透明度
方法依据与原始资料
- Unicode Unihan 繁体对应数据 已核验
- 发布方
- Unicode Consortium
- 访问日期
- 2026-09-10
- 支持字段
- 体 U+4F53 与體 U+9AD4 的对应
常见问题