阅读口径
本文是检索与阅读方法说明;涉及的候选不等于已经核实的真人身份。
先记录输入的原貌
把完整字串与输入场景分开保存。输入框中的文字、搜索建议和网页标题是三种不同记录;若建议补了后缀,不能将其当作用户原先掌握的资料。本文不提供该字串所指人物的生平结论。
拆分只是检索操作
可以把疑似姓名部分与后缀分别列为两个字段,分别寻找来源。拆分不会证明姓名存在,也不会证明两部分有关联。后缀应标为“输入文本中的标签”,不写进人物职业栏。
建立第一条待核实问题
与其问“她出演过什么”,先问“是否有公开一手页面给出这一姓名的原始写法”。这样把未经证实的前提移出了问题。没有来源时,结论停留在字串层面。
可执行检查单
- 01保存完整输入与看到它的页面地址。
- 02为疑似姓名和后缀分别开一栏。
- 03把身份字段标为尚未建立关联。
一个常见问题
搜索结果很多能证明身份吗?
不能。数量体现被索引的页面,不说明各页面是否独立取证;复制同一个标题也能形成很多结果。
本页结论
把第一步的结果交给字形核对页。只有姓名写法的来源清楚后,才进入同名候选比较。