第1步:把模糊问题改成核验任务
原问题如果只是“张维是谁”,几乎无法得到唯一答案。案例把任务限定为:当文章同时出现“清华大学”和“力学”时,张维是否指向工程教育与力学领域的历史人物,以及页面中的身份描述能否获得公开资料支持。
核验项只保留四个:所属领域、机构关系、代表性身份、活动年代。这样做的好处是避免顺手收集无关经历,也不把其他同名张维的照片、账号或商业信息混进来。
做张维对比,最怕把检索过程写成一句“网上查过了”。下面用一个可复现案例还原全过程:目标是判断“清华、力学”语境中的张维,应对应哪类公开人物资料。案例不靠搜索排名拍板,而是从问题拆解、候选建档、官方来源交叉验证到结论分级,完整走一遍。
原问题如果只是“张维是谁”,几乎无法得到唯一答案。案例把任务限定为:当文章同时出现“清华大学”和“力学”时,张维是否指向工程教育与力学领域的历史人物,以及页面中的身份描述能否获得公开资料支持。
核验项只保留四个:所属领域、机构关系、代表性身份、活动年代。这样做的好处是避免顺手收集无关经历,也不把其他同名张维的照片、账号或商业信息混进来。
候选A记录为“工程教育、力学、清华相关的张维”;其他缺少清华或力学锚点的同名结果统一放入候选B组。此时不凭搜索位置淘汰任何人,只比较页面是否同时命中两个限定词。
每张卡分开记录原始链接、网页标题、发布机构和页面日期。搜索摘要可能截断句子,也可能保留旧缓存,因此摘要只用于发现线索,不能直接写进结论。
公开机构资料显示,力学家、工程教育家张维与清华大学存在明确关联,并拥有中国科学院院士、中国工程院院士等可由相应机构名录核对的身份。此类信息由高校档案或院士名录承载,证据等级高于无署名人物简介。
再看聚合页面:若其领域、机构和时间线与官方资料一致,可作为阅读入口;若页面额外加入官方来源没有支持的经历,就把新增部分单独标黄。张维对比不是比较哪篇写得长,而是比较每句话能否落到出处。
案例结论可以写成:在“清华大学+力学”的明确语境下,相关信息可对应到力学家、工程教育家张维;核心身份应以清华大学及院士机构公开资料为准。这个结论只适用于该语境,不能外推到所有名为张维的账号和页面。
最后保存检索日期和证据表。网页会更新,机构称谓也可能因年代不同而变化。把“已确认”“待核实”“与本题无关”分开,比做一个笼统人物合集更可靠,也方便别人复查整个过程。