(01)

第一次搜索,只能用你已经知道的词

假设你在找自动化决定的申诉证据。搜索“automated appeals”时,结果多是产品页面;咨询机构却用“challenging a decision”,政府机构则用“reconsideration”。这些是值得尝试的检索词,不代表法律含义可以互换。只用最初的说法,可能找不到需要的记录。

AI浏览工具也面临类似问题。BrowseComp测试它们寻找冷门事实的能力,有些题需要多次搜索。[1] OpenAI把deep research描述为会规划、执行搜索,并根据发现继续行动的系统。[2] 这些例子说明,能调用搜索引擎只是其中一步,下一次搜索还要用上前一次学到的东西。

打开有用的结果后,问两件事:它能帮助回答问题吗?它有没有提示更好的搜索词或查找地点?页面即使没有答案,也可能指出哪个机构保存记录,或链接到原始研究。把这些线索和答案一起留下。

一条有用的结果,可以告诉你下一步该搜什么。
(02)

列出要覆盖的词、地点和人群

大量收集文档前,先写一个简短计划。列出人们可能使用的词,包括旧称、缩写和其他语言;再列可能保存证据的地方,如研究数据库、官方记录、产品文档、社区组织;最后注明最初搜索可能漏掉谁的经历或哪个时期。

在申诉的例子中,供应商可以解释产品如何工作,政府机构可能公布处理数据,咨询机构可能描述人们质疑决定时的困难。它们回答不同的问题。跨这些来源查找,能避免把记录详尽的产品说法当成整个服务的全貌。

每部分都写明希望找到什么、预计在哪里找到。“在机构年报中查处理时间”比“研究效率”更容易执行。找不到时,也能继续检查记录是否存在、访问是否受限,或是否搜错了名称。

(03)

先用一轮搜索熟悉领域的说法

开始时,跨几种来源阅读,留意反复出现的术语、作者、机构、日期和引文。保存几份有用的起始文档及其信息。还没弄清哪些材料有帮助前,不必下载每个看似相关的结果。

宽泛搜索能找到更多可能有用的材料,也带来更多无关结果;精确搜索减少阅读负担,却可能漏掉用了不同说法的资料。信息检索中,相关材料找得多全叫查全率,结果中相关材料占多少叫查准率。Cochrane指南介绍了根据已找到记录调整检索词的做法。[5] 探索项目可以先发现术语,再逐渐缩小搜索;系统综述仍须达到方案要求的覆盖范围。

第一轮结束后,写一份简短交接说明:下一步使用哪些词、查看哪些来源、还缺什么。例如:“机构报告用reconsideration,咨询页面用challenge。已有服务统计,但没有中途放弃者的经历。”下一轮就有了明确目的。

(04)

根据发现调整搜索

一篇论文可能介绍一个词,让你找到某个档案,再从中发现不同解释。Marcia Bates把这种不断变化的过程称为“采莓式检索”:有用信息分散在各处,每次发现都可能改变下一次搜索。[4] 最合适的检索式不一定一开始就知道。

把调整理由写具体。如果多份相关机构记录使用“reconsideration”,就把它与原来的词一起试。如果多份报告引用同一研究,就找原研究。如果结果都来自错误的国家,就加上目标地区,或搜索当地记录。每次改变都应回应你发现的情况。

保留新旧搜索词,用一句话说明为什么改。这样也容易发现另一种倾向:因为赞同某些结果,就不断往那个方向搜。有用的调整应帮助补齐材料、核对原始来源,或检验可能挑战最初答案的解释。

能说明自己学到了什么,调整检索式才有意义。
(05)

查文档引用了谁,也查后来谁引用它

报告提出重要说法时,打开它引用的来源,确认实际研究了什么、报告是否保留原来的限制。再找引用这份来源的后续工作。它们可能重复发现、换个环境检验、批评或纠正。这样能找到与你的搜索词表述不同的材料。

沿文档参考文献往前找,叫后向引文检索;找后来引用它的文档,叫前向引文检索。TARCiS指南建议,系统综述应把引文检索与其他方法结合,不能把一条引用链当成完整覆盖。[7] 从单一学科或语言出发,可能一直停留在同一范围内。

如果问题需要不同视角,就选择多份相关起始文档。记录文档、使用的引文索引、搜索日期和追查轮数。如果还有相关新记录却停止了,也说明原因。这些是TARCiS提出的报告事项的一部分。[7] 别人才能看出搜索到了哪里。

(06)

分头搜索,再一起核对

问题包含可分开的部分时,人或AI智能体可以同时搜索。例如分别查官方记录、技术评估和使用经历。Anthropic介绍过多智能体研究系统中的这种分工。[3] 如果大家都要先弄清同一个未知,比如研究哪个服务、采用哪种定义,并行就不太有帮助。

每条搜索都应有明确任务、可能的来源、时间限制和共同的返回格式。写清哪些记录可以访问等限制。除了摘要,还要求返回来源链接、重要段落、失败的搜索词和缺口。否则可能收到几份漂亮答案,却不知道实际检查了什么。

合并结果时,查看关键段落、比较定义,并把重复说法追到原始来源。三个智能体意见一致,也许只是找到了三篇引用同一报告的文章。底层来源仍然只有一份,可能还需要独立核查。

(07)

简要记录改变搜索的决定

浏览历史能显示打开了哪些页面,却很少说明为什么换词或放弃某个档案。边做边记一个小日志:注意到什么、改了什么、后来怎样。失败的搜索如果能让其他研究者少走弯路,也值得记录。

准确的搜索式和限制条件要及时保存,事后重建很困难。[5] 正式文献检索还可以请别人审核策略。PRESS指南涉及搜索是否对应研究问题、AND和OR是否用对,以及拼写变体或筛选条件是否意外排除了有用记录等。[6]

记录的细度要适合作业。探索式搜索可记下改变可发现材料的决定,如新词、日期限制、新档案或停止理由。系统综述则要保存报告规范要求的完整检索细节。简短决策日志解释思路,不能替代这些记录。

趁还记得时,写下改变方向的原因。
(08)

看看再搜一次可能增加什么

二十份报告可能只是同一说法的二十个版本。与其数文档,不如看最近的搜索增加了什么:新的人群、不同解释、矛盾,还是能改变答案的证据?如果一直重复核查过的内容,继续搜索的价值可能降低。

停止前,核对计划中的地点和术语,并列出剩余缺口。Cochrane讨论了包括新词能否带来相关记录在内的停止思路,适用方法取决于综述类型。[5] 探索搜索中的重复,是复查进展的理由,不是通用停止规则。搜完能访问的记录,也不会让薄弱的答案自动变强。

最后简要说明搜过哪里、有哪些重要转向、没能覆盖什么。写明什么会让工作重启:开放的档案、新研究,或缺失人群的证据。读者应能看懂为什么停下,以及还有哪些问题没解决。