3.1 资料检索与文献调研
写课程论文要查资料,打开搜索引擎,前五条三个广告两个软文;问对话 AI,它给你的「参考文献」点开根本不存在;好不容易找到几十篇 PDF,又读不完。本讲教你一套带来源、可核验的资料检索工作流——这是场景篇的第一课,也是后面所有 playbook 的地基。
本讲你将学到
- 为什么「直接问 AI」查资料不靠谱,正确姿势是「搜索 AI + 对话 AI」配合
- 四件查资料工具的分工:秘塔搜索(AI 搜索)、MiMo(读长资料)、Kimi(找文献)、智谱 AiResearch(查论文)
- 三个可复制的提示词:调研提问、长文档提炼、综述梳理
- 来源核验法:AI 给的每一条信息,如何 30 秒判断真伪
前置:建议先读完认知篇(知道 AI 会幻觉)和提问篇 2.1(会写「做什么+给背景+提要求」的提示词)。手上有什么 AI 都能跟做:主线 MiMo(小米 AI App 或 mimo.xiaomi.com),免费兜底 DeepSeek / Kimi / 智谱清言 均可。
1. 场景痛点:查资料的三重暴击
回顾一下你写「课程论文 / 调研报告」时的典型经历:
| 痛点 | 具体表现 |
|---|---|
| 搜索全是坑 | 搜索引擎结果页前几条是广告和营销号,权威内容被淹没 |
| AI 一本正经胡说 | 问「XX 领域研究现状」,AI 编出几条格式完美但不存在的参考文献 |
| 资料长到读不完 | 找到一份 80 页的行业报告 / 三十篇文献,没时间也没精力逐篇啃 |
第 0 篇讲过:AI 是生成式的,它「补全」出最像答案的话——你不给它真实资料,它就只能编。所以正确思路不是「换更聪明的 AI」,而是换工作流:让搜索类工具负责「找」,让对话 AI 负责「读和理」,让你自己负责「核验」。
2. 工具选择:四件工具各干一件事
| 工具 | 是什么 | 什么时候用 | 费用 |
|---|---|---|---|
| 秘塔 AI 搜索(metaso.cn) | AI 搜索引擎:帮你读完全网,给出带来源链接的结构化答案 | 调研第一步:摸清一个陌生领域 | 免费、无广告 |
| MiMo(主线) | 小米的大模型,全模态 + 1M 超长上下文(一次能读约一百万 token,相当于几本书) | 把找到的长 PDF / 报告喂给它提炼 | App 免费;API 极低价 |
| Kimi(kimi.moonshot.cn) | 长文本见长的对话 AI,文献检索口碑好 | 找相关文献、快速看懂一篇论文 | 免费版够用 |
| 智谱清言 AiResearch | 挂在智谱清言里的学术检索智能体,背后是 Aminer 论文库 | 查论文、查学者、做综述问答 | 免费 |
先记住一句话
搜索类工具(秘塔)给的是「真资料」,对话 AI(MiMo/Kimi)给的是「加工力」。 顺序错了(先问对话 AI 要资料),幻觉就来了。
免费兜底:DeepSeek、Kimi、智谱清言都自带联网搜索能力,日常查资料够用;本讲以 MiMo 为主线示范,你手头任何一款都能平替。
3. 分步操作:一次完整的资料调研
以一个真实任务为例:「写一篇《大学生使用 AI 工具的现状与影响》课程论文」,两周后交。 跟着做四步。
第 1 步:秘塔搜索做首轮摸底
打开 metaso.cn,选中**「学术」**模式(查论文专用;日常用「全网」模式),输入:
大学生使用生成式 AI 工具的现状 调查数据秘塔会返回一份结构化答案:要点总结 + 每条信息附脚注来源。注意页面右上/中间通常还能一键生成大纲或思维导图——用它快速看到这个主题分几块。
关键动作:点开脚注
秘塔的价值不在「答案」,在「来源」。看到有用的数据(比如「84.88% 受访大学生用过 AI 工具」),立刻点脚注打开原文:是权威调查(中青校媒)还是营销号转载?记下原始出处——这将来就是你论文里的引用。
第 2 步:把长资料喂给 MiMo 提炼
首轮调研后你会攒下一堆 PDF:行业报告、论文、政策文件。别硬读,喂给 MiMo。在小米 AI App 或 mimo.xiaomi.com 里上传文件,用这个提示词:
【任务】帮我提炼这份文档中与「大学生 AI 使用」相关的全部要点。
【背景】我在写课程论文,需要它作为论据来源。
【要求】
1. 按主题分组输出要点,每条标注它出现在文档的哪一部分;
2. 单独列出文档中的所有关键数据(数字、比例、日期),原样摘录不要改写;
3. 最后用 3 句话总结这份文档对我的论文有什么用;
4. 不确定或文档里没有的内容,直接说「文档中未提及」,不要补充。第 4 条是灵魂——显式禁止 AI 发挥,把幻觉风险摁下去。1M 上下文意味着几十页报告可以整份上传,不用切块。
第 3 步:Kimi / AiResearch 补文献
对话页问 Kimi:「推荐 10 篇关于大学生使用生成式 AI 的中英文实证研究论文」,或到智谱清言里找 AiResearch 智能体做学术问答。拿到文献列表后——
这一步必须人工
AI 推荐的每一篇文献都要自己验证存在:标题复制到知网 / Google Scholar / 学校图书馆数据库搜一次,搜得到、作者对得上,才算真。第 0 篇讲过:虚假引用正在爆发式增长,AI 给的文献清单里混几篇编造的是常态而非意外。验证通过的,下载 PDF 回到第 2 步喂给 MiMo 提炼——工作流闭环了。
第 4 步:让 AI 梳理综述框架(注意:是梳理,不是代写)
资料读完了,让 AI 帮你搭头脑风暴:
我在写《大学生使用 AI 工具的现状与影响》课程论文,已收集资料如下:
(粘贴你的要点笔记)
请帮我:1. 指出这些资料可以支撑哪几个论点;2. 补充我可能遗漏的角度;
3. 给出一个「文献综述」章节的组织建议。
注意:只基于我提供的资料分析,不要编造新的研究结论。注意措辞:AI 在整理你的东西,不是替你生产观点。这条线在 3.2 论文辅助篇会反复出现——它就是学术合规的生命线。
4. 验收清单:资料调研做完的自查
- [ ] 每一条进论文的数据,都有可点开的原始来源(不是「AI 说的」)
- [ ] 来源本身可靠:期刊、官方机构、主流媒体、一手调查,而不是营销号洗稿
- [ ] 关键数据至少经过两个独立来源交叉验证(两家都说 84.88% 才敢写 84.88%)
- [ ] AI 推荐的文献 100% 经过存在性验证
- [ ] 笔记里能区分:哪些是资料原文,哪些是 AI 的总结,哪些是你自己的想法
5. 红线提醒
资料检索的三条红线
- AI 给的参考文献必须逐条反查。The Lancet 2026 年研究审计了约 250 万篇论文,识别出 4046 条虚假引用——AI 编造引用已经严重到上了顶级医学期刊。反查方法见上文第 3 步。
- AI 生成的「综述」不能直接交。它读过的资料和你不同,直接交等于把幻觉打包上交。正确用法:AI 梳理框架 → 你逐条核对 → 用自己的话重写(详见3.2 论文辅助)。
- 别把内部资料喂给公网 AI。未公开数据、导师未发表的手稿、涉密内容,不要上传到任何在线 AI——详见规范篇 6.2 隐私与安全。
跟做练习
实践(约 30 分钟)
用你最近一门课的作业题目,完整走一遍四步流:①秘塔学术模式摸底并点开 3 个脚注;②找一份长 PDF 喂给 MiMo 用第 2 步提示词提炼;③让任意 AI 推荐 5 篇文献并逐条反查,记录几篇是编造的;④用第 4 步提示词梳理出三个可支撑论点。把「反查出几篇假文献」记下来——这个数字会让你终身记得核验的重要性。
下一步
资料已就位、核验已成习惯,下一讲直击最敏感的场景:毕业论文里 AI 到底能干什么、绝对不能干什么——复旦六条禁令逐条拆解 + 引用反查 SOP → 3.2 论文辅助(不越线版)
本页核验日期:2026-09-22(秘塔搜索免费/学术模式、Kimi 长文本与文献检索、智谱 AiResearch、MiMo 1M 上下文均经搜索核实;虚假引用数据出自 The Lancet 2026-08 研究,转引自本站调研文档 docs/01)