Skip to content

用 Codex 完成带来源的研究报告

研究任务最危险的结果不是“少找了一篇文章”,而是把未经核实的摘要、旧数据和推断写成确定事实。本页建立一条可审计流程:问题拆解、来源分级、主张台账、交叉验证、写作和引用检查。

不会写代码怎样完成本章

普通用户使用 ChatGPT Work、网页搜索和文档/表格能力即可完成主流程:先确认研究问题,再让任务建立来源清单和主张台账,最后生成可预览报告。你不需要编写爬虫、数据库或分析脚本。

research-plan.mdclaim-ledger.csv 等名称只是便于说明的文件格式,也可以改成 Word 计划书和 Excel 来源表。批量抓取、API、自动引用检查和程序化去重属于技术增强选项。

如果还不会判断来源和检查成品,先学习 文件验收教程

第一步:把主题改成可回答的问题

差问题:“研究 AI 电商”。

可执行问题:

text
截至 2026-07-11,一个 5 人跨境电商团队把 AI 用于选品、Listing、素材和客服时,哪些环节已经有可落地工具,哪些环节仍必须人工控制?重点比较成本、数据权限、质量风险和上线门槛。

定义:时间范围、地区、对象、比较维度和决策目的。

第二步:建立来源层级

优先顺序:

  1. 官方文档、法规、原始数据和正式发布;
  2. 官方仓库、技术论文和可复现实验;
  3. 可靠媒体、行业报告和专家访谈;
  4. 社区文章、视频和社交内容,用于发现线索;
  5. 搜索摘要,只用于导航,不直接作证据。

产品能力、命令、版本和价格必须优先回到当前官方来源。

第三步:先写研究计划

text
先不要写报告。把研究问题拆成 6-10 个子问题,给每个子问题定义需要的证据、首选来源类型、时间范围和停止条件。

输出 research-plan.md。不要开始大范围搜索,先让我审查。

停止条件很重要,例如“找到一份官方说明和一份独立实测交叉验证”比无限搜索更可控。

第四步:建立检索日志

source-log.csv 字段:

text
source_id,title,url,publisher,date,accessed_at,source_type,question,relevance,notes

提示:

text
按 research-plan.md 搜索。每打开一个来源就记录 source-log.csv。不要把搜索结果摘要当正文证据;必须打开原页面。遇到登录、验证码、付费墙或访问限制时停止并标记,不绕过。

第五步:建立主张台账

claim-ledger.csv

text
claim_id,claim,source_ids,evidence_type,status,confidence,caveat,report_section

每个准备写入报告的事实必须有来源。状态可以是:confirmedconflictingunverifiedanalysis

text
把来源中的候选结论写入 claim ledger。每条用自己的话表达,不复制长段原文。区分来源明确说了什么、可以合理推导什么、还不知道什么。

第六步:处理冲突和时效

遇到两个来源结论不同:

  • 比较发布日期和适用版本;
  • 比较样本、地区和定义;
  • 回到原始数据或官方说明;
  • 在报告中保留分歧,不强行选一个;
  • 写清当前判断和不确定性。

价格、套餐、模型、法规和市场数据必须标注核验日期。

第七步:先写结论骨架

text
只使用 claim-ledger.csv 中 confirmed 和 analysis 项,生成报告骨架。

结构:
1. 结论摘要;
2. 决策建议;
3. 证据与比较;
4. 风险和限制;
5. 仍需回答的问题;
6. 方法与来源。

每段标注将使用的 claim_id,不写完整正文。

先审查证据能否支持结论,再进入润色。

第八步:完成正文与引用

text
按已确认骨架写 3000-4000 字中文报告。每个版本敏感或可争议事实紧跟引用链接;短引文保持必要长度,其余用原创归纳。把作者分析明确写成分析,不伪装成来源结论。

对每条引用检查:

  • 链接能打开;
  • 页面确实支持前面的句子;
  • 日期和版本匹配;
  • 没有把二手转述伪装成原始来源;
  • 引用范围没有覆盖过大的综合结论。

第九步:做反方审查

text
以怀疑者角度审查报告:找出证据不足、相关性被写成因果、样本偏差、过期事实、定义偷换和遗漏反例。每条回到 claim ledger 和来源验证,不只给泛泛意见。

第十步:交付可复核材料

最终目录:

text
research/
├── report.md
├── report.pdf
├── research-plan.md
├── source-log.csv
├── claim-ledger.csv
└── figures/

公开交付时不要附带受限原文、个人数据、登录内容或无权再分发的附件。

常见失败

搜索很多,证据很少

从“网页数量”转向“主张是否有第一方证据”。

引用链接和句子无关

逐条打开验证,不依赖搜索摘要和模型记忆。

内容像目标文章

先建立自己的问题、claim ledger 和结构,再用自己的语言归纳;避免沿用来源的标题顺序、比喻和句式。

把没有结果写成负面结论

“没有找到证据”不等于“事实不存在”。标为未验证并说明检索范围。

完成门槛

  • [ ] 研究问题有时间、范围和决策目的。
  • [ ] 每条关键事实进入 claim ledger。
  • [ ] 搜索摘要没有直接充当证据。
  • [ ] 冲突、分析和未知项清楚区分。
  • [ ] 引用逐条打开验证。
  • [ ] 报告结构和语言为原创归纳。

事实来源

程序员小枫同学:用好新工具,练好工程内功,做出可靠交付。