Appearance
用 Codex 完成带来源的研究报告
研究任务最危险的结果不是“少找了一篇文章”,而是把未经核实的摘要、旧数据和推断写成确定事实。本页建立一条可审计流程:问题拆解、来源分级、主张台账、交叉验证、写作和引用检查。
不会写代码怎样完成本章
普通用户使用 ChatGPT Work、网页搜索和文档/表格能力即可完成主流程:先确认研究问题,再让任务建立来源清单和主张台账,最后生成可预览报告。你不需要编写爬虫、数据库或分析脚本。
research-plan.md、claim-ledger.csv 等名称只是便于说明的文件格式,也可以改成 Word 计划书和 Excel 来源表。批量抓取、API、自动引用检查和程序化去重属于技术增强选项。
如果还不会判断来源和检查成品,先学习 文件验收教程。
第一步:把主题改成可回答的问题
差问题:“研究 AI 电商”。
可执行问题:
text
截至 2026-07-11,一个 5 人跨境电商团队把 AI 用于选品、Listing、素材和客服时,哪些环节已经有可落地工具,哪些环节仍必须人工控制?重点比较成本、数据权限、质量风险和上线门槛。定义:时间范围、地区、对象、比较维度和决策目的。
第二步:建立来源层级
优先顺序:
- 官方文档、法规、原始数据和正式发布;
- 官方仓库、技术论文和可复现实验;
- 可靠媒体、行业报告和专家访谈;
- 社区文章、视频和社交内容,用于发现线索;
- 搜索摘要,只用于导航,不直接作证据。
产品能力、命令、版本和价格必须优先回到当前官方来源。
第三步:先写研究计划
text
先不要写报告。把研究问题拆成 6-10 个子问题,给每个子问题定义需要的证据、首选来源类型、时间范围和停止条件。
输出 research-plan.md。不要开始大范围搜索,先让我审查。停止条件很重要,例如“找到一份官方说明和一份独立实测交叉验证”比无限搜索更可控。
第四步:建立检索日志
source-log.csv 字段:
text
source_id,title,url,publisher,date,accessed_at,source_type,question,relevance,notes提示:
text
按 research-plan.md 搜索。每打开一个来源就记录 source-log.csv。不要把搜索结果摘要当正文证据;必须打开原页面。遇到登录、验证码、付费墙或访问限制时停止并标记,不绕过。第五步:建立主张台账
claim-ledger.csv:
text
claim_id,claim,source_ids,evidence_type,status,confidence,caveat,report_section每个准备写入报告的事实必须有来源。状态可以是:confirmed、conflicting、unverified、analysis。
text
把来源中的候选结论写入 claim ledger。每条用自己的话表达,不复制长段原文。区分来源明确说了什么、可以合理推导什么、还不知道什么。第六步:处理冲突和时效
遇到两个来源结论不同:
- 比较发布日期和适用版本;
- 比较样本、地区和定义;
- 回到原始数据或官方说明;
- 在报告中保留分歧,不强行选一个;
- 写清当前判断和不确定性。
价格、套餐、模型、法规和市场数据必须标注核验日期。
第七步:先写结论骨架
text
只使用 claim-ledger.csv 中 confirmed 和 analysis 项,生成报告骨架。
结构:
1. 结论摘要;
2. 决策建议;
3. 证据与比较;
4. 风险和限制;
5. 仍需回答的问题;
6. 方法与来源。
每段标注将使用的 claim_id,不写完整正文。先审查证据能否支持结论,再进入润色。
第八步:完成正文与引用
text
按已确认骨架写 3000-4000 字中文报告。每个版本敏感或可争议事实紧跟引用链接;短引文保持必要长度,其余用原创归纳。把作者分析明确写成分析,不伪装成来源结论。对每条引用检查:
- 链接能打开;
- 页面确实支持前面的句子;
- 日期和版本匹配;
- 没有把二手转述伪装成原始来源;
- 引用范围没有覆盖过大的综合结论。
第九步:做反方审查
text
以怀疑者角度审查报告:找出证据不足、相关性被写成因果、样本偏差、过期事实、定义偷换和遗漏反例。每条回到 claim ledger 和来源验证,不只给泛泛意见。第十步:交付可复核材料
最终目录:
text
research/
├── report.md
├── report.pdf
├── research-plan.md
├── source-log.csv
├── claim-ledger.csv
└── figures/公开交付时不要附带受限原文、个人数据、登录内容或无权再分发的附件。
常见失败
搜索很多,证据很少
从“网页数量”转向“主张是否有第一方证据”。
引用链接和句子无关
逐条打开验证,不依赖搜索摘要和模型记忆。
内容像目标文章
先建立自己的问题、claim ledger 和结构,再用自己的语言归纳;避免沿用来源的标题顺序、比喻和句式。
把没有结果写成负面结论
“没有找到证据”不等于“事实不存在”。标为未验证并说明检索范围。
完成门槛
- [ ] 研究问题有时间、范围和决策目的。
- [ ] 每条关键事实进入 claim ledger。
- [ ] 搜索摘要没有直接充当证据。
- [ ] 冲突、分析和未知项清楚区分。
- [ ] 引用逐条打开验证。
- [ ] 报告结构和语言为原创归纳。