附录 B — 用 Agent 复现一篇论文
很多经管论文的复现包并不复杂——一篇 PDF、一个(或几个)dofile、一份数据(Energy Economics 等期刊的复现包常常就是这样)。真正的难点不在跑代码,而在读懂项目结构、理顺运行顺序、核对结果与论文是否一致。这一节给出一套用 Agent 复现论文的通用流程。
B.1 四步流程
论文复现
先诊断(不改文件)→出复现路线图→逐脚本复跑→逐表核对
第一步,先诊断,不要改。 让 Agent 先读 PDF 和代码,弄清:主程序是哪个、脚本按什么顺序运行、路径是否写死在作者电脑上、缺哪些外部命令、哪个脚本生成哪张表 / 图。第一条指令永远是”先诊断、列计划,不要动文件”。
第二步,让它给一份复现路线图。 产出 reproduce_plan.md,把运行顺序、依赖、每步产物写清楚,你先审一遍再放行。
第三步,逐脚本复跑。 把绝对路径改成相对路径、补装缺失的外部命令、逐个脚本运行,全程留 log。发现报错就带着 log 回到 Agent,一步步修。
第四步,逐表核对。 把复现出的表格、图形与论文原文逐一对照,记录一致 / 不一致,不一致的要追因(数据版本?样本口径?随机种子?)。
B.2 一份可直接用的开场提示词
完整的任务说明书骨架见 附录 A · 场景模板二:论文复现。
B.3 复现自查清单
- 从原始数据能一键跑到最终结果(不依赖任何中间文件);
- 路径全部相对化,换台电脑也能跑;
- 外部命令依赖已列出且可安装(
ssc install ...); - 每一张表、每一张图都能对应到论文中的具体位置;
- 有一份
reproduce_log.md,记录每步做了什么、结果是否与论文一致。
B.4 延伸阅读
一次真实论文的完整复现实录(含截图、
diff、与论文原表的逐项对照)将在课后补充到这里。