正在补充深度解读,当前内容可以先阅读
论文解决了什么问题
AGENTS.md、CLAUDE.md 已成为 Coding Agent 的常见配置,但它们是否真的提高代码正确率并不清楚。论文在 Claude Code 和 Codex、3 个真实 Python 仓库、17 项任务和 288 次有效运行上进行受控消融;通用上下文文件没有带来可测量的正确率提升,失败主要来自功能设计、模式选择和精确接线,而不是缺少仓库知识。不过,包含高价值运行约束的上下文可以减少无效测试和执行时间。由于样本量较小,这一结论不应外推为“上下文文件完全无用”。
可核验的原论文来源和作者
- 作者
- Prakhar Khatri
- 来源
- arXiv
- 论文 ID
- 2607.27250