外观
论文精读:从这里开始
Agent Harness 的每一块组件——循环、工具、记忆、规划、评测——都能在具体论文里找到被实验验证过的原型。这个栏目把相关研究整理成四种用法:按路径读、逐篇精读、按主题查、追前沿。
你该从哪开始?
- 只有两小时 → 走阅读路径的「快速入门」线:ReAct → SWE-bench → SWE-agent → 一篇综述,建立领域直觉。
- 想做工程落地 → 走阅读路径的「工程落地」线,重点读 Agentless、SWE-agent、CodeAct 的精读,最后回到构建自己的 Harness动手。
- 想做研究或写综述 → 先翻论文地图建立坐标系,再按主题组推进,最后扫前沿进展看 2025 年之后问题换到了哪个方向。
- 只想查某一篇论文 → 直接在论文地图里按主题定位,每篇都有 arXiv 编号、机构、年份和一句话贡献。
这个栏目里还有什么?
- 阅读路径 — 三条按目标排好顺序的阅读路线(4 小时 / 2 周 / 1 周)
- 经典论文精读 — ReAct、MRKL、Toolformer、Reflexion、Generative Agents、Voyager、SWE-agent 七篇逐篇精读:问题、机制、实验结论、对 harness 设计的启示
- 论文地图 — 按主题分组的完整学术地图,附范式迁移时间轴
- 前沿进展 — 2025–2026 年的六条研究主线:长时程执行、上下文工程、记忆基础设施、多智能体、自我改进、评测纪律
- 阅读纪律与 FAQ — 论文数字怎么读、引用时要注意什么
一条建议
不管你走哪条路,先记住一件事:这些论文里的绝对分数几乎全部依赖当时的模型版本与 harness 配置,值得带走的是机制与失败分析,不是 leaderboard 数字。详见 FAQ。