LLMAgentPapers:一份按能力维度切分的智能体论文清单,但维护节奏需要你自己判断
Must-read Papers on LLM Agents.
秒懂
- 它是什么?
- zjunlp/LLMAgentPapers 是浙江大学团队维护的 LLM Agent 论文清单,按人格、记忆、规划、工具使用等能力维度组织。它适合入门检索,但更新频率和覆盖范围需要读者自行核实。
- 适合谁用?
- 适合刚进入 LLM Agent 领域、需要一份按能力维度组织论文列表的研究生或工程师。它把人格、记忆、规划、工具使用分开排列,找某类文献时比按时间堆叠的列表高效。
- 能商用吗?
- 未经许可不能。GitHub 在这个仓库里没有找到许可证文件;没有许可证,默认即「保留所有权利」:你可以阅读代码,但不能复用。使用前请看看 README,或先征得作者同意。
- 还在维护吗?
- 在维护。仓库最近一次提交在 4 天前。
- 用什么语言写的?
- GitHub 没有给出这个仓库的主要语言。
以上回答依据项目的 GitHub 数据(最近同步于 2026年9月15日)和我们的分析,不构成法律意见。
开源项目深度解析
一份解决检索问题的清单,而不是一个软件
这个仓库不提供代码,没有安装步骤,也没有可运行的程序。它是一个 Markdown 文件构成的论文索引,收录 LLM Agent 方向的必读文献。解决的问题很具体:这个领域论文分散在 arXiv 的多个子类,关键词也不统一,新人很难知道该从哪几篇读起。仓库把论文按研究问题切分,而不是按发表时间排列。目标读者是刚进入该领域、需要系统建立文献地图的研究者。对于已经在某个子方向深耕的人,这份清单的价值会递减,因为它不包含代码链接,也不提供论文之间的引用关系分析。
分类逻辑:先分单智能体,再分多智能体
清单的主干层级很清晰。顶层分 Overview 和 Agent 两大类,Agent 下面再按能力拆成 Personality、Memory、Planning、Tool use、RL training 五个小类。这个切分方式有实际用途:如果你想找关于工具调用的论文,不需要在标题里猜,直接进 Tool use 一节。多智能体部分单独成章,里面再按交流目的分成 Task-Oriented Communication 和 Casual/Open Conversations,前者又细分为 Collaborative Exchanges 与 Adversarial Interactions。这种树状结构比平铺列表更接近研究问题的自然边界。代价是有些论文可能横跨多个类别,比如一篇同时涉及记忆和规划的工作只能被放在一个位置,读者如果只翻其中一个分类,可能会漏掉它。
时间跨度与更新节奏的落差
仓库的 News 栏显示创建于 2023 年 6 月,目的是维护多智能体论文列表。最后推送时间是 2026 年 9 月 5 日,但这不是说内容一直活跃更新。Overview 部分收录的论文从 2023 年 5 月延伸到 2026 年 3 月,其中 2026 年那篇是预印本平台的稿件,尚未经过同行评审。清单里大量条目集中在 2023 到 2024 年,2025 年的只有少数几篇。这种时间分布说明维护者可能在某段时间集中补充,之后进入低频状态。对读者而言,这份清单适合作为历史脉络的参考,不适合作为追踪前沿的工具。如果把它当成最新论文的入口,会错过 2025 年下半年到 2026 年之间可能出现的多个重要工作。
从仓库布局能确认什么,不能确认什么
能确认的是分类结构和每篇论文的 arXiv 链接。Personality 类收有 Theory of Mind 是否在 LLM 中涌现的争议性研究,也有角色扮演与毒性分析的工作。Tool use 与 RL training 的分类存在,但 README 被截断,无法看到这两个分类下具体收录了哪些条目。同样,Framework、Application、Others 以及 Resources 里的 Benchmarks、Tool List 等章节的具体内容也不可见。这意味着本文无法评价这些部分的完整程度。如果你依赖这份清单做文献综述,建议先克隆仓库,检查你关心的分类下条目数量是否达到预期,再决定是否把它作为主要依据。
与同类清单的差异:维护方背景与扩展资源
仓库由 zjunlp 团队维护,该团队还管理 Prompt4ReasoningPapers 和 KnowledgeEditingPapers 两个相邻方向的清单,分别覆盖提示推理与知识编辑。三个仓库互相链接,形成一个围绕 LLM 能力研究的小型资源网络。这种关联是它的一个特点:从 Agent 论文跳到提示工程的论文,不需要换一个维护者重新适应其分类习惯。与那些按会议或年份整理的列表相比,这份清单按研究问题组织,更像一份阅读路线图。但它不提供论文之间的对比分析,也不标注哪些是必读中的必读,所有条目在格式上完全平等。对于想快速定位几篇奠基性工作的读者,这种扁平结构反而增加了筛选成本。
许可证与贡献方式的实际含义
README 顶部标注 MIT 许可证,这是对清单排版与文字组织的授权,不延伸到每篇论文的内容,那些论文各自保留版权。仓库设有 Contribution 章节并列出 Contributors,说明维护者接受外部提交。如果你想补充某篇缺失的论文,提交 pull request 即可,不需要经过复杂的审核流程。但仓库没有提供明确的收录标准,比如是否只收 arXiv 论文、是否优先选引用量高的工作、对预印本与正式发表版本如何取舍。这些规则缺失意味着贡献者只能凭感觉判断某篇论文是否够格。实际使用中,如果你发现某个分类有明显遗漏,与其等待维护者更新,不如自己 fork 一份并在自己的分支上按需增补。
编辑结论
适合刚进入 LLM Agent 领域、需要一份按能力维度组织论文列表的研究生或工程师。它把人格、记忆、规划、工具使用分开排列,找某类文献时比按时间堆叠的列表高效。不适合把这里当成最新动态来源,仓库最后更新停在 2026 年 9 月,而其中许多论文来自 2023 到 2025 年,近半年的新工作没有体现。也不适合需要代码或复现细节的人,这里只有论文摘要链接。采用前先做两件事:对照 arXiv 检查你关心的子领域是否有 2026 年后的重要论文缺失,再确认你依赖的某个具体方向,比如 RL training 或多智能体协作,是否在该分类下收录完整。这份清单的 MIT 许可证只约束清单本身的排版与组织,不改变其中每篇论文各自的版权归属。
社区笔记