
Agent 单步很强,任务一长却容易迷路。本文以代码 Agent 为例,分析误差累积、上下文膨胀和奖励稀疏,并梳理轨迹数据、后训练、安全与评估中的关键方法。
Apr 11, 2026

Code Agent 的能力不只来自模型,也来自规划、工具、验证、上下文和权限组成的控制闭环。本文从搜索、反馈、RLVR 与长期运行四个角度拆解这套中控系统。
Jan 2, 2026

记录一些在实践代码大语言模型过程中的经验和思考总结,本篇是关于代码智能体的相关内容,包括代码智能体的关键功能、关键技术方案等。主要来源于公开论文。
Feb 1, 2024