Blog

把书放回床头:我和大模型的向内求与向外看
把书放回床头:我和大模型的向内求与向外看

通勤从地铁换成自驾后,深度阅读的习惯悄悄丢了;把书放回床头,它又慢慢回来了。从这件小事出发,本文把《非暴力沟通》和《助推》看作向内与向外的一体两面,再对照大模型的两层演进:模型自身的推理能力是向内,模型之外的 harness 是向外,讨论两者各自的边界,以及在向外变得太容易的今天,如何把它们组合起来。

Sep 23, 2026

从 Vibe Coding 到 AI-Native Game:生成式游戏技术栈拆解
从 Vibe Coding 到 AI-Native Game:生成式游戏技术栈拆解

生成式游戏 AI 并不是一条单一赛道。本文从生成对象与运行时机出发,拆解 Vibe Coding、专业资产管线、Agent NPC 和神经世界模型四条技术路线,并讨论它们各自真正的工程瓶颈。

May 4, 2026

长程 Agent 为什么会失效:数据、训练与评估
长程 Agent 为什么会失效:数据、训练与评估

Agent 单步很强,任务一长却容易迷路。本文以代码 Agent 为例,分析误差累积、上下文膨胀和奖励稀疏,并梳理轨迹数据、后训练、安全与评估中的关键方法。

Apr 11, 2026

Agent 如何积累能力:RAG、Memory 与 Skills
Agent 如何积累能力:RAG、Memory 与 Skills

RAG、Memory 和 Skills 分别解决信息获取、经验保持与过程复用问题。本文从读写路径、上下文成本和工程边界出发,解释三者如何组合成一套可维护的 Agent 能力系统。

Feb 14, 2026

Code Agent 的中控系统:搜索、验证与长期运行
Code Agent 的中控系统:搜索、验证与长期运行

Code Agent 的能力不只来自模型,也来自规划、工具、验证、上下文和权限组成的控制闭环。本文从搜索、验证、RLVR、上下文与长期运行几个角度拆解这套中控系统。

Jan 2, 2026

如何识别真实需求:从场景验证到价值、共识与模式
如何识别真实需求:从场景验证到价值、共识与模式

真实需求不是用户说想要什么,而是在具体场景中,用户愿意持续付出时间、金钱或切换成本去解决的问题。本文从角色、场景、任务和证据出发,整理一套可验证的需求识别方法,并从价值、共识和模式三个维度判断需求能否成立为一门生意。

Jan 22, 2025

不写代码,但仍要为代码负责:AI for Code 这两年的变化
不写代码,但仍要为代码负责:AI for Code 这两年的变化

2024 年我还在自己写代码,2026 年已经完全交给 Agent。本文回看 AI for Code 这两年的变化:从代码助手到 Code Agent,再到通用 Agent;也讨论不写代码之后,人为什么仍要为代码负责,以及怎样评估 AI 的产出。

Aug 30, 2024

A few things about Code Agent
A few things about Code Agent

记录一些在实践代码大语言模型过程中的经验和思考总结,本篇是关于代码智能体的相关内容,包括代码智能体的关键功能、关键技术方案等。主要来源于公开论文。

Feb 1, 2024

A Survey of Code Foundation Models
A Survey of Code Foundation Models

记录一些在实践代码大语言模型过程中的经验和总结,本篇是关于代码大语言基座模型的相关内容,包括部分经典的代码大语言模型、以及对应的训练数据集和训练策略等信息的收集,其中StarCoder, Deepseeker Coder 以及 CodeLlama 占据相对较多的介绍篇幅。内容均来源于公开论文,不涉及商业敏感信息。

Jan 7, 2024

🌟 阅读笔记锦集
🌟 阅读笔记锦集

坚持阅读的习惯,坚持捕获阅读时刻的灵光一现,温故而知新。

Jan 1, 2024