I build and maintain open-source AI agent systems, primarily through nanobot.

multiagent collaboration 问题的初步整理

最近在研究multiagent collaboration, 做了一些调查, 写一篇文章做一些总结, 这应该会是第一篇 我们先来做一些定义方面的工作, 方便后续的讨论 层级 描述 多提示词工作流 同一个模型分别扮演 planner, critic, reviewer 中央编排的专家集合 一个编排器动态选择模型, 工具或subagent 分布式协作系统 各 agent 拥有不同信息, 状态, 工具或权限, 没有单一全知节点 开放式 agent 生态 成员, 目标, 联盟, 角色和制度都可能动态变化 表格中前两类问题更多的属于 复合推理 / 工作流优化, 2026 年的两篇论文讨论了这类问题. ...

August 17, 2026 · 4 min · chengyongru

Why we prompt?

Why we prompt? 2023 年 2 月 24 日是我第一次使用大模型。那时我刚开始学 C++,GPT-3.5 给了我不小的震撼。“What is xxx?” 大概是那一年我最常用的开场白。 ...

June 18, 2026 · 3 min · chengyongru

关于 Claw-SWE-Bench

最近沉迷 agent,所以对相关论文和 bench 比较感兴趣。下面这篇是我最近看到的比较炸裂的一篇。 https://arxiv.org/html/2606.12344v1 https://github.com/opensquilla/claw-swe-bench 我的结论很简单:这篇可以看看 bench 设计思路,但是实验结论基本没什么意义。原因也很直接:论文把单次运行、混杂对比和不完整实验网格写成了看起来很确定的结论。作者明知每个组合只跑一次,还在正文里讨论排名、机制和框架优劣,多多少少有点让我脑内自动浮现派大星翻白眼流哈喇子表情包。 ...

June 12, 2026 · 5 min · chengyongru