I build and maintain open-source AI agent systems, primarily through nanobot.
Awesome Agent Concurrency
上一次我们讨论了 multiagent system(后面我就简写成 mas 了)设计中存在的一些问题。如果还没读过,也没什么影响。anyway,我们继续在这篇文章里聊聊现代 mas 设计中的一些协议和算法。 ...
multiagent collaboration 问题的初步整理
最近在研究multiagent collaboration, 做了一些调查, 写一篇文章做一些总结, 这应该会是第一篇 我们先来做一些定义方面的工作, 方便后续的讨论 层级 描述 多提示词工作流 同一个模型分别扮演 planner, critic, reviewer 中央编排的专家集合 一个编排器动态选择模型, 工具或subagent 分布式协作系统 各 agent 拥有不同信息, 状态, 工具或权限, 没有单一全知节点 开放式 agent 生态 成员, 目标, 联盟, 角色和制度都可能动态变化 表格中前两类问题更多的属于 复合推理 / 工作流优化, 2026 年的两篇论文讨论了这类问题. ...
Why we prompt?
Why we prompt? 2023 年 2 月 24 日是我第一次使用大模型。那时我刚开始学 C++,GPT-3.5 给了我不小的震撼。“What is xxx?” 大概是那一年我最常用的开场白。 ...
关于 Claw-SWE-Bench
最近沉迷 agent,所以对相关论文和 bench 比较感兴趣。下面这篇是我最近看到的比较炸裂的一篇。 https://arxiv.org/html/2606.12344v1 https://github.com/opensquilla/claw-swe-bench 我的结论很简单:这篇可以看看 bench 设计思路,但是实验结论基本没什么意义。原因也很直接:论文把单次运行、混杂对比和不完整实验网格写成了看起来很确定的结论。作者明知每个组合只跑一次,还在正文里讨论排名、机制和框架优劣,多多少少有点让我脑内自动浮现派大星翻白眼流哈喇子表情包。 ...