一次 Ollama 工具调用缓存问题的排查
nanobot #4867 最初看起来已经解决了。 The-Markitecht 报告说,同一个 llama3.1:8b,直接通过 Ollama 调用很快;经过 nanobot 后,一轮对话却可能多花几十秒。日志中最明显的差别来自缓存:直接调用时,第二个请求能复用大部分 prompt;nanobot 的第二轮主请求只能复用四成左右。 ...
nanobot #4867 最初看起来已经解决了。 The-Markitecht 报告说,同一个 llama3.1:8b,直接通过 Ollama 调用很快;经过 nanobot 后,一轮对话却可能多花几十秒。日志中最明显的差别来自缓存:直接调用时,第二个请求能复用大部分 prompt;nanobot 的第二轮主请求只能复用四成左右。 ...
最近沉迷 agent,所以对相关论文和 bench 比较感兴趣。下面这篇是我最近看到的比较炸裂的一篇。 https://arxiv.org/html/2606.12344v1 https://github.com/opensquilla/claw-swe-bench 我的结论很简单:这篇可以看看 bench 设计思路,但是实验结论基本没什么意义。原因也很直接:论文把单次运行、混杂对比和不完整实验网格写成了看起来很确定的结论。作者明知每个组合只跑一次,还在正文里讨论排名、机制和框架优劣,多多少少有点让我脑内自动浮现派大星翻白眼流哈喇子表情包。 ...