一次 Ollama 工具调用缓存问题的排查

nanobot #4867 最初看起来已经解决了。 The-Markitecht 报告说,同一个 llama3.1:8b,直接通过 Ollama 调用很快;经过 nanobot 后,一轮对话却可能多花几十秒。日志中最明显的差别来自缓存:直接调用时,第二个请求能复用大部分 prompt;nanobot 的第二轮主请求只能复用四成左右。 ...

July 20, 2026 · 6 min · chengyongru

基于 LIEF 的 PE 解析死循环排查

在对抗性样本的特征工程流水线里,解析稳定性比性能更早暴露问题。最近处理一批大规模 PE 样本时,我的特征提取器偶发卡住:跑到几万个样本后,某些子进程停在原地,CPU 单核打满,tqdm 进度条也不再前进。 ...

November 28, 2025 · 3 min · chengyongru