← 返回首页

多模型互杠排错经历

发布时间: 2026-08-11 10:26(北京时间)

摘要: 作者记录了使用 Hermes Agent 更新后出现桌面端故障,通过 TUI 并行调用 Deepseek 和 Codex 排查修复的经历。过程中发现不同模型的分析思路差异明显,且修复成功未必代表根因正确。作者由此强调多模型互杠与人类复判的重要性,语气冷静且有工程反思色彩。

标签: AI排错, 多模型协作, 工程反思, 调试经历, 冷静

字数: 464

[哈哈] 第一次被 AI 说我是 “bleeding-edge user”。

Hermes Agent 已经很久没有出现那种一更新就炸的情况了,最多最多就是引入一些没考虑周到且令人难受的 Bug。而且,每次更新前我都会先让 Hermes 写详细的更新报告,看完后才决定是否更新。

不过早上更新后我的桌面版直接就炸了,连不上后端,log 提示是后端挂了。但我 tui 还是正常的。于是在 tui 让 Deepseek 排查,并行也让 Codex 排查。

Codex 给出的分析和修复方案我直觉上更加正确,就让 Codex 先修复了。成功后我又让他们俩互杠了几轮,我也帮忙做了些复判他们才达成共识。期间 Deepseek 有偷懒不测给出的错误断言,Codex 也有测试没考虑周全的地方。

Bug 的根因或许已经不太重要了,我看到的是,对于同一个问题,不同的模型的分析思路和习惯可能有不小的差异。已修复不一定意味着根因分析正确,或许也有点“误打误撞”的意思。

重要的事情或许还是得多模型互杠然后让人类复判才行。

image