上下文工程已不足够——一个无需大语言模型参与的循环工程实验 笔记

上下文工程已不足够——一个无需大语言模型参与的循环工程实验

大家都在谈论循环工程,但大多数讨论都假设大语言模型位于循环的中心。我想将架构本身隔离出来。因此,我构建了一个确定性、零依赖的 Python 基准测试,用简单规则替换模型,使我能够直接回答一个问题:目标导向的控制器是否比传统线性流水线更好地隔离故障?在跨 300 个随机种子验证该基准测试——并修复了一个最初使我的结果无效的微细 bug 之后——我发现该控制器始终能够完成线性执行器从未触及的独立分支。本文将阐述架构、基准测试设计、调试过程,以及支撑这一狭窄但具有实用价值的论断的证据:故障隔离是控制流的可度量属性,与大语言模型的推理无关。