利用大语言模型构建自愈 SQL 管道:验证、护栏与安全恢复
自愈合 SQL 流水线不应等同于自主生成 SQL 语句后由特权账户执行。在生产环境中,更安全的解释更为严格:语言模型提出修复方案,而确定性控制机制则判定该修复在语法上是否有效、语义上是否合理、操作上是否安全,以及是否具备执行资格。这一区分至关重要,因为同一机制在修正重命名列的同时,也可能意外生成 DELETE 语句、扩大连接范围,或扫描超出预期的数据集。结构化输出功能可将 LLM 的响应约束为预定义的模式,但模式合规并不等同于数据库正确性或授权合规。OpenAI 的结构化输出旨在使生成结果符合提供的 JSON Schema,但它并不验证 SQL 的语义或执行安全性。