尧图精选

AI Agent 开发工程师(十四):给模型的回答装上三道闸门——护栏与兜底

🕒 发布时间:2026/10/2 20:07:43 📁 来源:尧图网络
Agent 会乖乖交卷,但我们得先给答卷装个"自动判题机"上一篇我们真跑出一个扎心的结论:即便你写死了"严禁编造",LLM 照样会在逼它输出 JSON 时,偷偷编个 1999.00 塞给你。prompt 是人话,模型是概率,你没法用"你发誓不准编"焊死它。那怎么办?靠"押宝给模型自觉"终归不牢。真正可靠的是在代码层给它装上护栏(guardrail):无论模型说什么,都在它出门之前质检一遍——输出是不是合法 JSON?价格在不在合理范围?查不到时有没有老实说?不对就拦下、修拦截、或降级。这就是这一篇要做的:让 Agent 的"靠得住",从"看它说多好听"变成"代码先于结果把诡异拦下来"。一句话:prompt 是"前台劝导",guardrail 是"后台保安"。前台你劝它别干坏事,后台它在干坏事前一定要被拦死。护栏要守的三道闸门这一篇给我们那个股票 Agent 焊三道闸(全部能在代码层面真测真拦):结构闸(JSON 校验):说好了返回 JSON,那就必须真的是合法 JSON、字段类型对、不能多不能少。用json.loads+ 字段检查,非法就拦。语义闸(防编造 / 数值范围):价格必须在合理范围(茅台不可能 1 元,也不可能 1 万)。落在区间外,判定"可疑",标注suspect或直接标纠。查
上一篇/下一篇内容由系统自动关联 返回资讯列表 →