能够有效避免 LLM 产生幻觉的智能体框架 Parlant

Parlant 是一款专为抑制大模型幻觉设计的智能体框架,提出注意力推理查询(ARQ)方法:通过 JSON 结构化模板强制模型在每步推理中回答规则约束、历史操作、工具调用等关键问题,使长对话中的规则遵循率提升至 90.2%,显著优于思维链,在复杂流程与多轮交互中更稳定可靠。

发布于2025年10月21日 03:11
编辑零重力瓦力
评论0
阅读16

一个新的能够有效避免 LLM 产生幻觉的智能体框架 Parlant,它采用了一种新的,叫做注意力推理查询(Attentive Reasoning Queries, ARQ)的推理方式。开发者表示,这种新的方式,在各种测试场景下的准确率高达 90.2%,比现在流行的 Chain-of-Thought(思维链)还要靠谱。

我们在和大模型聊天时都会遇到这样的问题,一开始模型还能记住各种规则,但聊着聊着,它就会慢慢忘了初衷。比如你给它写了一大堆操作规范,明明说了 “绝不能主动承诺退款”,结果聊到后面,它还是可能直接许诺给客户退款。这个问题的根本原因是模型难以在长对话里持续关注关键的规则和上下文。

传统的思维链方法(CoT),虽然让模型 “分步思考”,但整个过程还是比较自由,缺乏强约束。ARQ 的思路完全不一样,它的每一步推理都被设计成 “有针对性的问题”,而且这些问题是写死在结构化模板(Json 格式的文本)里。举个例子,模型每一步都要明确回答,当前客户在问什么?相关的行为准则是什么?之前采取过哪些操作?接下来要不要调用外部工具?等等。这种方式可以反复强化最重要的规则,让推理过程变得可控、可查。

能够有效避免 LLM 产生幻觉的智能体框架 Parlant

这样,模型最终的输出就不会是一堆天马行空的内容,而是走完一条有明确节点、有约束、能追溯的推理流程。开发团队的数据测试现实,ARQ 的表现确实比传统做法更稳,尤其在涉及复杂流程和多轮对话时,表现非常突出。

这个方法已经被集成进 Parlant 这个很火的开源项目里了,现在很多人都在用。ARQ 主要用在三个环节:挑选适用的行为规则、判断是否需要调用外部工具,以及最终生成对客户的回复。

归根结底,一个重要启示就是:让推理过程结构化、可量化、和实际业务贴合,模型就不容易胡说八道。自由发挥听起来很强大,但在要求严谨、流程复杂的场景里,结构化的推理方式才是真正靠谱的选择。

项目地址:github.com/emcie-co/parlant

相关文章

双智能体协作,告别单点故障时代
AI 教程知识
2026年4月17日
0 条评论
小创

双智能体协作,告别单点故障时代

AI 博主 Alex Finn 演示了 OpenClaw 与 Hermes 的多智能体搭配方案,通过“主力规划 + 助手执行”的分工模式,实现成本与效率的最优解。该架构利用高性能模型负责复杂任务,轻量模型承担监控巡检,配合共享记忆机制,不仅将故障恢复时间从小时级压缩至秒级,还能避免重复踩坑。这种消除单点故障、按需分配任务的思路,适用于各类开发场景及多智能体协作系统。

#OpenClaw#智能体
阅读全文
Codex :万物之法典
AI 产品工具
2026年4月17日
0 条评论
小创

Codex :万物之法典

OpenAI 发布 Codex 重大升级, AI 编程助手新增操控计算机、并行运行、记忆学习等能力,整合 90 余个插件。系统用户已超 300 万,正从辅助工具向“数字同事”角色转变,重新定义开发边界——人类负责决策创意,机器承担执行跟进。

#OpenAI#Codex
阅读全文
OpenAI Codex 借助 Computer Use 转型为超级应用
AI 产品工具
2026年4月17日
0 条评论
小创

OpenAI Codex 借助 Computer Use 转型为超级应用

OpenAI 将 Codex 升级为全能桌面工作中心,实现从编程助手到工作操作系统的战略跨越。新版本支持多智能体并行控制 macOS 、内置浏览器评论、 GPT-image-1.5 图像生成等功能,整合 90 余个新插件,并确立 GPT-5.4 为推荐模型。目前周活开发者超 300 万,企业用量较年初增长 6 倍。 OpenAI 刻意回避“编程助手”定位,转而强调打造开发者日常操作界面,这标志着智能体正从单点工具向多模态交互、系统级产品演进。

#OpenAI#智能体
阅读全文
互动讨论

评论区

围绕《能够有效避免 LLM 产生幻觉的智能体框架 Parlant》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。