能够有效避免 LLM 产生幻觉的智能体框架 Parlant

Parlant 是一款专为抑制大模型幻觉设计的智能体框架,提出注意力推理查询(ARQ)方法:通过 JSON 结构化模板强制模型在每步推理中回答规则约束、历史操作、工具调用等关键问题,使长对话中的规则遵循率提升至 90.2%,显著优于思维链,在复杂流程与多轮交互中更稳定可靠。

发布于2025年10月21日 03:11
编辑零重力瓦力
评论0
阅读84

一个新的能够有效避免 LLM 产生幻觉的智能体框架 Parlant,它采用了一种新的,叫做注意力推理查询(Attentive Reasoning Queries, ARQ)的推理方式。开发者表示,这种新的方式,在各种测试场景下的准确率高达 90.2%,比现在流行的 Chain-of-Thought(思维链)还要靠谱。

我们在和大模型聊天时都会遇到这样的问题,一开始模型还能记住各种规则,但聊着聊着,它就会慢慢忘了初衷。比如你给它写了一大堆操作规范,明明说了 “绝不能主动承诺退款”,结果聊到后面,它还是可能直接许诺给客户退款。这个问题的根本原因是模型难以在长对话里持续关注关键的规则和上下文。

传统的思维链方法(CoT),虽然让模型 “分步思考”,但整个过程还是比较自由,缺乏强约束。ARQ 的思路完全不一样,它的每一步推理都被设计成 “有针对性的问题”,而且这些问题是写死在结构化模板(Json 格式的文本)里。举个例子,模型每一步都要明确回答,当前客户在问什么?相关的行为准则是什么?之前采取过哪些操作?接下来要不要调用外部工具?等等。这种方式可以反复强化最重要的规则,让推理过程变得可控、可查。

能够有效避免 LLM 产生幻觉的智能体框架 Parlant

这样,模型最终的输出就不会是一堆天马行空的内容,而是走完一条有明确节点、有约束、能追溯的推理流程。开发团队的数据测试现实,ARQ 的表现确实比传统做法更稳,尤其在涉及复杂流程和多轮对话时,表现非常突出。

这个方法已经被集成进 Parlant 这个很火的开源项目里了,现在很多人都在用。ARQ 主要用在三个环节:挑选适用的行为规则、判断是否需要调用外部工具,以及最终生成对客户的回复。

归根结底,一个重要启示就是:让推理过程结构化、可量化、和实际业务贴合,模型就不容易胡说八道。自由发挥听起来很强大,但在要求严谨、流程复杂的场景里,结构化的推理方式才是真正靠谱的选择。

项目地址:github.com/emcie-co/parlant

相关文章

Jev 实操指南,用概率闸门重构智能体决策流
AI 新闻资讯
2026年9月18日
0 条评论
小创

Jev 实操指南,用概率闸门重构智能体决策流

TypeSafe AI 推出系统一模型 Jev,作为智能体概率决策闸门,仅返回带校准概率的结构化结果而不生成文本。该模型具备低成本、低延迟及零输出错误率特性,支持 Choice、Score、Noul 三种提问原语。文章详解了其 API 调用、SDK 集成及推测式并行、置信度路由等五种落地模式,并指出其本质是强类型函数调用而非廉价 LLM。建议在生产环境中锁定版本、规避算术任务,并通过影子模式实测校准效果。

#智能体#AI 编程#提示词工程
阅读全文
Anthropic 开源知识工作插件库,111 个无代码技能包重塑智能体工作流
AI 教程知识
2026年9月18日
0 条评论
小创

Anthropic 开源知识工作插件库,111 个无代码技能包重塑智能体工作流

Anthropic 开源 knowledge-work-plugins 项目,提供 111 个无代码智能体技能包。该体系基于 Markdown 和 JSON 构建标准化模块,支持渐进式披露与 MCP 工具集成,标志提示词工程向软件工程化转型。内置 marketing 与 productivity 等插件展示了结构化输入及分层记忆范式,支持语义路由与轻量化定制。尽管存在多插件上下文竞争及云端连接器限制内网访问等问题,仍为智能体工作流提供了可复用的模块化规范。

#智能体#AI工具#提示词工程
阅读全文
Plugin4Shell 零点击攻破四大编程智能体 SHA 固定
智能体工程
2026年9月18日
0 条评论
小创

Plugin4Shell 零点击攻破四大编程智能体 SHA 固定

安全团队 AIR 披露高危漏洞 Plugin4Shell,影响 Claude Code、Codex 等四大主流 AI 编程智能体。该漏洞利用 Git 分支命名解析歧义绕过 SHA 固定机制,使攻击者可通过插件后台自动更新实现零点击远程代码执行。这是 AI 智能体生态首个分发层供应链漏洞,打破了传统安全审阅的信任假设。目前 Anthropic 和 OpenAI 已修复,Google 建议迁移,Microsoft 尚未发布补丁。开发者需在客户端增加 HEAD 哈希校验以防范风险。

#智能体#AI 编程#安全
阅读全文
互动讨论

评论区

围绕《能够有效避免 LLM 产生幻觉的智能体框架 Parlant》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。