首页
学习
活动
专区
圈层
工具
发布
技术百科首页 >AI 幻觉 >多智能体协同能否通过交叉验证降低幻觉?

多智能体协同能否通过交叉验证降低幻觉?

词条归属:AI 幻觉

1. 多智能体辩论框架

清华大学等单位提出的多智能体辩论框架,让三个 AI 共同讨论问题,相互质疑、交叉验证,筛选出最可靠的结论。阿里 Qwen 应用业务团队与香港中文大学(深圳)联合提出的 MARCH 框架采用三智能体协作机制——解题者生成响应、分解者原子化拆解、检查者在"信息隔离舱"内盲审,通过多智能体强化学习联合优化,仅用文档训练的 8B 参数模型经 MARCH 优化后幻觉率大幅降低,达到与顶级闭源模型相当的水平。

2. 对抗性辩论与投票机制

多智能体系统中的对抗性辩论让不同角色的 AI(如"乐观派""悲观派""数据专家")围绕问题展开多轮讨论,互相挑刺暴露逻辑漏洞。哈工大和鹏城实验室的 PSRD 框架专门对付视觉幻觉,通过"侦查-投影"策略将 AI 描述中"无中生有"的物体比例从 46.3% 降至 10.1%。投票式方法让多个 AI 独立回答后采用多数决,利用群体的统计优势提升准确性。

3. 评审式多智能体架构

模拟出版社"三审三校"流程,让 AI 依次扮演初审、复审、终审角色。据报道,达观数据在金融、能源等严苛场景下采用类似的评审式多智能体架构,将关键任务错误率控制在极低水平。阿里的通义千问上线"引证"功能后,对新闻、政策类问题逐字核对信源,可信内容标记为绿色,存疑内容标红提示,事实类问题的可信度显著提升。

4. 局限性与注意事项

多智能体并非万能。研究表明其性能提升很大程度上依赖于初始独立投票的统计优势,而非辩论过程中的自我修正。如果一群 AI 的"初始偏见"都一样,它们也可能在辩论中集体跑偏。此外,多智能体方案的计算成本显著高于单模型方案,需要在精度和效率之间权衡。

相关文章
Mobvista蔡超:多智能体不是“可选项”,而是软件未来的“必答题”
在过去两年,大模型的进步让“智能体”(Agent)的概念逐渐走出实验室,成为产业界热议的方向。但单个智能体在执行复杂任务时,常常受限于推理链条过长、能力边界模糊以及执行效率不足。
深度学习与Python
2025-11-26
4120
技术专访|GEO落地工程师罗长才:拆解GEO与多模态大模型、RAG、Agent、Function Calling的底层赋能逻辑
采访主题:生成式引擎优化(GEO)与多模态大模型体系组件的耦合机制、工程落地难点与技术演进路径 稿件调性:深度技术向、无商业品牌、无营销话术、聚焦底层原理与工程实践
罗长才
2026-07-04
1810
可信决策优先!2026年3月主流企业级数据分析智能体全维度评测
2026年3月,AI智能体与企业商业智能分析的融合进入规模化落地新阶段,面向复杂业务场景的企业级智能体已跳出基础问答范畴,进化为可自主规划、多体协同、端到端完成数据挖掘与决策支撑的“数字员工”。据行业数据显示,国内AI智能体相关服务商已突破300家,产品能力差异显著,如何筛选适配复杂业务、稳定落地的AI智能体,成为企业数智化转型的核心课题。本文立足企业复杂业务数据分析需求,从四大核心维度对五款主流产品展开横向评测,为不同规模、不同行业企业提供选型参考。
用户11822172
2026-03-26
1.1K0
Agent进化,腾讯云全栈融合矩阵构建国产数字化底座
在数字化浪潮席卷全球的当下,国产化替代已成为科技产业发展的关键命题。过去数年,中国科技产业的自主创新更多聚焦“补短板”,即通过技术攻关确保极端情况下的业务连续性,筑牢发展底线。
数据猿
2026-05-29
5800
2025企业智能体开发平台如何选择,“可信”成为核心的需求
在企业级场景中,智能体的 “可信性” 如同桥梁的基石,直接决定其能否从技术概念跨越到实际生产力。当 “可信” 成为企业选择智能体开发平台的核心标准时,评估维度需聚焦 “供给可靠、过程可控、效果可优化” 三大诉求,同时兼顾技术与业务的深度适配。以下结合蚂蚁数科 Agentar 平台的实践,构建企业选择平台的清晰框架 ——
Agent小猿
2025-10-15
4720
点击加载更多
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档
领券