01arXivAI智能体社会需要社交框架来防止协作失败
论文提出"智能体社会"概念,指多个AI智能体跨越信任边界、为不同主体的目标进行自主协作的场景。研究通过实验发现,即便参与的智能体均为诚实且能力完备,仅凭现有框架与消息传递原语仍常常无法达成令人满意的协作结果;而一旦系统中混入故障或恶意智能体,后者便可利用通信机制中的漏洞(即"言语"层面的缺陷),蓄意拖慢协作进程、操纵决策结果,甚至实施其他有害行为。这意味着智能体的安全风险已从单体的提示注入、越权操作等层面,延伸至多智能体间的交互协议本身。论文据此主张,智能体社会迫切需要一套"社交治理框架",用以规范跨主体协作中的通信、信任与行为约束。该研究揭示了当前多智能体系统在互操作与安全治理上的结构性短板,为未来智能体协议设计与平台治理提供了重要参照。
原文 ↗