论文指出,多智能体 LLM 流水线会把某个智能体接收的恶意内容作为可信输入继续传播,形成单智能体系统较少见的结构性安全缺口。作者提出“边界验证”安全原语,覆盖内容、身份、执行意图与状态完整性,并在 GAIA、SWE-Bench 生产轨迹及 GPT-5-mini、Claude Sonnet 4.5、Kimi K2.5 上研究注入、冒充、计划偏离和记忆投毒。
最近 24 小时暂无可用热度快照。