ICML 26 | 注意力阀门源头抑制,杜绝危险画面元素

团队提出Unified Visual Safety Regulator(UVR)。UVR 在生成过程中主动定位不安全视觉区域,并对相关危险信息流进行调控,从而统一提升图像生成与图像编辑任务的安全性。该方法无需重新训练模型,却能够在安全性、图像质量和编辑能力之间取得良好平衡。

AgentGuard:给智能体工具调用行为带上“紧箍咒”

团队提出了AgentGuard,一套面向工具调用型智能体的轻量级访问控制框架。AgentGuard 能够无缝集成到现有智能体系统中,用户可通过可视化界面,以表单化方式根据实际需求灵活配置安全规约;系统则对工具调用请求与安全规约进行匹配,对未授权或高风险调用进行识别与拦截,并完整记录执行轨迹,从而支持事后审计与安全溯源。