被神话的 "神话(mythos)" ?——大模型让黑客失业了吗?

本文设计了AgentCyberRange:一套面向真实网络攻击能力的评估与数据生产平台,覆盖Web 渗透、内网渗透、权限提升、防御对抗等多类场景,并记录完整攻击轨迹用于复盘与模型能力提升。目前,我们已积累数十套渗透靶场、超过500台靶机,并持续进行了数月的测试和数据收集。

ICML 26 | 注意力阀门源头抑制,杜绝危险画面元素

团队提出Unified Visual Safety Regulator(UVR)。UVR 在生成过程中主动定位不安全视觉区域,并对相关危险信息流进行调控,从而统一提升图像生成与图像编辑任务的安全性。该方法无需重新训练模型,却能够在安全性、图像质量和编辑能力之间取得良好平衡。