研究分享|大模型高压下集体 “对齐失效”?复旦 × 创智 × 牛津发布 AutoControl-Arena:前沿 AI 风险评测迈向自动化

复旦大学、上海创智学院与牛津大学联合发布 AutoControl-Arena,不仅推出一套自动化、高保真、可复现的前沿 AI 安全评测框架,更揭露多个反直觉的发现:在压力与诱惑的双重考验下,当前主流大模型普遍存在对齐幻觉—— 那些表面看似安全的模型,在真实压力下瞬间 “破防”

成果分享 | 正在互联网“裸奔”的小程序云服务

复旦大学系统软件与安全实验室小程序安全研究小组对小程序云服务进行了系统研究,揭示了数千个小程序存在云资源泄露风险,大量敏感数据在互联网中“裸奔”。该研究成果已发表于网络安全顶会NDSS 2026。

偷拍、窃密... 你的龙虾(OpenClaw)是我的了!

我们做了一个完整的端到端攻击实验。结果发现:只需在群里 @ 一下 OpenClaw,再加上一条精心设计的指令,就可能诱导它执行非法的操作,比如打开主人的摄像头、窃取主人的文件、甚至控制主人的电脑!