arXiv:2607.15550:SeerGuard以安全世界模型预测移动GUI智能体动作的后果
Xue Yu及合作者提出SeerGuard,一个基于Safety-Augmented World Model、面向移动GUI智能体的consequence-aware(后果感知)安全框架,具备执行前指令审查功能。在Qwen3-VL-8B-Instruct模型上,safety-utility评分从0.191提升至0.596,risk-cost评分从0.347降至0.130,且在不同智能体间具有泛化能力。
本文由人工智能基于一手来源生成。
SeerGuard如何防止移动智能体做出危险动作?
Xue Yu及合作者在论文《SeerGuard: A Safety Framework for Mobile GUI Agents via World Model Prediction》(arXiv:2607.15550)中提出了一种面向移动GUI智能体——即自主操作移动应用界面、代替用户点击按钮和输入文本的AI系统——的consequence-aware(后果感知)安全框架。SeerGuard在执行前审查指令本身,并额外在每个单独动作层面评估风险,而不是等到动作已经执行完毕后才评估安全性。
Safety-Augmented World Model作为审查基础
该系统的核心是Safety-Augmented World Model(SAWM),它结合了两项功能:预测界面下一个状态——即模拟智能体执行特定动作后会发生什么的世界模型——以及对该预测后果的安全风险评估。因此,执行前审查不仅依赖指令文本本身,还依赖对动作后果的预测,先于智能体在真实设备上实际执行该动作。
Qwen3-VL-8B-Instruct上的结果:更高的实用性,更低的风险
在Qwen3-VL-8B-Instruct模型上,omega参数为0.8时,safety-utility评分从0.191提升至0.596,同时alpha参数为0.8时,risk-cost评分从0.347降至0.130。换言之,配备SeerGuard的智能体在完成任务方面并未损失实用性,安全性却得到了提升,且作者表示这一改进能够泛化到不同的移动GUI智能体,而不仅限于测试所用的模型。
常见问题
- SeerGuard在移动GUI智能体执行动作前会检查什么?
- SeerGuard在执行前会审查指令本身,并利用Safety-Augmented World Model评估移动GUI智能体每个单独动作的风险,该模型会预测界面的下一个状态,同时评估该动作的安全风险。
- 在Qwen3-VL-8B-Instruct模型上,SeerGuard对智能体安全性的提升有多大?
- 在omega为0.8时,safety-utility评分从0.191提升至0.596,同时在alpha为0.8时,risk-cost评分从0.347降至0.130,且这一改进能泛化到测量所用模型之外的其他移动GUI智能体。
📬 AI 新闻直达您的邮箱
按您的方式定制每日摘要——自选主题、来源和频率,一键退订。