🟢 🛡️ 安全 发布于: · 1 分钟阅读 ·

arXiv:2607.15550:SeerGuard以安全世界模型预测移动GUI智能体动作的后果

arXiv:2607.15550 ↗

手机屏幕显示应用界面及智能体下一步预测路径的标注

Xue Yu及合作者提出SeerGuard,一个基于Safety-Augmented World Model、面向移动GUI智能体的consequence-aware(后果感知)安全框架,具备执行前指令审查功能。在Qwen3-VL-8B-Instruct模型上,safety-utility评分从0.191提升至0.596,risk-cost评分从0.347降至0.130,且在不同智能体间具有泛化能力。

🤖

本文由人工智能基于一手来源生成。

SeerGuard如何防止移动智能体做出危险动作?

Xue Yu及合作者在论文《SeerGuard: A Safety Framework for Mobile GUI Agents via World Model Prediction》(arXiv:2607.15550)中提出了一种面向移动GUI智能体——即自主操作移动应用界面、代替用户点击按钮和输入文本的AI系统——的consequence-aware(后果感知)安全框架。SeerGuard在执行前审查指令本身,并额外在每个单独动作层面评估风险,而不是等到动作已经执行完毕后才评估安全性。

Safety-Augmented World Model作为审查基础

该系统的核心是Safety-Augmented World Model(SAWM),它结合了两项功能:预测界面下一个状态——即模拟智能体执行特定动作后会发生什么的世界模型——以及对该预测后果的安全风险评估。因此,执行前审查不仅依赖指令文本本身,还依赖对动作后果的预测,先于智能体在真实设备上实际执行该动作。

Qwen3-VL-8B-Instruct上的结果:更高的实用性,更低的风险

在Qwen3-VL-8B-Instruct模型上,omega参数为0.8时,safety-utility评分从0.191提升至0.596,同时alpha参数为0.8时,risk-cost评分从0.347降至0.130。换言之,配备SeerGuard的智能体在完成任务方面并未损失实用性,安全性却得到了提升,且作者表示这一改进能够泛化到不同的移动GUI智能体,而不仅限于测试所用的模型。

常见问题

SeerGuard在移动GUI智能体执行动作前会检查什么?
SeerGuard在执行前会审查指令本身,并利用Safety-Augmented World Model评估移动GUI智能体每个单独动作的风险,该模型会预测界面的下一个状态,同时评估该动作的安全风险。
在Qwen3-VL-8B-Instruct模型上,SeerGuard对智能体安全性的提升有多大?
在omega为0.8时,safety-utility评分从0.191提升至0.596,同时在alpha为0.8时,risk-cost评分从0.347降至0.130,且这一改进能泛化到测量所用模型之外的其他移动GUI智能体。

📬 AI 新闻直达您的邮箱

按您的方式定制每日摘要——自选主题、来源和频率,一键退订。