🟢 🛡️ セキュリティ 公開日: · 2 分で読めます ·

arXiv:2607.15550:SeerGuardが安全世界モデルでモバイルGUIエージェントの行動の結果を予測

arXiv:2607.15550 ↗

アプリのインターフェースと、エージェントの次のステップの予測経路が示されたモバイル画面

Xue Yuと共同研究者らは、Safety-Augmented World Modelに基づく、モバイルGUIエージェント向けのconsequence-aware(結果認識型)安全フレームワークであるSeerGuardを提示しています。実行前の指示チェックを備えています。Qwen3-VL-8B-Instructモデルにおいて、safety-utilityスコアは0.191から0.596に上昇し、risk-costスコアは0.347から0.130に低下し、異なるエージェント間での汎化も確認されています。

🤖

この記事はAIにより一次情報源から生成されました。

SeerGuardはどのようにモバイルエージェントの危険な行動を防ぐのか?

Xue Yuと共同研究者らは、論文「SeerGuard: A Safety Framework for Mobile GUI Agents via World Model Prediction」(arXiv:2607.15550)において、モバイルGUIエージェント——ユーザーの代わりにモバイルアプリのインターフェースを自律的に操作し、人間がするようにボタンをタップしテキストを入力するAIシステム——向けのconsequence-aware(結果認識型)安全フレームワークを提示しています。SeerGuardは実行前に指示そのものをチェックし、さらに個々の行動レベルでリスクを評価します。行動がすでに実行された後に安全性を評価するのではありません。

審査の基盤としてのSafety-Augmented World Model

このシステムの中核はSafety-Augmented World Model(SAWM)で、2つの機能を組み合わせています。インターフェースの次の状態を予測すること——エージェントが特定の行動を実行した場合に何が起こるかをシミュレートするワールドモデル——と、その予測された結果に対する安全リスクの評価です。したがって、実行前チェックは指示文のテキストだけに依存するのではなく、エージェントが実際のデバイス上でその行動をまだ実行していない段階での、その行動の予測される結果にも依存します。

Qwen3-VL-8B-Instructでの結果:より高い有用性、より低いリスク

Qwen3-VL-8B-Instructモデルにおいて、omegaパラメータが0.8のとき、safety-utilityスコアは0.191から0.596に上昇し、同時にalphaパラメータが0.8のとき、risk-costスコアは0.347から0.130に低下しました。つまり、SeerGuardを備えたエージェントは、タスク実行の有用性を失うことなくより安全になり、著者らによれば、この改善はテストに使用されたモデルだけでなく、さまざまなモバイルGUIエージェントに汎化するとされています。

よくある質問

SeerGuardはモバイルGUIエージェントが行動を実行する前に何をチェックしますか?
SeerGuardは実行前に指示そのものをチェックし、Safety-Augmented World Modelを用いて、モバイルGUIエージェントの個々の行動それぞれのリスクを評価します。このモデルはインターフェースの次の状態を予測すると同時に、その行動の安全リスクを評価します。
Qwen3-VL-8B-InstructモデルでSeerGuardによりエージェントの安全性はどれだけ向上しますか?
omegaが0.8のとき、safety-utilityスコアは0.191から0.596に上昇し、alphaが0.8のとき、risk-costスコアは0.347から0.130に低下します。この改善は、測定に使われたモデル以外の他のモバイルGUIエージェントにも汎化します。

📬 AIニュースをあなたの受信箱へ

毎日のダイジェストを自分仕様に——トピック、ソース、頻度を選べます。ワンクリックで解除。