🟢 🛡️ Sicherheit Veröffentlicht: · 2 Min. Lesezeit ·

arXiv:2607.15550: SeerGuard sagt mit einem Sicherheits-Weltmodell die Folgen von Aktionen mobiler GUI-Agenten voraus

arXiv:2607.15550 ↗

Ein Mobiltelefon mit einer App-Oberfläche und einem hervorgehobenen Pfad, der den nächsten Schritt des Agenten vorhersagt

Xue Yu und Kollegen stellen SeerGuard vor, ein konsequenzbewusstes Sicherheits-Framework für mobile GUI-Agenten mit Pre-Execution-Prüfung von Anweisungen, basierend auf einem Safety-Augmented World Model. Beim Modell Qwen3-VL-8B-Instruct steigt der Safety-Utility-Score von 0,191 auf 0,596, und der Risk-Cost-Score sinkt von 0,347 auf 0,130, bei Generalisierung über verschiedene Agenten hinweg.

🤖

Dieser Artikel wurde mithilfe von künstlicher Intelligenz aus Primärquellen erstellt.

Wie verhindert SeerGuard gefährliche Aktionen mobiler Agenten?

Xue Yu und Kollegen stellen im Paper „SeerGuard: A Safety Framework for Mobile GUI Agents via World Model Prediction” (arXiv:2607.15550) ein konsequenzbewusstes Sicherheits-Framework für mobile GUI-Agenten vor — KI-Systeme, die eigenständig die Oberfläche einer mobilen App anstelle des Nutzers bedienen, Schaltflächen antippen und Text eingeben, wie es ein Mensch tun würde. SeerGuard prüft vor der Ausführung die Anweisung selbst und bewertet zusätzlich das Risiko auf der Ebene jeder einzelnen Aktion, statt die Sicherheit erst nach der bereits ausgeführten Aktion zu beurteilen.

Safety-Augmented World Model als Grundlage der Prüfung

Das Rückgrat des Systems ist das Safety-Augmented World Model (SAWM), ein Modell, das zwei Funktionen kombiniert: die Vorhersage des nächsten Oberflächenzustands — ein Weltmodell, das simuliert, was passiert, wenn der Agent eine bestimmte Aktion ausführt — sowie eine Sicherheitsbewertung des Risikos dieser vorhergesagten Konsequenz. Die Pre-Execution-Prüfung hängt somit nicht nur vom Text der Anweisung ab, sondern auch von der vorhergesagten Konsequenz der Aktion, bevor der Agent sie überhaupt auf dem tatsächlichen Gerät ausführt.

Ergebnisse bei Qwen3-VL-8B-Instruct: höherer Nutzen, geringeres Risiko

Beim Modell Qwen3-VL-8B-Instruct steigt der Safety-Utility-Score bei einem Parameter Omega von 0,8 von 0,191 auf 0,596, während der Risk-Cost-Score bei einem Parameter Alpha von 0,8 gleichzeitig von 0,347 auf 0,130 sinkt. Mit anderen Worten: Ein Agent mit SeerGuard wird sicherer, ohne dabei an Nutzen bei der Aufgabenausführung zu verlieren, und laut den Autoren generalisiert die Verbesserung über verschiedene mobile GUI-Agenten hinweg, nicht nur auf das getestete Modell.

Häufig gestellte Fragen

Was prüft SeerGuard, bevor ein mobiler GUI-Agent eine Aktion ausführt?
SeerGuard prüft vor der Ausführung die Anweisung selbst und bewertet das Risiko jeder einzelnen Aktion eines mobilen GUI-Agenten mithilfe eines Safety-Augmented World Model, das den nächsten Oberflächenzustand vorhersagt und gleichzeitig das Sicherheitsrisiko dieser Aktion bewertet.
Wie stark verbessert sich die Agentensicherheit mit SeerGuard beim Modell Qwen3-VL-8B-Instruct?
Der Safety-Utility-Score steigt bei Omega 0,8 von 0,191 auf 0,596, während der Risk-Cost-Score bei Alpha 0,8 gleichzeitig von 0,347 auf 0,130 sinkt, und die Verbesserung generalisiert auch auf andere mobile GUI-Agenten außerhalb des gemessenen Modells.

📬 KI-News in dein Postfach

Ein täglicher Digest nach deinen Regeln — Themen, Quellen und Rhythmus wählbar. Abmeldung mit einem Klick.