🟢 🛡️ Sigurnost Objavljeno: · 2 min čitanja ·

arXiv:2607.15550: SeerGuard sigurnosnim svjetskim modelom predviđa posljedice akcija mobilnih GUI agenata

arXiv:2607.15550 ↗

Mobilni telefon s prikazom sučelja aplikacije i naznačenom putanjom predviđanja sljedećeg koraka agenta

Xue Yu i suradnici predstavljaju SeerGuard, consequence-aware sigurnosni okvir za mobilne GUI agente s pre-execution provjerom instrukcija, temeljen na Safety-Augmented World Model. Na modelu Qwen3-VL-8B-Instruct safety-utility score raste s 0,191 na 0,596, a risk-cost score pada s 0,347 na 0,130, uz generalizaciju kroz različite agente.

🤖

Ovaj članak generiran je uz pomoć umjetne inteligencije na temelju primarnih izvora.

Kako SeerGuard sprječava opasne akcije mobilnih agenata?

Xue Yu i suradnici u radu “SeerGuard: A Safety Framework for Mobile GUI Agents via World Model Prediction” (arXiv:2607.15550) predstavljaju consequence-aware sigurnosni okvir namijenjen mobilnim GUI agentima — AI sustavima koji samostalno upravljaju sučeljem mobilne aplikacije umjesto korisnika, dodirujući gumbe i unoseći tekst kao što bi to učinio čovjek. SeerGuard prije izvršenja provjerava samu instrukciju i dodatno procjenjuje rizik na razini svake pojedine akcije, umjesto da sigurnost ocjenjuje tek nakon što je akcija već izvedena.

Safety-Augmented World Model kao temelj provjere

Okosnica sustava je Safety-Augmented World Model (SAWM), model koji kombinira dvije funkcije: predviđanje sljedećeg stanja sučelja, odnosno world model koji simulira što će se dogoditi ako agent izvede određenu akciju, i sigurnosnu procjenu rizika te predviđene posljedice. Pre-execution provjera tako ne ovisi samo o tekstu instrukcije, već i o predviđenoj posljedici akcije prije nego što je agent uopće izvrši na stvarnom uređaju.

Rezultati na Qwen3-VL-8B-Instruct: veća korisnost, manji rizik

Na modelu Qwen3-VL-8B-Instruct safety-utility score raste s 0,191 na 0,596 uz parametar omega 0,8, dok risk-cost score istovremeno pada s 0,347 na 0,130 uz parametar alfa 0,8. Drugim riječima, agent uz SeerGuard postaje sigurniji i pritom ne gubi korisnost izvršavanja zadataka, a autori navode da se poboljšanje generalizira kroz različite mobilne GUI agente, ne samo na testiranom modelu.

Česta pitanja

Što SeerGuard provjerava prije nego mobilni GUI agent izvrši akciju?
SeerGuard prije izvršenja provjerava samu instrukciju i procjenjuje rizik svake pojedine akcije mobilnog GUI agenta, koristeći Safety-Augmented World Model koji predviđa sljedeće stanje sučelja i istovremeno procjenjuje sigurnosni rizik te akcije.
Koliko se poboljšava sigurnost agenta uz SeerGuard na modelu Qwen3-VL-8B-Instruct?
Safety-utility score raste s 0,191 na 0,596 uz omega 0,8, dok risk-cost score istovremeno pada s 0,347 na 0,130 uz alpha 0,8, a poboljšanje se generalizira i na druge mobilne GUI agente izvan modela na kojem je mjereno.

📬 AI vijesti u tvoj inbox

Dnevni digest po tvojoj mjeri — biraš teme, izvore i ritam. Odjava jednim klikom.