🟡 🛡️ Sigurnost Objavljeno: · 1 min čitanja ·

OpenAI: naučene lekcije i nove zaštitne mjere za sigurnost dugotrajno-djelujućih (long-horizon) AI modela

Apstraktni prikaz AI agenta koji izvršava niz zadataka kroz vremensku os

OpenAI je objavio pregled naučenih lekcija iz primjene dugotrajno-djelujućih (long-horizon) AI modela, ističući nove sigurnosne rizike, uočene propuste i unaprijeđene zaštitne mjere koje nastaju kad agent samostalno djeluje kroz duže vremenske horizonte zadataka, bez konkretnih javno objavljenih brojki u dostupnom sažetku objave.

🤖

Ovaj članak generiran je uz pomoć umjetne inteligencije na temelju primarnih izvora.

Što je long-horizon AI model?

Long-horizon model je AI sustav dizajniran da samostalno izvršava zadatke kroz dulje vremensko razdoblje, za razliku od klasičnih modela koji odgovaraju na pojedinačni upit i time završavaju interakciju. OpenAI je objavio pregled naučenih lekcija iz stvarne primjene takvih modela.

Novi sigurnosni rizici i uočeni propusti

OpenAI ističe da produljena autonomija agenta otvara sigurnosne rizike koji se ne pojavljuju kod kratkotrajnih zadataka — što je zadatak dulji, veći je prostor za odstupanje od željenog ponašanja. Tvrtka spominje konkretne, opažene propuste (failures) tijekom stvarnog rada takvih modela, bez navođenja detaljnih brojki u dostupnom sažetku.

Iako izvor ne navodi brojke o učestalosti propusta, logika je jasna: model koji djeluje dulje ima više prilika za kumulativnu pogrešku nego model koji izvrši jedan odgovor i stane.

Zaštitne mjere jačaju s dužinom zadatka

Kao odgovor, OpenAI navodi unaprijeđene zaštitne mjere (safeguards) — mehanizme nadzora i ograničenja koji sprječavaju štetno ponašanje modela tijekom dužeg samostalnog djelovanja. Usporedba s kratkotrajnim zadacima pokazuje obrazac: rizik raste s duljinom horizonta autonomije, pa i zaštitne mjere moraju rasti razmjerno.

Napomena: puni tekst OpenAI-jeve objave trenutačno nije dostupan, pa ovaj članak donosi samo ono što je potvrđeno u službenom sažetku.

Česta pitanja

Što je long-horizon AI model?
Long-horizon model je AI sustav koji samostalno izvršava zadatke kroz dulje vremensko razdoblje, umjesto da odgovori na jedan upit odjednom.
Koji rizici rastu s dužim horizontom autonomije?
OpenAI navodi da dulji horizont autonomnog djelovanja modela nosi nove sigurnosne rizike i propuste u odnosu na kratkotrajne zadatke, zbog čega su unaprijedili zaštitne mjere (safeguards).

📬 AI vijesti u tvoj inbox

Dnevni digest po tvojoj mjeri — biraš teme, izvore i ritam. Odjava jednim klikom.