🟡 🤖 Modeli Objavljeno: · 2 min čitanja ·

arXiv:2607.18100: SOPHIA activation steering izvlači jezične modele iz reasoning samoponavljajućih petlji

arXiv:2607.18100 ↗

Dijagram prikazuje kako SOPHIA steering vektorima preusmjerava jezični model iz samoponavljajuće reasoning petlje

Sheldon Yu i suradnici predstavljaju SOPHIA, metodu activation steeringa koja modele s produljenim razmišljanjem izvlači iz self-loops, samoponavljajućih petlji koje troše token budžet bez napretka. SOPHIA klasificira reasoning prefikse u latentna stanja, detektira petlje tijekom inferencije i steering vektorima preusmjerava proces, poboljšavajući i točnost zadatka i token efikasnost.

🤖

Ovaj članak generiran je uz pomoć umjetne inteligencije na temelju primarnih izvora.

Što su self-loops kod reasoning modela?

Sheldon Yu i suradnici u radu “Can We Break LLMs Out of Self-Loops? Fine-Grained Reasoning Control with Activation Steering” (arXiv:2607.18100) identificiraju da neuspjele reasoning putanje kod jezičnih modela s produljenim razmišljanjem — takozvanim extended thinking načinom rada — upadaju u self-loops, odnosno samoponavljajuće petlje u kojima model ponavlja slične korake zaključivanja bez stvarnog napretka prema rješenju. Takve petlje troše token budžet, ograničenu količinu tokena dodijeljenu za proces razmišljanja, a da pritom ne povećavaju šansu za točan odgovor.

SOPHIA prati skrivena stanja i preusmjerava proces

Autori predlažu SOPHIA (Steering Of reasoning Processes via Hidden-state Intervention and Activations), metodu koja reasoning prefikse, početne dijelove lanca razmišljanja, klasificira u latentna stanja, odnosno skrivene unutarnje reprezentacije modela. Tijekom same inferencije SOPHIA detektira kada model ulazi u self-loop, a zatim primjenjuje steering vektor, matematičku korekciju unutarnje aktivacije modela, kako bi proces zaključivanja preusmjerila prema novom, produktivnom smjeru.

Točnost i ušteda tokena s SOPHIA-om naspram bez nje

Prema autorima, model s primijenjenim SOPHIA steeringom istovremeno poboljšava točnost zadatka i token efikasnost u usporedbi s modelom bez intervencije. Umjesto da nastavi trošiti token budžet na petlju iz koje se sam ne bi izvukao, model uz SOPHIA napušta neproduktivnu putanju i alocira preostale tokene na novi pokušaj rješavanja zadatka.

Zašto je fino-zrnata kontrola reasoning procesa važna

Pristup pokazuje da se problemi reasoning modela ne moraju rješavati samo promjenom promptova ili ponovnim treniranjem, već i izravnom intervencijom na razini aktivacija tijekom inferencije. Za developere alata koji koriste modele s produljenim razmišljanjem to znači mogućnost jeftinije kontrole ponašanja bez dodatnog treniranja.

Česta pitanja

Što su self-loops kod reasoning modela?
Self-loops su samoponavljajuće petlje u koje upadaju neuspjele reasoning putanje kod modela s produljenim razmišljanjem — model ponavlja slične korake zaključivanja bez stvarnog napretka prema rješenju, a pritom troši ograničeni token budžet dodijeljen procesu razmišljanja.
Kako SOPHIA detektira i prekida samoponavljajuće petlje?
SOPHIA (Steering Of reasoning Processes via Hidden-state Intervention and Activations) klasificira reasoning prefikse u latentna stanja, tijekom inferencije prepoznaje kad model uđe u self-loop, a zatim primjenjuje steering vektor koji korigira unutarnju aktivaciju modela i preusmjerava proces zaključivanja.
Koliko SOPHIA poboljšava točnost i uštedu tokena?
Prema autorima, model s primijenjenim SOPHIA steeringom istovremeno poboljšava točnost zadatka i token efikasnost u usporedbi s modelom bez intervencije, jer napušta neproduktivnu petlju i preostale tokene alocira na novi pokušaj rješavanja zadatka.

📬 AI vijesti u tvoj inbox

Dnevni digest po tvojoj mjeri — biraš teme, izvore i ritam. Odjava jednim klikom.