🟡 🤝 Agenti Objavljeno: · 2 min čitanja ·

arXiv:2607.15901: DSWorld world model ubrzava agente za data science čak 14 puta u treningu i inferenciji

arXiv:2607.15901 ↗

Dijagram DSWorld world modela koji predviđa ishode operacija agenata za data science uz ubrzanje treninga

DSWorld je world model koji Zherui Yang, Fan Liu i Hao Liu uvode kako bi predvidio ishode operacija agenata za data science i smanjio računalnu neefikasnost. Kombinira strukturirano stanje, inteligentno rutiranje i LLM-based simulator, uz Reflective World Model Optimization i skup od 8.000 trajektorija. Rezultat je ~14× brže treniranje RL agenata i ~3-6× brža search-based inferencija.

🤖

Ovaj članak generiran je uz pomoć umjetne inteligencije na temelju primarnih izvora.

Što je DSWorld i zašto agentima za data science treba world model?

World model je komponenta koja unutarnje simulira ishode akcija prije nego što se one stvarno izvrše, umjesto da agent svaki put čeka stvarni rezultat operacije. Zherui Yang, Fan Liu i Hao Liu uvode DSWorld, world model specifično dizajniran za agente za data science — sustave koji automatski pišu i izvršavaju kod za analizu podataka, treniranje modela i evaluaciju rezultata. Problem koji rješavaju je računalna neefikasnost: svaka isprobana operacija inače zahtijeva stvarno izvršavanje, često na resursno-intenzivnim zadacima poput treniranja modela ili obrade velikih skupova podataka.

DSWorld kombinira strukturirano stanje, rutiranje i simulaciju

Arhitektura kombinira tri elementa: strukturirano stanje koje sažeto opisuje trenutni kontekst zadatka, inteligentno rutiranje koje odlučuje kada je isplativo pozvati stvarnu simulaciju naspram brze procjene, te LLM-based simulator koji predviđa ishod resursno-intenzivnih operacija bez njihovog stvarnog izvršavanja. Sustav je dodatno uparen s tehnikom “Reflective World Model Optimization” — error-aware pristupom podržanog učenja (reinforcement learning, RL) koji uči iz vlastitih pogrešaka u predviđanju — te datasetom od 8.000 zabilježenih trajektorija koje služe kao trening podloga.

DSWorld: 14× brže treniranje i 3-6× brža inferencija

Rezultati pokazuju znatna ubrzanja: DSWorld postiže oko 14× brže treniranje RL agenata u odnosu na pristupe bez world modela, te 3 do 6 puta bržu search-based inferenciju, gdje agent istražuje više mogućih akcija prije odabira najbolje. Uz to, sustav nadmašuje najjači testirani LLM baseline za 35,6% na zadacima predviđanja tranzicije — odnosno predviđanja kako će se stanje zadatka promijeniti nakon određene operacije — dok zadržava konkurentnu izvedbu na ukupnim zadacima data science.

Ubrzanja mijenjaju ekonomiku agentskog rada

Kombinacija 14× bržeg treninga i 3-6× brže inferencije znači da agenti za data science mogu isprobati znatno više strategija u istom vremenskom i računalnom budžetu. Za zadatke koji inače zahtijevaju skupo, ponovljeno izvršavanje koda — poput pretraživanja hiperparametara ili odabira modela — to izravno prevodi u niže troškove i brže iteracije pri razvoju automatiziranih data science pipeline-ova.

Česta pitanja

Što je world model u kontekstu agenata za data science?
World model je komponenta koja predviđa ishod operacije prije njezinog stvarnog izvršavanja, čime agent štedi vrijeme i računalne resurse na resursno-intenzivnim zadacima.
Koliko je DSWorld brži od postojećih pristupa?
DSWorld postiže oko 14× brže treniranje RL agenata i 3 do 6 puta bržu search-based inferenciju, uz 35,6% bolju izvedbu na predviđanju tranzicije stanja od najjačeg LLM baselinea.
Što je Reflective World Model Optimization?
To je error-aware tehnika podržanog učenja (RL) koja uči iz vlastitih pogrešaka predviđanja world modela, koristeći dataset od 8.000 zabilježenih trajektorija.

📬 AI vijesti u tvoj inbox

Dnevni digest po tvojoj mjeri — biraš teme, izvore i ritam. Odjava jednim klikom.