📦 Open Source

83 vijesti

🟢 📦 Open Source 10. srpnja 2026. · 2 min čitanja

PyTorch: 'besplatna normalizacija' fuzira Layer Norm u GEMM i attention kernele — Meta cilja niži trošak treniranja velikih modela

Editorial ilustracija: dva GPU kernela koja se stapaju u jedan tok bez međukoraka

PyTorch tim iz Mete objavio je tehnike za fuziranje normalizacijskih operacija izravno u GEMM i attention kernele, s ciljem uklanjanja njihova računalnog troška — 'free normalization'. Kod je dostupan na GitHubu kroz knjižnicu kernela, a izravna posljedica je brže treniranje i inference modela s čestim Layer Norm i RMS Norm operacijama.

🟡 📦 Open Source 9. srpnja 2026. · 2 min čitanja

Ollama: 88 milijuna dolara financiranja za lokalni AI — 8,9 milijuna developera i Docker osnivač među investitorima

Editorial ilustracija: lama silueta od procesorskih čipova okružena lokalnim računalima

Ollama je platforma za lokalno pokretanje otvorenih AI modela koja je objavila 88 milijuna dolara financiranja uz investitore poput Benchmarka, Theory Venturesa i Solomona Hykesa, osnivača Dockera. Platformu koristi 8,9 milijuna developera i 85% Fortune 500 kompanija, a cloud servis udvostručuje volumen tokena svaki mjesec.

🔴 📦 Open Source 8. srpnja 2026. · 5 min čitanja

PyTorch 2.13: do 4× manje GPU memorije za LLM treniranje i 12,3× brži FlexAttention

Editorial ilustracija: PyTorch 2.13 novo izdanje s ključnim poboljšanjima za AI treniranje i inferenciju

PyTorch 2.13 izlazi s 3.328 commitova od 526 suradnika. Ključne novosti: nn.LinearCrossEntropyLoss reže vršni GPU memorijski otisak do 4× za LLM treniranje, FlexAttention na Apple Siliconom postiže do 12,3× ubrzanje, a novi torchcomms backend modernizira distribuirani trening.

🟡 📦 Open Source 8. srpnja 2026. · 4 min čitanja

CNCF white paper: Pohrana podataka ostaje glavna prepreka cloud-native AI-ja u mjerilu

Editorial ilustracija: CNCF bijela knjiga o pohrani podataka za cloud-native AI i Kubernetes infrastrukturu

CNCF TAG Infrastructure objavio je white paper koji mapira uska grla pohrane podataka u cloud-native AI okruženjima, razlikujući zahtjeve faza treniranja, inferencije i agentskog AI-ja, te daje arhitekturne smjernice za Kubernetes AI/ML deploymente.

🟢 📦 Open Source 8. srpnja 2026. · 3 min čitanja

IBM i Red Hat proširuju Lightwell — 6.500+ saniranih open-source ovisnosti i clearinghouse za financije

Editorial ilustracija: IBM i Red Hat Lightwell AI sustav za remedijaciju ranjivosti u otvorenom softverskom kodu

IBM i Red Hat lansirali su Lightwell Network u općoj dostupnosti s katalogom od 6.500+ digitalno potpisanih saniranih ovisnosti u Javi i Pythonu, te Lightwell Clearinghouse Premier za koordinaciju patch embarga u financijskim uslugama, poduprt obvezom od 5 milijardi dolara za open-source sigurnost.

🟡 📦 Open Source 6. srpnja 2026. · 4 min čitanja

vLLM i Tencent Hunyuan upstreamaju dva HPC backenda za NVIDIA Hopper GPU-ove

Editorial ilustracija: vLLM FP8 i MoE GPU kerneli za visokoučinkovito posluživanje velikih jezičnih modela

Tencent Hunyuan AI Infra tim i vLLM tim zajednički su upstreamali HPC_ATTN attention backend i hpc MoE backend koji smanjuju TTFT za 24% i TPOT za 17% na konfiguraciji 8× NVIDIA H20, bez potrebe za forkanjem vLLM koda.

🟡 📦 Open Source 1. srpnja 2026. · 4 min čitanja

Kimi K2.7 Code stigao u GitHub Copilot kao prvi open-weight model

Editorial ilustracija: Kimi K2.7 otvoreni model Moonshota integriran u GitHub Copilot

Moonshot AI-jev Kimi K2.7 Code dostupan je u GitHub Copilotu kao prvi open-weight model u model pickeru, hostan na Microsoft Azureu. Dostupan je na Pro, Pro+ i Max planovima uz usage-based billing, s planiranim proširenjem na Business i Enterprise.

🟢 📦 Open Source 1. srpnja 2026. · 3 min čitanja

LangChain objavljuje OpenWiki: open-source alat koji automatski dokumentira repozitorije za AI agente

Editorial ilustracija: LangSmith pogon za open-source dokumentacijski agent OpenWiki repozitorija

LangChain je objavio OpenWiki, open-source CLI alat koji automatski generira i ažurira dokumentacijske wikije za kod-repozitorije. Cilj je dati kodnim agentima strukturiran kontekst o repozitoriju bez napuhavanja instrukcijskih datoteka poput AGENTS.md ili CLAUDE.md. Alat je građen na DeepAgents okviru i podržava više LLM providera.

🟡 📦 Open Source 30. lipnja 2026. · 3 min čitanja

Miles: PyTorch-nativni open-source okvir za RL post-training LLM-ova frontier razmjera

Editorial ilustracija: PyTorch-nativni Miles stog za post-treniranje s pojačanim učenjem i kernel fuzijom

RadixArk objavljuje Miles, open-source reinforcement learning okvir koji spaja SGLang, Megatron-LM, Ray i PyTorch u jedinstven produkcijski-testirani stack za post-training velikih jezičnih modela na Hopper i Blackwell GPU-ima.

🟢 📦 Open Source 30. lipnja 2026. · 3 min čitanja

CNCF Kepler prerađen od temelja: precizno mjerenje energije Kubernetes Podova bez privilegija kernela

Editorial ilustracija: CNCF Kepler preuređen za precizno mjerenje potrošnje energije Kubernetes infrastrukture

CNCF sandbox projekt Kepler potpuno je prepisan: nova arhitektura zamjenjuje eBPF pristup čitanjem standardnih /proc i /sys puteva, eliminira višekilovatne skokove mjerenja i svodi jaz atribucije snage procesa na razinu milivata.

🟢 📦 Open Source 30. lipnja 2026. · 3 min čitanja

ONNX v1.22.0 donosi native attention operatore za LLM-ove i WebAssembly podršku

Editorial ilustracija: ONNX verzija 1.22 donosi nove attention operatore i WebAssembly interoperabilnost

LF AI & Data Foundation objavila je ONNX v1.22.0 s native attention operatorima za transformerske arhitekture i LLM-ove, WebAssembly podrškom za pregled modela u pregledniku te SLSA Level 2 kriptografskim atestacijama. Doprinijela su 27 suradnika, od kojih 16 po prvi put.

🟡 📦 Open Source 29. lipnja 2026. · 2 min čitanja

NVIDIA: Palantir i NVIDIA Nemotron donose suvereni AI američkim agencijama u air-gapped sustavima

Editorial ilustracija: Palantir i NVIDIA Nemotron donose suvereni AI američkim agencijama u air-gapped sustavima, bez teksta i lica

Palantir je integrirao NVIDIA Nemotron open modele u svoj Sovereign AI Operating System za američke vladine agencije i kritičnu infrastrukturu. Sustav radi u air-gapped okruženjima — potpuno izoliranim mrežama bez internetske veze — pokrivajući sektore obrane, energetike, zdravstva, obrazovanja i transporta.

🟡 📦 Open Source 27. lipnja 2026. · 2 min čitanja

GitHub: Desktop 3.6 donosi Git worktrees i AI razrješavanje merge konflikata

Editorial illustration: laptop screen showing branching git tree diagram with multiple parallel workflow lanes, dark background

GitHub Desktop 3.6 je dostupan za macOS i Windows i donosi podršku za Git worktrees — mehanizam koji omogućuje paralelni rad na više grana bez stashanja — uz dublje Copilot integracije za commit poruke i merge konflikte.

🔴 📦 Open Source 26. lipnja 2026. · 2 min čitanja

PyTorch: TokenSpeed-Kernel — prijenosni high-performance kerneli za multi-silicon LLM inference

Editorial illustration: PyTorch logo s apstraktnim slojevima GPU silicija i grafom ubrzanja inferencije na plavoj pozadini

TokenSpeed-Kernel je open-source troslojni kernel podsustav koji ubrzava LLM inference na NVIDIA i AMD GPU-ima do 3,6 puta bez prepisivanja koda, a već je integriran u vLLM inferencing framework.

🟢 📦 Open Source 26. lipnja 2026. · 1 min čitanja

Allen Institute: koje tokene hibridni model (OLMo 3) predviđa bolje?

Editorial illustration: dijagram usporedbe hibridne SSM-Transformer arhitekture i čistog Transformer modela s tokenima

Allen Institute (AI2) analizira OLMo 3 i OLMo Hybrid arhitekture i otkriva da hibridni modeli bolje predviđaju značenjske, kontekstno-ovisne tokene, dok čisti Transformeri ostaju bolji za verbatim kopiranje teksta.

🟢 📦 Open Source 25. lipnja 2026. · 1 min čitanja

arXiv:2606.24855: OpenThoughts-Agent — otvoreni recepti za treniranje agentskih modela

Editorial illustration: otvoreni laboratorij s robotskim agentima koji sortiraju podatkovne kartice u pipeline

OpenThoughts-Agent je otvoreni pipeline za kuriranje podataka za agentske jezične modele. Kroz 100+ ablacijskih eksperimenata tim je izgradio 100K primjera i finetunao Qwen3-32B koji postiže 44,8% na sedam agentskih benchmarka — nadmašujući sve postojeće open-source modele.

🟢 📦 Open Source 21. lipnja 2026. · 2 min čitanja

Anthropic (Claude Code GitHub): Claude Code v2.1.185 poboljšava poruku pri zastoju streama

Urednička ilustracija: Claude Code v2.1.185 poboljšava poruku pri zastoju streama

Claude Code v2.1.185 je UX zakrpa objavljena 20. lipnja 2026. koja mijenja poruku zastoja API streama i produžuje prag aktivacije s 10 na 20 sekundi tišine — bez promjena modela ili API-ja.

🟡 📦 Open Source 20. lipnja 2026. · 2 min čitanja

arXiv:2606.20517: Multi-LCB proširuje LiveCodeBench na 12 programskih jezika i otkriva Python overfitting kod 24 modela

Urednička ilustracija: dvanaest ikona programskih jezika oko središnjeg mjerila uspješnosti

Multi-LCB je proširenje benchmarka LiveCodeBench s Pythona na 12 programskih jezika, opisano u radu arXiv:2606.20517 i prihvaćeno na konferenciji ICLR 2026. Testiranjem 24 velika jezična modela autori otkrivaju značajno preprilagođavanje (overfitting) Pythonu te jezično-specifičnu kontaminaciju podataka, čime izravno otkrivaju granice višejezičnog generiranja koda u današnjim modelima.

🟡 📦 Open Source 20. lipnja 2026. · 2 min čitanja

UK AISI: Engineering Playbook otvara infrastrukturu za evaluaciju frontier modela u pet slojeva

Urednička ilustracija: pet naslaganih slojeva infrastrukture s ikonom štita za sigurnost

Engineering Playbook je open-source dokumentacija koju je UK AI Safety Institute objavio 18. lipnja 2026. i koja otvara internu infrastrukturu za evaluaciju frontier AI modela. Playbook je strukturiran u pet slojeva (Evaluate, Isolate, Connect, Run, Scale) i gradi na ranije otvorenom alatu Inspect AI koji ima preko 200 gotovih evaluacija i 240 kontributora.

🟡 📦 Open Source 19. lipnja 2026. · 2 min čitanja

Black Forest Labs: Robin Rombach poziva G7 lidere na podršku otvorenom razvoju AI-a

Editorial ilustracija: Robin Rombach poziva G7 lidere na podršku otvorenom razvoju AI-a

Robin Rombach, suosnivač i CEO Black Forest Labs (tvorci FLUX modela), obratio se G7 liderima s pozivom da otvoreni i odgovorni razvoj AI-a postane globalna norma. Rombach argumentira da javna dostupnost AI parametara potiče inovacije i demokratizira tehnologiju.

🟡 📦 Open Source 18. lipnja 2026. · 2 min čitanja

Allen Institute: Open-source MolmoMotion predviđa 3D kretanje iz videa i postavlja SOTA u robotici

Editorial ilustracija: predviđanje 3D putanja objekata za robotsko manipuliranje

Allen Institute objavio je MolmoMotion, potpuno open-source model koji predviđa 3D trajektorije objekata iz videa i prirodnojezičnih uputa poput 'okreni zdjelu'. Model postiže state-of-the-art na PointMotionBenchu s 0,109 m prosječnog pomaka naspram 0,134 m prethodnog rekorda, a podiže uspjeh pick-and-place zadataka u robotici s 56% na 76,3%, plus 20,3 postotna boda. Treniran je na MolmoMotion-1M skupu od 1,16 milijuna videa s 3D trajektorijama i opisima radnji.

🟡 📦 Open Source 17. lipnja 2026. · 1 min čitanja

vLLM: Semantic Router Fusion spaja panel modela uz suca koji sintetizira jedan odgovor

Editorial ilustracija: panel AI modela i model-sudac sintetiziraju jedan odgovor

vLLM je predstavio Semantic Router Fusion, primitiv u kojem više modela radi paralelno kao panel, a model-sudac analizira konsenzus i razlike te sintetizira jedan odgovor. Podržava lokalne vLLM i privatne endpointe te javne providere poput Gemini, Kimi, DeepSeek i Claude. Vanjska validacija na OpenRouter DRACO pokazala je 69% za spojeni panel naspram 65,3% za najbolji pojedinačni model, uz punu OpenAI API kompatibilnost.

🟡 📦 Open Source 16. lipnja 2026. · 2 min čitanja

GitHub: Otvoreni Multilingual Repositories Dataset s 80 milijuna redaka i 40 milijuna repozitorija

Editorial ilustracija: višejezični skup podataka iz otvorenih repozitorija koda

GitHub je objavio Multilingual Repositories Dataset s više od 80 milijuna klasifikacijskih redaka kroz 40+ milijuna repozitorija, pod potpuno otvorenom CC0-1.0 licencom. Za svaki repozitorij dataset bilježi tri tekstualna izvora — README, najkomentiraniji issue i najkomentiraniji pull request — uz detekciju jezika kroz tri alata: fastText, gcld3 i lingua-py. Portugalski vodi među ne-engleskim README datotekama, a korejski je najzastupljeniji u raspravama issue-a.

🟢 📦 Open Source 16. lipnja 2026. · 2 min čitanja

CNCF: Oracleova donacija od 3 milijuna dolara u OCI kreditima ubrzava Arm64 podršku u 12+ projekata

Editorial ilustracija: Arm64 cloud infrastruktura za open-source projekte

CNCF navodi da Oracleova donacija od 3 milijuna dolara u OCI compute kreditima omogućuje Arm64 CI/CD podršku u više od 12 projekata, uključujući OpenTelemetry, containerd, Falco, Longhorn, Crossplane i Jaeger. Potražnja je brzo nadmašila početnu smjernicu od 5.000 dolara mjesečno. Pomak prati podatak da više od 50 posto novih AWS instanci i 33 posto Azure instanci sada radi na Arm64 arhitekturi.

🟡 📦 Open Source 12. lipnja 2026. · 4 min čitanja

Allen Institute for AI objavio olmo-eval: evaluacijska platforma dizajnirana za aktivni razvojni ciklus LLM modela

Editorial ilustracija: AllenAI OLMo evaluacijska platforma za razvoj i usporedbu jezičnih modela otvorenog koda

AI2 je objavio olmo-eval, otvorenu evaluacijsku platformu koja proširuje OLMES standard iz jednokratnog benčmarkinga prema cjelovitoj razvojnoj petlji. Ključna inovacija je parna usporedba na razini pojedinih pitanja kroz checkpointe, uz ugrađene statističke mjere za razlikovanje stvarnih poboljšanja od šuma u podacima.

🟡 📦 Open Source 12. lipnja 2026. · 3 min čitanja

MiniMax M3 u vLLM: Day-0 podrška za model s milijun tokena konteksta

Editorial ilustracija: vLLM servis za MiniMax M3 multimodalni MoE model s milijun tokena konteksta

vLLM tim objavio je punu Day-0 podršku za MiniMax M3 — model s milijun tokena konteksta, nativnom multimodalnošću i Mixture-of-Experts arhitekturom. Ključna inovacija je MiniMax Sparse Attention koji omogućuje praktično posluživanje dugih konteksta bez punog materijaliziranja KV cachea.

🟡 📦 Open Source 11. lipnja 2026. · 4 min čitanja

Ollama donosi do 20% brži Apple Silicon inference: MLX engine, NVFP4 kvantizacija i snimke za agentske tokove rada

Editorial ilustracija: Ollama MLX kvantizacija NVFP4 za ubrzano lokalno zaključivanje na Apple Silicon čipu

Ollama je ažurirala MLX engine za Apple Silicon donoseći do 20 posto brže generiranje tokena putem fuzija Metal kernela i GPU uzorkovanja. Novi NVFP4 format kvantizacije prepolovi gubitak kvalitete u odnosu na nekvantizirani BF16, a sustav snimki olakšava agentske tokove rada s mogućnošću grananja i ponovnog pokušaja.

🟢 📦 Open Source 10. lipnja 2026. · 3 min čitanja

Helion u vLLM-u: PyTorch-nativni DSL zamjenjuje CUDA kernele i ubrzava FP8 inferenzu Qwen3 modela

Editorial ilustracija: PyTorch Helion DSL prenosivi GPU kerneli za zaključivanje i automatsko ugađanje LLM-ova

Helion je PyTorch-nativni DSL za pisanje GPU kernela bez direktnog CUDA koda. Devet Helionovih kernela integrirano je u vLLM za FP8 inferenzu Qwen3 modela: ne-GEMM kerneli bilježe ubrzanja do 73% na H100, a sveukupna propusnost raste za oko 5–9% u usporedbi s prethodnim rješenjima.

🟢 📦 Open Source 9. lipnja 2026. · 4 min čitanja

LF AI & Data: DocLang radna skupina razvija otvoreni standard za AI-nativne dokumente

Editorial ilustracija: LF AI i Data uvodi otvoreni standard za AI-native dokumente

LF AI & Data Foundation pokrenula je DocLang Specification Working Group s osnivačkim članovima IBM-om, Red Hatom i NVIDIA-om radi razvoja otvorenog standarda za AI-nativne dokumente. Format čuva semantičko značenje i geometrijski raspored, ugrađuje governance kontrole i optimiziran je za moderne AI tokenizatore i agentne workflow-ove.

🟢 📦 Open Source 9. lipnja 2026. · 4 min čitanja

vLLM: vime — novi RL okvir koji spaja Megatron trening i vLLM inferenciju u jedinstven pipeline

Editorial ilustracija: vLLM novi okvir za reinforcement learning s GB200 GPU infrastrukturom

vime je novi RL okvir za post-trening jezičnih modela koji spaja Megatron distribuirani trening i vLLM inferenciju u jedinstven pipeline. Na GB200 hardveru Qwen3-30B-A3B MoE model postiže oko 147 sekundi po koraku — 1,72× brže nego na H200. R3 routing replay smanjuje raskorak log-vjerojatnosti s 0,019 na 0,013.

🟡 📦 Open Source 6. lipnja 2026. · 2 min čitanja

arXiv:2606.08094: vla.cpp pokreće Vision-Language-Action modele na 1,3 GiB memorije

Urednička ilustracija: vla.cpp pokreće Vision-Language-Action modele na 1,3 GiB memorije

Novi rad predstavlja vla.cpp, C++ inference engine za pokretanje Vision-Language-Action politika na resursno ograničenom robotskom hardveru. Engine dostiže SOTA razinu na benchmarku LIBERO-Object i izvršava BitVLA uz samo 1,3 GiB memorije.

🟡 📦 Open Source 5. lipnja 2026. · 3 min čitanja

Ollama 0.30: integracija s llama.cpp, GGUF podrška i do 20% brži inference

Urednička ilustracija: integracija s llama.cpp, GGUF podrška i do 20% brži inference

Ollama 0.30 donosi integraciju s llama.cpp za bolje performanse i GGUF kompatibilnost modela, uz do 20% bržu propusnost na NVIDIA GPU-ovima. Proširuje hardversku podršku Vulkanom na AMD i Intel uređajima te dodaje podršku za tool-calling. Nadopunjuje postojeći MLX engine za Apple silicij.

🟡 📦 Open Source 5. lipnja 2026. · 3 min čitanja

vLLM Semantic Router v0.3 'Themis': produkcijski stateful routing upita

Urednička ilustracija: produkcijski stateful routing upita

vLLM tim izdao je v0.3 'Themis' svog Semantic Routera, prvu produkcijski spremnu verziju za usmjeravanje upita između modela. Donosi kanoničku konfiguraciju, inspektabilan tok odluke i reproducibilno ponašanje routinga za Kubernetes deploymente.

🟢 📦 Open Source 3. lipnja 2026. · 2 min čitanja

Google otvorio hidrološki framework iza Flood Hub servisa za predviđanje poplava

Urednička ilustracija: Google otvorio hidrološki framework iza Flood Hub servisa za predviđanje poplava

Google Research je 3. lipnja 2026. na GitHubu pod licencom Apache 2.0 objavio Python/PyTorch framework koji pokreće globalni servis Flood Hub za predviđanje poplava. Framework koristi LSTM i noviju ME-LSTM arhitekturu nad open-source datasetom Caravan, a nadograđeni v2 model produžuje pouzdani horizont predviđanja za 6 dana u mjerenim slivovima.

🟡 📦 Open Source 2. lipnja 2026. · 2 min čitanja

vLLM: Session-Aware Agentic Routing smanjuje prebacivanja modela za 79 posto

Urednička ilustracija: Session-Aware Agentic Routing smanjuje prebacivanja modela za 79 posto

vLLM Semantic Router dobio je Session-Aware Agentic Routing (SAAR), mehanizam koji razumije dugotrajne agentske razgovore umjesto da svaku poruku tretira zasebno. Na 21.600 testnih turnusa SAAR smanjuje prebacivanja modela za 79,29 posto, u potpunosti eliminira nesigurna prebacivanja i smanjuje procijenjene troškove za 78,71 posto.

🟢 📦 Open Source 2. lipnja 2026. · 2 min čitanja

vLLM: AutoRound kvantizacija stiže u vLLM-Omni za manje multimodalne modele

Urednička ilustracija: AutoRound kvantizacija stiže u vLLM-Omni za manje multimodalne modele

vLLM je integrirao Intelovu AutoRound kvantizaciju u vLLM-Omni, omogućivši W4A16 kompresiju multimodalnih i difuzijskih modela. Rezultat je do 62 posto manji checkpoint, uz minimalan pad kvalitete i brže generiranje na Intel XPU i NVIDIA grafičkim karticama.

🟡 📦 Open Source 1. lipnja 2026. · 2 min čitanja

vLLM: pokretanje na NVIDIA DGX Spark / GB10 sustavima

Urednička ilustracija: pokretanje na NVIDIA DGX Spark / GB10 sustavima

vLLM tim objavio je praktičan vodič za pokretanje vLLM-a na NVIDIA DGX Spark sustavu temeljenom na GB10 čipu. Vodič pokriva ponašanje unificirane memorije, posluživanje NVFP4 modela Nemotron-3-Super, Docker deployment, Prometheus metrike i rezultate lokalne evaluacije na novom edge-hardveru.

🟢 📦 Open Source 30. svibnja 2026. · 2 min čitanja

xAI: xai-sdk-python v1.15.0 dodaje model grok-build-0.1 i sažimanje konteksta

Urednička ilustracija: xai-sdk-python v1.15.0 dodaje model grok-build-0.1 i sažimanje konteksta

xAI je objavio xai-sdk-python v1.15.0, izdanje s tri promjene: dodavanje modela grok-build-0.1 u klasu ChatModel, podršku za context compaction odnosno sažimanje konteksta, te podizanje verzije s 1.14.0 na 1.15.0. Sve promjene došle su kroz tri zasebna pull requesta.

🟡 📦 Open Source 29. svibnja 2026. · 2 min čitanja

arXiv:2605.31463: PithTrain, kompaktni sustav za treniranje MoE modela prilagođen agentima

Urednička ilustracija: PithTrain, kompaktni sustav za treniranje MoE modela prilagođen agentima

PithTrain je novi sustav za treniranje Mixture-of-Experts modela optimiziran za AI agente za kodiranje. Rad uvodi metriku agent-task efficiency i pripadni ATE-Bench, a na njemu PithTrain postiže do 62 posto manje agentskih koraka i 64 posto manje aktivnog GPU vremena uz usporedivu propusnost.

🟡 📦 Open Source 28. svibnja 2026. · 2 min čitanja

vLLM: Standardizirani API-ji za sinkronizaciju težina ubrzavaju asinkroni RL

Urednička ilustracija: Standardizirani API-ji za sinkronizaciju težina ubrzavaju asinkroni RL

vLLM je 28. svibnja 2026. uveo standardizirane API-je za sinkronizaciju težina (weight synchronization) i poboljšanu podršku za asinkroni reinforcement learning. Rješava fragmentaciju u kojoj svaki RL framework ad-hoc implementira prijenos težina između treninga i inferencije, te popravlja probleme stabilnosti u velikim distribuiranim deploymentima.

🟢 📦 Open Source 28. svibnja 2026. · 1 min čitanja

Microsoft: Data Formulator 0.7 spaja rascjepkane podatke poduzeća

Urednička ilustracija: Data Formulator 0.7 spaja rascjepkane podatke poduzeća

Data Formulator 0.7 je open-source sustav Microsoft Researcha koji povezuje rascjepkane izvore podataka u poduzećima i podržava iterativne analitičke tijekove. Donosi perzistentne data konektore i kontekstualno svjesne AI agente, omogućujući analitiku bez znanja SQL-a ili programiranja.

🟢 📦 Open Source 28. svibnja 2026. · 1 min čitanja

Mistral: Search Toolkit za produkcijske pretraživačke pipeline

Urednička ilustracija: Search Toolkit za produkcijske pretraživačke pipeline

Mistral Search Toolkit je open-source framework za izgradnju produkcijskih pretraživačkih pipelinea za AI aplikacije. Objedinjuje unos, dohvat i evaluaciju pod jednim sučeljem i može se postaviti u oblaku, on-premises ili na rubu mreže.

🟢 📦 Open Source 28. svibnja 2026. · 2 min čitanja

Ollama: OpenJarvis v1.0 za osobne AI agente koji rade lokalno

Urednička ilustracija: OpenJarvis v1.0 za osobne AI agente koji rade lokalno

OpenJarvis v1.0 je open-source framework za izgradnju osobnih AI agenata koji rade lokalno na vlastitom hardveru, s ugrađenom Ollama integracijom. Local-first je pristup u kojem modeli ostaju lokalni, a oblak je opcionalan, uz praćenje potrošnje energije, troška i latencije.

🟡 📦 Open Source 27. svibnja 2026. · 3 min čitanja

PyTorch: Kako torch.compile postiže ubrzanje do 10× kroz kernel fusion

Urednička ilustracija: Kako torch.compile postiže ubrzanje do 10× kroz kernel fusion

PyTorch kompajler torch.compile postiže ubrzanje do 10× na GPU-ima eliminacijom redundantnog pisanja u globalnu memoriju kroz tehniku kernel fusion. Umjesto zasebnih GPU kernela za svaku operaciju, Inductor kompajler automatski spaja zavisne operacije u jedan kernel koji međuvrijednosti drži u brzim registrima procesora.

🟢 📦 Open Source 27. svibnja 2026. · 2 min čitanja

xAI: SDK Python v1.14.0 dodaje enable_image_search u web_search i SERVER_SIDE_TOOL_IMAGE_SEARCH enum

Urednička ilustracija: SDK Python v1.14.0 dodaje enable_image_search u web_search i SERVER_SIDE_TOOL_IMAGE_SEARCH enum

xAI je objavio Python SDK v1.14.0 koji donosi podršku za pretraživanje slika unutar web_search funkcionalnosti. Novo polje enable_image_search i SERVER_SIDE_TOOL_IMAGE_SEARCH enum konstanta omogućuju razvojnim timovima koji grade Grok-temeljene aplikacije uključivanje pretrage vizualnog sadržaja na serverskoj strani, uz standardnu web pretragu teksta.

🟢 📦 Open Source 23. svibnja 2026. · 4 min čitanja

Kedro: verzija 1.2.0 donosi @experimental dekorator i LangGraph agentic starter za GenAI pipeline-e

Editorial ilustracija: pipeline čvorovi s LangGraph orkestracijskim mostom i Mermaid dijagramom

Linux Foundation AI projekt Kedro objavio je verziju 1.2.0 zajedno s Kedro-Viz 12.3.0. Novi @experimental dekorator omogućuje označavanje API-ja u razvoju, a starter projekt support-agent-langgraph demonstrira integraciju s LangGraph orkestracijom i Langfuse/Opik prompt management alatima. Kedro-Viz dobiva Mermaid dijagrame i node preview extensibility za bolji pipeline debugging.

🟡 📦 Open Source 21. svibnja 2026. · 2 min čitanja

Stability AI: Stable Audio 3.0 s open-weight modelima i generacijom do 6 minuta

Editorial illustration: Stability AI Stable Audio 3 open-weight obitelj modela s 6-minutnom generacijom i inpainting podrškom

Stability AI je 20. svibnja 2026. objavio Stable Audio 3.0 — obitelj od 4 audio modela (Small SFX, Small, Medium, Large) od kojih su tri open-weight i dostupna na Hugging Face-u. Glavna novost je generacija audija do 6 minuta (prethodna verzija je davala 47 sekundi), kao i podrška za audio inpainting, kauzalnu kontinuaciju i LoRA fine-tuning, uz tvrdnju da su svi modeli trenirani isključivo na licenciranim podacima.

🟢 📦 Open Source 20. svibnja 2026. · 2 min čitanja

LangChain: Agent koji popravlja agente — kako je izgrađen LangSmith Engine

Editorial illustration:

LangChain je objavio tehnički pregled LangSmith Enginea — autonomnog meta-agenta koji analizira greške u produkcijskim AI agentima i predlaže konkretne popravke. Engine automatizira detekciju grešaka, generiranje evaluatora i regresijskih testova end-to-end.

🟡 📦 Open Source 19. svibnja 2026. · 2 min čitanja

PyTorch: ExecuTorch MLX Delegate donosi 3–6× brže izvođenje modela na Apple Silicon GPU-ima

Editorial illustration: PyTorch tim objavio je eksperimentalni ExecuTorch MLX Delegate — backend koji iskorištava Apple MLX

PyTorch tim objavio je eksperimentalni ExecuTorch MLX Delegate — backend koji iskorištava Apple MLX framework i Metal GPU kernele za 3 do 6 puta veći throughput na Apple Silicon čipovima. Podržava Llama 3.2, Qwen 3, Phi-4 mini, Whisper i Voxtral real-time streaming transkribiranje.

🟢 📦 Open Source 19. svibnja 2026. · 2 min čitanja

GitHub: Copilot Spaces API sada općenito dostupan

Editorial illustration: GitHub je objavio opću dostupnost REST API-ja za Copilot Spaces, čime timovi mogu programatski kreir

GitHub je objavio opću dostupnost REST API-ja za Copilot Spaces, čime timovi mogu programatski kreirati, konfigurirati i brisati kontekstualne AI radne prostore. Novo sučelje posebno je korisno organizacijama koje upravljaju većim brojem Spaces-a bez oslanjanja na ručne tijekove rada.

Pogledaj cijelu arhivu →