🟢 📦 Open Source Objavljeno: · 1 min čitanja ·

PyTorch Foundation: šest projekata otvorenog koda ubrzava razvoj AI-ja, FlexAttention sada 12 puta brži

PyTorch logotip uz vizualizaciju grafa neuronske mreže i GPU čipova

PyTorch Foundation, multi-projektna fondacija od travnja 2025., okuplja šest projekata otvorenog koda. PyTorch 2.13 donosi FlexAttention 12 puta brži na Apple Siliconu i do 4 puta manju GPU memoriju, uz 4.415 commitova u Q2. vLLM, DeepSpeed, Ray Data i Helion također bilježe napredak.

🤖

Ovaj članak generiran je uz pomoć umjetne inteligencije na temelju primarnih izvora.

PyTorch Foundation okuplja šest projekata otvorenog koda

PyTorch Foundation, multi-projektna fondacija osnovana u travnju 2025., danas okuplja šest projekata otvorenog koda: PyTorch, vLLM, DeepSpeed, Ray, Helion i druge komponente ekosustava za strojno učenje. Zajednička uprava omogućuje koordinirani razvoj alata koji pokrivaju treniranje, posluživanje i optimizaciju modela.

Koliko je brži FlexAttention u PyTorchu 2.13?

Nova verzija PyTorch 2.13 donosi FlexAttention, mehanizam pažnje koji je sada oko 12 puta brži na Apple Siliconu nego u prethodnim verzijama. Nova funkcija nn.LinearCrossEntropyLoss smanjuje potrebnu GPU memoriju do 4 puta, a u drugom kvartalu zabilježeno je 4.415 commitova, znatno više od usporedivih razdoblja ranije u projektu.

Napredak kod vLLM, DeepSpeed, Ray Data i Heliona

vLLM je uspostavio stabilan dvotjedni ciklus izdanja i najavio prvu vlastitu konferenciju od 24. do 26. kolovoza na Ray Summitu. DeepSpeed je objavio šest izdanja u prvom kvartalu, a njegov SuperOffload dobio je počasno priznanje za najbolji rad na konferenciji ASPLOS 2026. Ray i vLLM na AMD MI325X GPU-ovima postižu uštedu od 67 posto pri prefill-decode disagregaciji, dok nadolazeći Ray Data 2.57 najavljuje potpuno novi high-performance engine. Helion postiže 10 puta brže autotuning i vrhunske rezultate (state-of-the-art) na NVIDIA Blackwell i Google TPU arhitekturama.

Česta pitanja

Što je PyTorch Foundation?
PyTorch Foundation je multi-projektna fondacija osnovana u travnju 2025., koja okuplja šest projekata otvorenog koda iz ekosustava strojnog učenja, uključujući PyTorch, vLLM, DeepSpeed, Ray i Helion.
Što je FlexAttention i koliko je brži?
FlexAttention je mehanizam pažnje u PyTorchu koji u verziji 2.13 radi oko 12 puta brže na Apple Siliconu, dok nova funkcija nn.LinearCrossEntropyLoss smanjuje potrebnu GPU memoriju do 4 puta.

📬 AI vijesti u tvoj inbox

Dnevni digest po tvojoj mjeri — biraš teme, izvore i ritam. Odjava jednim klikom.