PyTorch Foundation: šest projekata otvorenog koda ubrzava razvoj AI-ja, FlexAttention sada 12 puta brži
PyTorch Foundation, multi-projektna fondacija od travnja 2025., okuplja šest projekata otvorenog koda. PyTorch 2.13 donosi FlexAttention 12 puta brži na Apple Siliconu i do 4 puta manju GPU memoriju, uz 4.415 commitova u Q2. vLLM, DeepSpeed, Ray Data i Helion također bilježe napredak.
Ovaj članak generiran je uz pomoć umjetne inteligencije na temelju primarnih izvora.
PyTorch Foundation okuplja šest projekata otvorenog koda
PyTorch Foundation, multi-projektna fondacija osnovana u travnju 2025., danas okuplja šest projekata otvorenog koda: PyTorch, vLLM, DeepSpeed, Ray, Helion i druge komponente ekosustava za strojno učenje. Zajednička uprava omogućuje koordinirani razvoj alata koji pokrivaju treniranje, posluživanje i optimizaciju modela.
Koliko je brži FlexAttention u PyTorchu 2.13?
Nova verzija PyTorch 2.13 donosi FlexAttention, mehanizam pažnje koji je sada oko 12 puta brži na Apple Siliconu nego u prethodnim verzijama. Nova funkcija nn.LinearCrossEntropyLoss smanjuje potrebnu GPU memoriju do 4 puta, a u drugom kvartalu zabilježeno je 4.415 commitova, znatno više od usporedivih razdoblja ranije u projektu.
Napredak kod vLLM, DeepSpeed, Ray Data i Heliona
vLLM je uspostavio stabilan dvotjedni ciklus izdanja i najavio prvu vlastitu konferenciju od 24. do 26. kolovoza na Ray Summitu. DeepSpeed je objavio šest izdanja u prvom kvartalu, a njegov SuperOffload dobio je počasno priznanje za najbolji rad na konferenciji ASPLOS 2026. Ray i vLLM na AMD MI325X GPU-ovima postižu uštedu od 67 posto pri prefill-decode disagregaciji, dok nadolazeći Ray Data 2.57 najavljuje potpuno novi high-performance engine. Helion postiže 10 puta brže autotuning i vrhunske rezultate (state-of-the-art) na NVIDIA Blackwell i Google TPU arhitekturama.
Česta pitanja
- Što je PyTorch Foundation?
- PyTorch Foundation je multi-projektna fondacija osnovana u travnju 2025., koja okuplja šest projekata otvorenog koda iz ekosustava strojnog učenja, uključujući PyTorch, vLLM, DeepSpeed, Ray i Helion.
- Što je FlexAttention i koliko je brži?
- FlexAttention je mehanizam pažnje u PyTorchu koji u verziji 2.13 radi oko 12 puta brže na Apple Siliconu, dok nova funkcija nn.LinearCrossEntropyLoss smanjuje potrebnu GPU memoriju do 4 puta.
Izvori
📬 AI vijesti u tvoj inbox
Dnevni digest po tvojoj mjeri — biraš teme, izvore i ritam. Odjava jednim klikom.
Povezane vijesti
CNCF: Confidential Containers napreduje u Incubating status uz 150+ kontributora i fokus na confidential AI
NVIDIA: open-source okvir za medicinsku fiziku skraćuje trening robotskih politika s 5 sati na 2 minute
Meta: SAM 3 i DINOv3 otvoreni za Genesis Mission, segmentacijska analiza skraćena s mjesec dana na 15 minuta