🟢 📦 Open Source Veröffentlicht: · 2 Min. Lesezeit ·

PyTorch Foundation: sechs Open-Source-Projekte beschleunigen die KI-Entwicklung, FlexAttention jetzt 12-mal schneller

PyTorch-Logo neben einer Visualisierung eines neuronalen Netzwerkgraphen und von GPU-Chips

Die PyTorch Foundation, eine seit April 2025 bestehende Multi-Projekt-Stiftung, vereint sechs Open-Source-Projekte. PyTorch 2.13 bringt FlexAttention 12-mal schneller auf Apple Silicon und bis zu 4-mal geringeren GPU-Speicherbedarf, bei 4.415 Commits im zweiten Quartal. Auch vLLM, DeepSpeed, Ray Data und Helion verzeichnen Fortschritte.

🤖

Dieser Artikel wurde mithilfe von künstlicher Intelligenz aus Primärquellen erstellt.

Die PyTorch Foundation vereint sechs Open-Source-Projekte

Die PyTorch Foundation, eine im April 2025 gegründete Multi-Projekt-Stiftung, vereint heute sechs Open-Source-Projekte: PyTorch, vLLM, DeepSpeed, Ray, Helion und weitere Komponenten des Machine-Learning-Ökosystems. Eine gemeinsame Steuerung ermöglicht die koordinierte Entwicklung von Tools für Training, Serving und Modelloptimierung.

Wie viel schneller ist FlexAttention in PyTorch 2.13?

Die neue Version PyTorch 2.13 bringt FlexAttention, einen Attention-Mechanismus, der auf Apple Silicon nun rund 12-mal schneller ist als in früheren Versionen. Die neue Funktion nn.LinearCrossEntropyLoss reduziert den benötigten GPU-Speicher um bis zu das 4-Fache, und im zweiten Quartal wurden 4.415 Commits verzeichnet — deutlich mehr als in vergleichbaren früheren Zeiträumen des Projekts.

Fortschritte bei vLLM, DeepSpeed, Ray Data und Helion

vLLM hat einen stabilen zweiwöchentlichen Release-Zyklus etabliert und seine erste eigene Konferenz vom 24. bis 26. August auf dem Ray Summit angekündigt. DeepSpeed veröffentlichte im ersten Quartal sechs Releases, und sein SuperOffload erhielt eine ehrenvolle Erwähnung für das beste Paper auf der Konferenz ASPLOS 2026. Ray und vLLM erzielen auf AMD-MI325X-GPUs bei der Prefill-Decode-Disaggregation eine Einsparung von 67 Prozent, während das kommende Ray Data 2.57 eine komplett neue High-Performance-Engine ankündigt. Helion erreicht ein 10-mal schnelleres Autotuning und Spitzenergebnisse (State-of-the-Art) auf den Architekturen NVIDIA Blackwell und Google TPU.

Häufig gestellte Fragen

Was ist die PyTorch Foundation?
Die PyTorch Foundation ist eine im April 2025 gegründete Multi-Projekt-Stiftung, die sechs Open-Source-Projekte aus dem Machine-Learning-Ökosystem vereint, darunter PyTorch, vLLM, DeepSpeed, Ray und Helion.
Was ist FlexAttention, und wie viel schneller ist es?
FlexAttention ist ein Attention-Mechanismus in PyTorch, der in Version 2.13 auf Apple Silicon rund 12-mal schneller läuft, während die neue Funktion nn.LinearCrossEntropyLoss den benötigten GPU-Speicher um bis zu das 4-Fache reduziert.

📬 KI-News in dein Postfach

Ein täglicher Digest nach deinen Regeln — Themen, Quellen und Rhythmus wählbar. Abmeldung mit einem Klick.