PyTorch Foundation: 6개 오픈소스 프로젝트가 AI 개발 가속, FlexAttention 12배 빨라져
2025년 4월부터 다중 프로젝트 재단으로 운영되는 PyTorch Foundation이 6개의 오픈소스 프로젝트를 아우르고 있습니다. PyTorch 2.13은 Apple Silicon에서 12배 빨라진 FlexAttention과 최대 4배 줄어든 GPU 메모리 사용량을 제공하며, 2분기에만 4,415건의 커밋을 기록했습니다. vLLM, DeepSpeed, Ray Data, Helion도 발전을 이어가고 있습니다.
이 기사는 AI가 1차 출처를 기반으로 생성했습니다.
PyTorch Foundation, 6개 오픈소스 프로젝트를 아우르다
2025년 4월 설립된 다중 프로젝트 재단인 PyTorch Foundation은 현재 PyTorch, vLLM, DeepSpeed, Ray, Helion을 비롯한 머신러닝 생태계의 여러 구성 요소 등 6개의 오픈소스 프로젝트를 아우르고 있습니다. 공동 거버넌스를 통해 모델의 훈련, 서빙, 최적화를 아우르는 도구들의 조율된 개발이 가능해집니다.
PyTorch 2.13의 FlexAttention은 얼마나 빨라졌는가?
새로운 PyTorch 2.13 버전은 이전 버전보다 Apple Silicon에서 약 12배 빨라진 어텐션 메커니즘 FlexAttention을 제공합니다. 새로운 nn.LinearCrossEntropyLoss 기능은 필요한 GPU 메모리를 최대 4배까지 줄여주며, 2분기에는 4,415건의 커밋이 기록되어 프로젝트의 이전 비교 기간보다 훨씬 많은 수치를 보였습니다.
vLLM, DeepSpeed, Ray Data, Helion의 발전
vLLM은 안정적인 2주 단위 릴리스 주기를 확립했으며, 8월 24일부터 26일까지 Ray Summit에서 자체 첫 컨퍼런스를 개최한다고 발표했습니다. DeepSpeed는 1분기에 6건의 릴리스를 발표했고, SuperOffload는 ASPLOS 2026 컨퍼런스에서 최우수 논문상 명예상을 수상했습니다. AMD MI325X GPU에서 Ray와 vLLM은 prefill-decode 분리 방식으로 67%의 비용 절감을 달성했으며, 곧 출시될 Ray Data 2.57은 완전히 새로운 고성능 엔진을 예고합니다. Helion은 오토튜닝 속도를 10배 향상시켰고 NVIDIA Blackwell과 Google TPU 아키텍처에서 최고 수준(state-of-the-art)의 결과를 기록했습니다.
자주 묻는 질문
- PyTorch Foundation이란 무엇입니까?
- PyTorch Foundation은 2025년 4월에 설립된 다중 프로젝트 재단으로, PyTorch, vLLM, DeepSpeed, Ray, Helion을 포함해 머신러닝 생태계의 6개 오픈소스 프로젝트를 아우릅니다.
- FlexAttention이란 무엇이며 얼마나 빨라졌습니까?
- FlexAttention은 PyTorch의 어텐션 메커니즘으로, 2.13 버전에서는 Apple Silicon에서 약 12배 빠르게 작동하며, 새로운 nn.LinearCrossEntropyLoss 기능은 필요한 GPU 메모리를 최대 4배까지 줄여줍니다.
📬 AI 뉴스를 받은편지함으로
나만의 방식으로 구성하는 일일 다이제스트 — 주제, 출처, 주기를 선택하세요. 원클릭 해지.