PyTorch — een populaire framework voor machine learning — is bijgewerkt naar versie 2.10.
Enkele van de belangrijkste nieuwe functies zijn:
Ondersteuning voor AMD ROCm:
- Ondersteuning voor gegroepeerde GEMM is geïntroduceerd.
- Verbeterde ondersteuning voor ROCm op Windows.
- Nieuwe GPU modellen GFX1150/GFX1151 (AI 300-serie) zijn toegevoegd aan de ondersteuning van hipblaslt.
- De functionaliteiten zijn uitgebreid, zoals ondersteuning voor scaled_mm v2 en AOTriton scaled_dot_product_attention.
Ondersteuning voor GPU Intel:
- Nieuwe Torch XPU API's voor Intel zijn geïmplementeerd.
- Ondersteuning voor extra ATen-operators.
- Prestatieoptimalisatie voor GPU Intel.
Ondersteuning voor NVIDIA CUDA:
- Uitgebreidere mogelijkheden voor het schrijven van sjablonen-kernen.
- Verbeterde ondersteuning voor CUDA 13.
Ondersteuning voor Python 3.14 voor torch.compile(), evenals experimentele ondersteuning voor het bouwen met Python 3.14 zonder globale interpreterlock (free-threaded).
Vermindering van overhead bij het starten van kernen door horizontale fusie van combo-kernen in Torch Inductor.
Een volledige lijst van wijzigingen is beschikbaar op github.
Kant-en-klare varianten, gecompileerd voor verschillende GPU's, besturingssystemen en talen (Python/C++/Java) zijn vermeld op de Pytorch website.
Bron: linux.org.ru
