PyTorch — un framework populaire pour l'apprentissage automatique — a été mis à jour vers la version 2.10.
Parmi les principales nouveautés, on peut noter :
Support d'AMD ROCm :
- Un support pour GEMM groupé a été introduit.
- Amélioration du support ROCm pour Windows.
- Ajout de nouveaux modèles de GPU GFX1150/GFX1151 (série AI 300) dans les listes de support hipblaslt.
- Fonctionnalités étendues, telles que le support de scaled_mm v2 et AOTriton scaled_dot_product_attention.
Support des GPU Intel :
- Nouveaux API Torch XPU pour Intel introduits.
- Support d'opérateurs ATen supplémentaires.
- Optimisation des performances pour les GPU Intel.
Support de NVIDIA CUDA :
- Fonctionnalités étendues pour l'écriture de cœurs templates.
- Amélioration du support de CUDA 13.
Support de Python 3.14 pour torch.compile(), ainsi qu'un support expérimental pour la construction de Python 3.14 sans verrouillage global de l'interpréteur (multi-threaded).
Réduction des frais généraux au démarrage des cœurs grâce à la fusion horizontale des cœurs combinés dans Torch Inductor.
La liste complète des modifications est disponible sur github.
Les versions prêtes à l'emploi, compilées pour différents GPU, systèmes d'exploitation et langages (Python/C++/Java), sont indiquées sur le site Pytorch.
Source : linux.org.ru
