PyTorch — un popolare framework per l'apprendimento automatico — è stato aggiornato alla versione 2.10.
Tra le principali novità si segnalano:
Supporto AMD ROCm:
- Introdotto il supporto per GEMM gruppato.
- Migliorato il supporto per ROCm su Windows.
- Aggiunti nuovi modelli GPU GFX1150/GFX1151 (serie AI 300) nelle liste di supporto hipblaslt.
- Espanse le funzionalità, come il supporto per scaled_mm v2 e AOTriton scaled_dot_product_attention.
Supporto GPU Intel:
- Introdotti nuovi API Torch XPU per Intel.
- Supporto operatori ATen aggiuntivi.
- Ottimizzazione delle prestazioni per GPU Intel.
Supporto NVIDIA CUDA:
- Capacità ampliate per la scrittura di kernel templati.
- Migliorato il supporto per CUDA 13.
Supporto per Python 3.14 per torch.compile(), oltre al supporto sperimentale per la creazione di Python 3.14 senza locking globale dell'interprete (free-threaded).
Riduzione delle spese generali per l'avvio dei kernel grazie alla fusione orizzontale dei kernel combo nel Torch Inductor.
L'elenco completo delle modifiche è disponibile su github.
Le opzioni pronte, compilate per diversi GPU, sistemi operativi e lingue (Python/C++/Java) sono indicate su sito di Pytorch
Fonte: linux.org.ru
