PyTorch — un framework popolare per l'apprendimento automatico — è stato aggiornato alla versione 2.10.
Tra le principali novità si segnalano:
Supporto AMD ROCm:
- Introdotto il supporto per GEMM raggruppato.
- Migliorato il supporto per ROCm su Windows.
- Aggiunti nuovi modelli GPU GFX1150/GFX1151 (serie AI 300) nell'elenco di supporto hipblaslt.
- Espansi le funzionalità, come il supporto per scaled_mm v2 e AOTriton scaled_dot_product_attention.
Supporto GPU Intel:
- Introdotti nuovi API Torch XPU per Intel.
- Supporto per operatori ATen aggiuntivi.
- Ottimizzazione delle prestazioni per GPU Intel.
Supporto NVIDIA CUDA:
- Migliorate le possibilità di scrivere kernel template.
- Migliorato il supporto per CUDA 13.
Supporto per Python 3.14 in torch.compile(), oltre al supporto sperimentale per la creazione di Python 3.14 senza blocco globale dell'interprete (free-threaded).
Riduzione delle spese generali di avvio dei kernel grazie alla fusione orizzontale dei combo kernel in Torch Inductor.
L'elenco completo delle modifiche è disponibile sulla github.
Opzioni pronte, compilate per diverse GPU, sistemi operativi e linguaggi (Python/C++/Java) sono disponibili su sito di Pytorch
Fonte: linux.org.ru
