PyTorch — popularny framework do uczenia maszynowego — zaktualizował się do wersji 2.10.
Wśród głównych nowości można wymienić:
Wsparcie dla AMD ROCm:
- Wprowadzono wsparcie dla zgrupowanego GEMM.
- Poprawione wsparcie ROCm dla Windows.
- Nowe modele GPU GFX1150/GFX1151 (seria AI 300) dodane do listy wsparcia hipblaslt.
- Rozszerzone funkcjonalności, takie jak wsparcie dla scaled_mm v2 i AOTriton scaled_dot_product_attention.
Wsparcie dla GPU Intel:
- Wdrożono nowe interfejsy API Torch XPU dla Intela.
- Wsparcie dla dodatkowych operatorów ATen.
- Optymalizacja wydajności dla GPU Intel.
Wsparcie dla NVIDIA CUDA:
- Rozszerzone możliwości pisania szablonowych rdzeni.
- Poprawione wsparcie CUDA 13.
Wsparcie dla Pythona 3.14 dla torch.compile(), a także eksperymentalne wsparcie dla kompilacji Pythona 3.14 bez globalnego blokowania interpretera (wątki wolne).
Zmniejszenie narzutów przy uruchamianiu rdzeni dzięki poziomemu scaleniu rdzeni kombinowanych w Torch Inductor.
Pełna lista zmian dostępna na github.
Gotowe opcje, skompilowane dla różnych GPU, systemów operacyjnych i języków (Python/C++/Java) podane są na stronie Pytorch
Źródło: linux.org.ru
