Publication de la version AMD GAIA 0.20.0 — un cadre ouvert pour le lancement d'agents IA locaux sur PC avec accélération matérielle AMD Ryzen AI. Le projet est distribué sous licence MIT, supporte Windows et Linux, et l'installation est disponible via le paquet amd-gaia. Le tag v0.20.0 a été publié le 3 juin, mais la sortie est apparue dans le fil d'actualités du 4 au 5 juin.
Le principal changement de la version est le choix normal de l'appareil d'exécution pour chaque agent. Auparavant, GAIA utilisait par défaut le GPU via un backend basé sur llama.cpp et ne fournissait pas de moyen pratique de basculer un agent spécifique sur le CPU ou le NPU économe en énergie de Ryzen AI. Dans GAIA 0.20.0, les agents peuvent déclarer les appareils pris en charge, et l'utilisateur choisit CPU, GPU ou NPU via l'interface utilisateur de l'agent ou le drapeau CLI —device {cpu,gpu,npu}. Le GPU reste l'option par défaut, tandis que le profil gaia init —profile npu gère la détection du NPU, l'installation du FLM-backend et le chargement du modèle.
Modifications dans cette version :
Choix CPU/GPU/NPU pour des agents individuels. Permet d'exécuter des scénarios lourds sur GPU, tandis que les scénarios moins exigeants ou de fond s'exécutent sur NPU ou CPU. Pour les propriétaires de Ryzen AI, cela est particulièrement important : le NPU peut être utilisé pour une sortie locale avec une consommation d'énergie réduite, sans occuper le cœur graphique.
Agent Hub TUI. Lors du lancement de gaia sans arguments, un centre de gestion des agents dans le terminal s'ouvre désormais. À travers celui-ci, il est possible de visualiser, rechercher, lancer et administrer des agents sans interface graphique. Les développeurs indiquent que la taille de l'exécutable autonome est d'environ 21 Mo et que le lancement prend moins de 200 ms.
Contrôle plus strict des outils MCP. Pour les connecteurs MCP, un deuxième niveau de contrôle — activations — a été ajouté. Désormais, le connecteur attribué à un agent n'est pas obligé d'ajouter automatiquement tous ses outils au prompt : les outils ne deviennent visibles qu'après activation explicite pour la paire « connecteur — agent ». Cela réduit le bruit dans le prompt et aide les petits modèles à choisir les actions appropriées avec plus de précision.
Traitement du courrier accéléré. L'agent email a reçu sept nouveaux outils batch pour organiser massivement les entrées. Selon les développeurs, le scénario typique est passé d'environ 13 requêtes LLM à 2-3 étapes, le temps de traitement a été réduit de 488 secondes à 30-60 secondes, et la consommation de jetons est passée d'environ 12 000 à 1 200.
RAG pour les fichiers PowerPoint. GAIA indexe désormais directement les .pptx : texte, tableaux, notes du conférencier et images intégrées via l'analyse VLM. Auparavant, l'utilisateur devait d'abord enregistrer les présentations au format PDF.
Renforcement de la sécurité et de la résilience du premier lancement. La version corrige le contournement de la protection en écriture par des liens symboliques dans Python 3.10/3.11, étend les limitations d'écriture à quatre autres outils de fichiers, et corrige une erreur de diagnostic d'un modèle corrompu qui pouvait entraîner un redémarrage avec environ 25 Go de données.
GAIA évolue comme une alternative locale aux services d'IA basés sur le cloud : les données restent sur la machine de l'utilisateur, et l'exécution peut être transférée entre CPU, GPU et NPU en fonction de la tâche. Pour AMD, cela représente également une démonstration pratique de l'utilisation de Ryzen AI, non seulement en tant que bloc marketing dans le processeur, mais aussi en tant que dispositif de calcul distinct pour les agents locaux.
Source : linux.org.ru
