Публикация на издание AMD GAIA 0.20.0 — от открытого фреймворка за стартиране на локални AI-агенти на ПК с хардуерно ускорение AMD Ryzen AI. Проектът се разпространява под лиценз MIT, поддържа Windows и Linux, а инсталацията е достъпна чрез пакета amd-gaia. Самият етикет v0.20.0 е публикуван на 3 юни, но в новинарската лента релизът е попаднал на 4–5 юни.
Основната промяна в версията е нормалният избор на устройство за изпълнение за всеки агент. По-рано GAIA по подразбиране използваше GPU чрез бекенд на база llama.cpp и не предоставяше удобен начин за прехвърляне на конкретен агент на CPU или енергийно ефективен Ryzen AI NPU. В GAIA 0.20.0 агентите могат да обявяват поддържаните устройства, а потребителят избира CPU, GPU или NPU чрез Agent UI или CLI-флаг —device {cpu,gpu,npu}. GPU остава опция по подразбиране, а профилът gaia init —profile npu приема управлението на откритие на NPU, инсталация на FLM-бекенд и зареждане на модела.
Промени в версията:
Избор на CPU/GPU/NPU за отделни агенти. Позволява стартиране на тежки сценарии на GPU, а по-малко изискващи или фонови — на NPU или CPU. За собствениците на Ryzen AI това е особено важно: NPU може да се използва за локален изход с по-ниска консумация на енергия, без да заема видеоядро.
Agent Hub TUI. При стартиране на gaia без аргументи сега се отваря терминален контролен център за агенти. През него можете да преглеждате, търсите, стартирате и администрирате агенти без графичен интерфейс. Разработчиците уточняват размера на самостоятелния бинарен файл около 21 MB и стартиране за по-малко от 200 ms.
По-строг контрол на MCP-инструментите. За MCP-конекторите е добавено второ ниво на управление — activations. Сега издаденият на агента конектор не е задължен автоматично да добавя всички свои инструменти в prompt: инструментите стават видими само след явно включване за двойката 'конектор — агент'. Това намалява шума в prompt и помага на малките модели да избират по-точно нужните действия.
Ускорена обработка на поща. Email-агентът получи седем нови batch-инструменти за масова организация на входящи. Според разработчиците, типичният сценарий е съкратен от около 13 LLM-запитвания до 2–3 стъпки, времето за обработка е намалено от 488 секунди до 30–60 секунди, а разходът на токени — от около 12 хиляди до 1,2 хиляди.
RAG по PowerPoint файлове. GAIA сега индексира .pptx директно: текст, таблици, бележки на говорителя и вградени изображения чрез VLM-анализ. По-рано потребителят трябваше първо да записва презентации в PDF.
Усъвършенстване на сигурността и устойчивостта на първоначалното стартиране. В настоящото издание е затворен обходът на защитата от запис чрез символични линкове в Python 3.10/3.11, разширени са ограниченията за запис с още четири файлови инструмента, а също е поправена грешка в диагностицирането на повреден модел, поради която може да се стартира повторно зареждане на около 25 GB данни.
GAIA се развива като локална алтернатива на облачните AI услуги: данните остават на машината на потребителя, а изпълнението може да се прехвърля между CPU, GPU и NPU в зависимост от задачата. За AMD това е и демонстрация на практическото приложение на Ryzen AI не само като маркетингов блок в процесора, но и като отделно изчислително устройство за локални агенти.
Източник: linux.org.ru
