Roman Gushchin z zespołu deweloperów jądra Linux, pracujący w Google, ogłosił stworzenie nowego systemu weryfikacji kodu z wykorzystaniem dużych modeli językowych. Prace trwały przez ostatnie kilka miesięcy i otrzymały nazwę Sashiko, na cześć tradycyjnego japońskiego haftu, składającego się z małych prostych ściegów tworzących różne wzory.
Projekt jest już od pewnego czasu używany w firmie Google do identyfikacji problemów, a teraz stał się dostępny dla wszystkich i został skonfigurowany do automatycznej recenzji wszystkich łatek przesyłanych do listy mailingowej deweloperów jądra Linux. Kod Sashiko został napisany w języku Rust i jest dostępny na licencji Apache 2.0. System jest samodzielny i może być używany na własnym sprzęcie.
Sashiko został zaprojektowany do pracy z modelem Google Gemini Pro 3.1, ale częściowo testowany z Claude i prawdopodobnie będzie działał z innymi nowoczesnymi dużymi modelami językowymi. Wykorzystane do recenzji prompty opierają się na zestawie review-prompts przygotowanym przez Chrisa Masona, twórcę systemu plików Btrfs. Budżet tokenów i infrastruktura Sashiko są finansowane przez Google. Prawa do projektu zostały przekazane organizacji Linux Foundation.
Z przeprowadzonych testów wynika, że przy użyciu modelu Gemini 3.1 Pro narzędzie Sashiko było w stanie wykryć 53% błędów z nieprzefiltrowanego zestawu, obejmującego 1000 niedawnych problemów w jądrze, oznaczonych tagami „Fixes:”. Na pierwszy rzut oka 53% nie wygląda zbyt imponująco, ale należy pamiętać, że wszystkie zidentyfikowane problemy na początku nie zostały zauważone podczas recenzji przez ludzi.
Źródło: opennet.ru
