Badacze z zespołów Google Project Zero i Google DeepMind opublikowali raport na temat rozwoju systemu AI Big Sleep, opartego na dużym modelu językowym Gemini 1.5 Pro, przeznaczonego do identyfikacji luk w kodzie źródłowym. Sukcesem projektu było wykrycie przy użyciu Big Sleep pierwszej w pełni eksploatacyjnej, wcześniej nieznanej luki w istniejącym projekcie. Luka ta została zidentyfikowana w wyniku analizy kodu bazy danych SQLite przez system AI, prowadząc do niedoboru bufora w stosie (buffer underflow). Problem został wykryty w niedawno zaakceptowanym kodzie i usunięty przed jego wprowadzeniem w ostatecznej wersji SQLite 3.47.0.
Model może być używany jako narzędzie wspomagające w dziedzinach, gdzie konieczna jest pracochłonna ręczna recenzja, a także do automatycznej weryfikacji nowego kodu w celu wykrywania luk na wczesnych etapach rozwoju (przed wprowadzeniem problematycznego kodu do wersji finalnych). Zakłada się, że rozwijany model AI umożliwi wykrywanie problemów związanych z bezpieczeństwem w kodzie, które trudno zidentyfikować za pomocą testowania fuzzingowego.
Dodatkowo warto wspomnieć, że dyrektor generalny Google zauważył, iż obecnie ponad jedna czwarta (25%) całego kodu tworzonego w firmie generowana jest przy użyciu dużych modeli językowych Gemini, po czym ten kod jest recenzowany i akceptowany przez inżynierów. Zaznacza się, że takie zastosowanie AI znacznie przyspieszyło proces rozwoju produktów.
Źródło: opennet.ru
