Firma Anthropic zaprezentowała projekt Glasswing, w ramach którego udostępni wczesną wersję modelu AI Claude Mythos w celu identyfikacji luk i zwiększenia bezpieczeństwa krytycznego oprogramowania. Wśród uczestników projektu znajduje się organizacja Linux Foundation oraz firmy Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Microsoft, NVIDIA i Palo Alto Networks. Zaproszenia do udziału w projekcie otrzymało także około 40 innych organizacji.
Wydany w lutym model AI Claude Opus 4.6 osiągnął nową jakość w takich obszarach jak identyfikacja luk, wyszukiwanie i naprawa błędów, recenzowanie zmian i generowanie kodu. Eksperymenty z tym modelem AI pozwoliły wykryć ponad 500 luk w otwartych projektach oraz wygenerować kompilator C, zdolny do zbudowania jądra Linux. Jednocześnie model Claude Opus 4.6 słabo radził sobie z tworzeniem działających exploitów.
Model następnej generacji «Claude Mythos» według Anthropic znacząco przewyższa Claude Opus 4.6 w zakresie pisania gotowych exploitów. Z kilku setek prób stworzenia exploitów dla luk wykrytych w silniku JavaScript Firefox 147, w Claude Opus 4.6 jedynie dwie próby zakończyły się sukcesem. Przy powtórzeniu eksperymentu z użyciem wczesnej wersji modelu Mythos udało się stworzyć działające expiloty 181 razy — procent udanych exploitów wzrósł z wartości bliskich zeru do 72,4%.

Ponadto w Claude Mythos znacznie rozszerzono możliwości wykrywania błędów i luk, co w połączeniu z zdolnością do tworzenia exploitów stwarza nowe ryzyka dla branży — exploity dla jeszcze niezlikwidowanych luk (0-day) mogą być tworzone przez niedoświadczonych użytkowników w zaledwie kilka godzin. Zauważono, że poziom możliwości modelu Mythos w zakresie wykrywania i wykorzystania luk osiągnął profesjonalną jakość i jak na razie nie dorównuje tylko najbardziej doświadczonym profesjonalistom.
Otworzenie nieograniczonego dostępu do modeli AI o podobnych możliwościach wymaga przygotowania branży, dlatego zdecydowano się najpierw otworzyć dostęp do wersji wstępnej dla wąskiego grona ekspertów, którzy będą pracować nad identyfikacją i eliminacją luk w krytycznych oprogramowaniach i otwartym oprogramowaniu. Na sfinansowanie tej inicjatywy przyznano dotację w wysokości 100 milionów dolarów, a także postanowiono przyznać 4 miliony dolarów jako darowizny dla organizacji zajmujących się utrzymaniem bezpieczeństwa otwartych projektów.
W zestawie testowym CyberGym, oceniajacym zdolność modeli do wykrywania luk, model Mythos uzyskał wynik 83,1%, a Opus 4.6 — 66,6%. W testach jakości pisania kodu modele wykazały następujące wyniki:
W trakcie eksperymentu firma Anthropic w ciągu kilku tygodni dzięki modelowi AI Mythos zdołała zidentyfikować kilka tysięcy wcześniej nieznanych (0-day) luk, z których wiele oznaczono jako krytyczne. Między innymi znaleziono lukę w stosie TCP OpenBSD, która przez 27 lat pozostawała niezauważona, umożliwiając zdalne inicjowanie awaryjnego zakończenia działania systemu. Zidentyfikowano również lukę istniejącą od 16 lat w implementacji kodeka H.264 projektu FFmpeg oraz luki w kodekach H.265 i av1, które były wykorzystywane podczas przetwarzania specjalnie przygotowanego materiału.
W jądrze Linux zidentyfikowano kilka luk, które pozwalały nieuprzywilejowanemu użytkownikowi uzyskać uprawnienia root. Powiązanie zidentyfikowanych luk w łańcuch umożliwiło stworzenie exploitów, które umożliwiły uzyskanie praw root po otwarciu specjalnych stron w przeglądarce internetowej. Stworzono również exploit, który pozwolił na wykonanie kodu z uprawnieniami root poprzez wysłanie specjalnie przygotowanych pakietów sieciowych do serwera NFS z systemu FreeBSD.
W jednej z systemów wirtualizacji, napisanej w języku zapewniającym bezpieczną pracę z pamięcią, wykryto lukę, która potencjalnie pozwala na wykonanie kodu na stronie hosta poprzez manipulacje w systemie gościa (nazwa nie jest podawana, ponieważ problem nie został jeszcze naprawiony, ale wydaje się, że luka znajduje się w unsafe bloku w kodzie Rust). Wykryto luki w popularnych przeglądarkach internetowych oraz bibliotekach kryptograficznych. Zidentyfikowano luki prowadzące do wstrzyknięcia kodu SQL w różnych aplikacjach webowych.
Źródło: opennet.ru
