Kompania Anthropic ka përfunduar rezultatet e para nga testimi i versionit paraprak të modelit AI Mythos, në të cilin janë zgjeruar ndjeshëm mundësitë për gjetjen e gabimeve, identifikimin e dobësive dhe shkruarjen e eksploitëve të gatshëm. Kompania Anthropic, me ndihmën e modelit AI Mythos, ka skanuar mbi një mijë projekte të rëndësishme të hapura, gjatë të cilave janë identifikuar 23019 dobësi. 6202 dobësi janë klasifikuar me nivel të lartë ose kritik të rrezikshmërisë.
1752 nga 6202 dobësi, të cilat janë klasifikuar si të rrezikshme nga modeli AI Mythos, janë verifikuar nga kompani të pavarura që specializohen në sigurinë kompjuterike. Në 1587 raste (90.6%) është konfirmuar prania e dobësisë, ndërsa në 1094 (62.4%) ka mbetur një nivel i lartë ose kritik rrezikshmërie. Duke bazuar në treguesit aktualë të alarmeve të gabuara, supozohet se nga 6202 dobësitë e rrezikshme të raportuara nga modeli AI, rreth 3900 (62.4%) do të ruajnë nivelin e lartë të rrezikshmërisë, përveç dobësive të rrezikshme që janë gjetur veçmas gjatë verifikimit nga 50 pjesëmarrësit e projektit Glasswing.
Të dhënat për 467 dobësi të vërtetuara janë dërguar përfaqësuesve të kompanive që mbikqyrin projektet e hapura. Me kërkesa të veçanta, stafi i Anthropic ka trasferuar direkt përmbajtjen mbi 1129 probleme të pavërtetuara. Në total, mbikëqyrësit e 281 projekteve të hapura kanë marrë të dhëna për 1596 probleme dhe kanë konfirmuar praninë e 1451 dobësive. Deri më tani, në bazat e kodit janë korrigjuar vetëm 97 probleme dhe janë publikuar 88 raporte të hapura mbi dobësitë.
Për më tepër, raportohet se 50 pjesëmarrës të projektit Glasswing, të cilëve iu dha qasje të hershme në modelin Mythos, zbuluan në bazat e tyre të kodit më shumë se 10,000 dobësi të rrezikshme. Për shembull, kompania Cloudflare gjeti me ndihmën e Mythos më shumë se 2000 gabime, nga të cilat 400 janë shënuar si dobësi me nivel të lartë dhe kritik rrezikshmërie. Nivelin e alarmeve të gabuara, sipas Cloudflare, ishte më i ulët se sa gjatë testimeve të kryera nga njerëzit. Kompania Mozilla, gjatë kontrollit të kodit të Firefox 150, gjeti me ndihmën e Mythos 271 dobësi, që është 10 herë më shumë se sa u gjetën gjatë kontrollit të Firefox 148 nga modeli Claude Opus 4.6.
Si një shembull i një problemi kritik të korrigjuar
váșčn tĂ«rheqĂ«s (CVE-2026-5194) nĂ« bibliotekĂ«n kriptografike wolfSSL. Mythos arriti tĂ« pĂ«rgatisĂ« njĂ« exploit qĂ« i lejon njĂ« sulmuesi tĂ« krijojĂ« njĂ« certifikatĂ« ECDSA tĂ« rreme pĂ«r faqet dhe postat serverĂ«sh, e cila gjatĂ« verifikimit nga biblioteka wolfSSL pĂ«rpunoheshin si tĂ« saktĂ«. Problemi u shkaktua nga mungesa e njĂ« kontrolli pĂ«r madhĂ«sinĂ« e hash-it dhe OID, qĂ« lejonte tĂ« specifikohej nĂ« certifikatĂ« njĂ« hash me njĂ« madhĂ«si mĂ« tĂ« vogĂ«l se ajo e lejuar.
Burimi: opennet.ru
