Compania Mistral AI a lansat un model lingvistic mare, Devstral, optimizat pentru a rezolva problemele apărute în procesul de dezvoltare a software-ului. Spre deosebire de modelele AI tipice, Mistral AI depășește scrierea funcțiilor individuale și completarea codului, oferind capacități de analiză și contextualizare (definirea scopului și logicii) a bazelor mari de cod, identificarea legăturilor între componente și depistarea erorilor greu detectabile în funcții complexe.
Modelul are 23,6 miliarde de parametri, ia în considerare contextul în 128 de mii de tokeni și a fost publicat sub licența Apache 2.0. Arhiva descărcabilă cu Devstral ocupă 47 GB și este utilizabilă pe sisteme locale — pentru a rula modelul este suficient un PC cu plăcuță grafică NVIDIA GeForce RTX 4090 și 32 GB RAM. Modelul poate fi utilizat în instrumentele deschise SWE-agent și OpenHands pentru automatizarea corecției erorilor, analiza codului și efectuarea modificărilor.
Sistemul poate fi utilizat pentru a rezolva probleme specifice (issue) pe GitHub și depășește cu neliniște alte proiecte în setul de teste SWE-Bench Verified, care verifică corectitudinea soluției problemelor tipice în cod (se oferă 500 de teste bazate pe mesaje reale de eroare de pe GitHub). În acest test, modelul Devstral a obținut 46,8%, în timp ce modelul Claude 3.5 Haiku a obținut 40,6%, SWE-smith-LM 32B — 40,2% și GPT-4.1-mini — 23,6%. Printre altele, Devstral a depășit astfel de modele mari precum Deepseek-V3-0324 671B (38,8%) și Qwen3 232B-A22B (34,4%), care acoperă sute de miliarde de parametri.
Sursa: opennet.ro
