Mistral AI publikoi Devstral, një model të madh gjuhësor për punë me kodin

Kompania Mistral AI prezantoi një model të madh gjuhësor Devstral, të optimizuar për zgjidhjen e problemeve që lindin gjatë procesit të zhvillimit të softuerit. Ndryshe nga modelet e zakonshme të AI, Mistral AI shkon përtej shkruajtjes së funksioneve të veçanta dhe plotësimit të kodit, duke ofruar mundësi për të analizuar dhe kontekstualizuar (përcaktuar qëllimin dhe logjikën e funksionimit) baza të mëdha koduese, për t'u përcaktuar marrëdhëniet ndërmjet komponenteve dhe për të identifikuar gabime të vështira për t'u zbuluar në funksione komplekse.

Modeli mbulon 23.6 miliard parametra, merr parasysh kontekstin nĂ« 128 mijĂ« tokena dhe Ă«shtĂ« publikuar nĂ«n licencĂ«n Apache 2.0. Arkivi i dorĂ«zuar me Devstral zĂ« 47 GB dhe Ă«shtĂ« i pĂ«rshtatshĂ«m pĂ«r pĂ«rdorim nĂ« sisteme lokale — pĂ«r tĂ« ekzekutuar modelin, mjafton njĂ« PC me kartĂ« grafike NVIDIA GeForce RTX 4090 dhe 32 GB RAM. Modeli mund tĂ« pĂ«rdoret nĂ« mjetet e hapura SWE-agent dhe OpenHands pĂ«r automatizimin e rregullimit tĂ« gabimeve, analizĂ«n e kodit dhe ndryshimin e tij.

Sistemi mund tĂ« pĂ«rdoret pĂ«r tĂ« zgjidhur probleme specifike (issue) nĂ« GitHub dhe pĂ«rparon dukshĂ«m mbi projektet e tjera nĂ« grupin testues SWE-Bench Verified, qĂ« verifikon saktĂ«sinĂ« e zgjidhjes sĂ« problemeve tipike nĂ« kod (ofrohen 500 teste bazuar nĂ« raportet reale tĂ« gabimeve nĂ« GitHub). NĂ« kĂ«tĂ« test, modeli Devstral arriti 46.8%, ndĂ«rsa modeli Claude 3.5 Haiku mori 40.6%, SWE-smith-LM 32B — 40.2% dhe GPT-4.1-mini — 23.6%. PĂ«rveç kĂ«saj, Devstral e kaloi modelet e mĂ«dha si Deepseek-V3-0324 671B (38.8%) dhe Qwen3 232B-A22B (34.4%), qĂ« mbulojnĂ« qindra miliarda parametra.

Burimi: opennet.ru

Bli njĂ« hosting tĂ« besueshĂ«m pĂ«r faqet me mbrojtje DDoS, VPS VDS serverĂ« đŸ”„ Bli njĂ« hosting tĂ« besueshĂ«m pĂ«r faqet me mbrojtje DDoS, VPS VDS serverĂ« | ProHoster