Hulumtuesit nga kompania CodeRabbit analizuan 470 pull-request-e (350 - të krijuara nga AI, 150 - të shkruara manualisht) në projekte të hapura në GitHub dhe arritën në përfundimin se në ndryshimet e gjeneruara nga asistencat AI, ka 1.7 herë më shumë defekte të rëndësishme dhe 1.4 herë më shumë probleme kritike sesa në kodin e shkruar manualisht. Në mesatare, në pull-request-et e gjeneruara nga AI ka pasur 10.83 probleme, ndërsa në ndryshimet e krijuara manualisht ky tregues ishte 6.45.
Kur shqyrtohen kategori të veçanta problemesh, në kodin e krijuar nga AI ka 1.75 herë më shumë gabime logjike, 1.64 herë më shumë probleme me cilësinë dhe mirëmbajtjen e kodit, 1.56 herë më shumë probleme me sigurinë dhe 1.41 herë më shumë probleme me performancën. Shtohet gjithashtu se në kodin e gjeneruar nga AI, probabiliteti i përpunimit të gabuar të fjalëkalimeve është 1.88 herë më i lartë, për të ofruar akses të pasigurt në objekte 1.91 herë, për scriptet ndërsite XSS 2.74 herë dhe për deserializimin e pasigurt të të dhënave 1.82 herë. Ndërkohë, në kodin e shkruar nga njerëzit kishte 1.76 herë më shumë gabime ortografike dhe 1.32 herë më shumë gabime të lidhura me testimin.



Disa studime të tjera:
- Në një studim të kryer në nëntor nga kompania Cortex, u vërejt se krahasuar me vitin e kaluar, falë përdorimit të AI, numri i pull-request-eve të krijuara nga një zhvillues mesatarisht u rrit me 20%, por numri i problemeve në pull-request-e u rrit me 23.5%, dhe niveli i refuzimeve gjatë ndryshimeve u rrit përafërsisht me 30%.
- Në studimin e bërë në gusht nga Universiteti i Napolit, u arrit në përfundimin se kodi i gjeneruar nga AI në përgjithësi është më i thjeshtë dhe më homogjen, por përmban më shumë konstruksione të pautilizuara dhe inserte debugging të ndërtuara, ndërsa kodi i shkruar manualisht është strukturore më kompleks dhe përmban më shumë probleme në mirëmbajtje.
- Eksperimenti i korrikut nga grupi METR tregoi se asistentët AI nuk përshpejtojnë, por ngadalësojnë zgjidhjen e detyrave të caktuara, ndonëse subjektivisht pjesëmarrësit mendonin se AI kishte përshpejtuar punën e tyre.
- Në një studim të janarit nga Universitete Monash, u tha se GPT-4 gjeneron kod më kompleks, që kërkon përmirësime për mbështetje të mëtejshme, por që kalon më mirë testet.
Burimi: opennet.ru
