Hulumtuesit nga kompania CodeRabbit analizuan 470 pull-request (350 â tĂ« krijuara nga AI, 150 â tĂ« shkruara manualisht) nĂ« projekte tĂ« hapura nĂ« GitHub dhe arritĂ«n nĂ« pĂ«rfundimin se nĂ« ndryshimet e gjeneruara nga asistentĂ«t AI ka 1.7 herĂ« mĂ« shumĂ« defekte tĂ« rĂ«ndĂ«sishme dhe 1.4 herĂ« mĂ« shumĂ« probleme kritike sesa nĂ« kodin e shkruar manualisht. NĂ« mesatare, nĂ« pull-request-at e gjeneruara nga AI kishte 10.83 probleme, ndĂ«rsa nĂ« ndryshimet e krijuara manualisht ky tregues ishte 6.45.
Kur shqyrtohen kategoritĂ« e veçanta tĂ« problemeve, nĂ« kodin e krijuar nga AI kishte 1.75 herĂ« mĂ« shumĂ« gabime logjike, 1.64 herĂ« mĂ« shumĂ« probleme me cilĂ«sinĂ« dhe mirĂ«mbajtjen e kodit, 1.56 herĂ« mĂ« shumĂ« probleme me sigurinĂ« dhe 1.41 herĂ« mĂ« shumĂ« probleme me performancĂ«n. Shtohet se nĂ« kodin e gjeneruar nga AI ka 1.88 herĂ« mĂ« shumĂ« probabilitet pĂ«r pĂ«rpunim tĂ« papĂ«rshtatshĂ«m tĂ« fjalĂ«kalimeve, 1.91 herĂ« â pĂ«r ofrimin e pa sigurt tĂ« qasjeve nĂ« objekte, 2.74 herĂ« â pĂ«r skritimin ndĂ«rfaqĂ«sor (XSS) dhe 1.82 herĂ« â pĂ«r deserializimin e pasigurt tĂ« tĂ« dhĂ«nave. NĂ« tĂ« njĂ«jtĂ«n kohĂ«, nĂ« kodin e shkruar nga njerĂ«zit kishte 1.76 herĂ« mĂ« shumĂ« gabime ortografike dhe 1.32 herĂ« mĂ« shumĂ« gabime qĂ« lidhen me testimin.



Disa kërkime të tjera:
- Në një studim të kryer në nëntor nga kompania Cortex, u tha se krahasuar me vitin e kaluar, falë përdorimit të AI, numri i pull-request-eve të krijuara nga çdo zhvillues është rritur mesatarisht me 20%, por numri i problemeve në pull-request është rritur me 23.5%, ndërsa niveli i refuzimeve gjatë ndryshimeve është rritur rreth 30%.
- Në një studim të bërë në gusht nga Universiteti Neapolitan, u arrit në përfundimin se kodi i gjeneruar nga AI është në përgjithësi më i thjeshtë dhe më njëformësisht, por përmban më shumë struktura të papërdorura dhe futje të integruara për debug, ndërsa kodi i shkruar manualisht është strukturally më i ndërlikuar dhe përmban më shumë probleme me mirëmbajtjen.
- Eksperimenti i korrikut nga grupi METR tregoi se ndihmësit AI nuk përshpejtojnë, por ngadalësojnë zgjidhjen e detyrave të caktuara, ndonëse ndjeshëm pjesëmarrësit menduan se AI përshpejtoi punën e tyre.
- Në një studim të janarit nga Universiteti Monash, u tha se GPT-4 gjeneron kod më të ndërlikuar, që kërkon përmirësime për mirëmbajtjen e mëtejshme, por e kalon më mirë testet.
Burimi: opennet.ru
