Google prezantoi Gemini 3 Deep Think — njĂ« AI tĂ« fuqishĂ«m pĂ«r shkencĂ«n, i cili ende "pĂ«rshtat" detyrat me pĂ«rgjigjen

Kompania Google lĂ«shoi njĂ« pĂ«rditĂ«sim tĂ« madh Gemini 3 Deep Think — njĂ« platformĂ« e bazuar nĂ« inteligjencĂ«n artificiale qĂ« mendon, e cila ka pĂ«r qĂ«llim tĂ« zgjidhĂ« problemet aktuale nĂ« fushĂ«n e shkencĂ«s dhe inxhinierisĂ«.

Google prezantoi Gemini 3 Deep Think — njĂ« AI tĂ« fuqishĂ«m pĂ«r shkencĂ«n, i cili ende "pĂ«rshtat" detyrat me pĂ«rgjigjen

Zhvillimi i versionit tĂ« ri Google Gemini 3 Deep Think Ă«shtĂ« realizuar nĂ« bashkĂ«punim me shkencĂ«tarĂ«t — shĂ«rbimi Ă«shtĂ« krijuar pĂ«r tĂ« zgjidhur probleme tĂ« ndĂ«rlikuara kĂ«rkimore, tĂ« cilat mund tĂ« kenĂ« aspekte pa kufij tĂ« qartĂ« ose njĂ« zgjidhje tĂ« vetme tĂ« saktĂ«, dhe tĂ« dhĂ«nat pĂ«rkatĂ«se mund tĂ« jenĂ« jopjesore ose tĂ« çrregullta. Platforma e pĂ«rditĂ«suar Deep Think pĂ«rfaqson njĂ« pĂ«rpjekje pĂ«r tĂ« kaluar pĂ«rtej teorisĂ« abstrakte dhe pĂ«r t'u futur nĂ« fushĂ«n e aplikimit praktik. Rezhimi i ri Ă«shtĂ« i disponueshĂ«m direkt nĂ« aplikacionin Gemini, por mund ta shfrytĂ«zojnĂ« vetĂ«m abonet e Google AI Ultra; kompania gjithashtu do ta hapĂ« pĂ«r herĂ« tĂ« parĂ« aksesin nĂ« shĂ«rbimin pĂ«rmes API Gemini — inxhinierĂ«t, hulumtuesit dhe ndĂ«rmarrjet do t'u duhet tĂ« dorĂ«zojnĂ« njĂ« kĂ«rkesĂ« pĂ«rkatĂ«se.

NĂ« provimin Humanity’s Last Exam, platforma Google Gemini 3 Deep Think arriti 48.4% pa pĂ«rdorimin e mjeteve tĂ« jashtme; rezultati nĂ« benchmarkun ARC-AGI-2 ishte njĂ« 84.6% pa precedent. NĂ« testin e programimit Codeforces, ratingu Elo arriti 3455; nĂ« detyrat e OlimpiadĂ«s NdĂ«rkombĂ«tare tĂ« MatematĂ«s 2025, sistemi tregoi nivelin e medaljes sĂ« artĂ«, tĂ« njĂ«jtin rezultat arriti edhe nĂ« zgjidhjen e detyrave tĂ« olimpiadave nĂ« kimi dhe fizikĂ«. NĂ« testin CMT-Benchmark, rezhimi Google Gemini 3 Deep Think demonstroi njĂ« nivel tĂ« lartĂ« tĂ« njohurive nĂ« fizikĂ«n teorike me njĂ« rezultat prej 50.5%.

Google prezantoi Gemini 3 Deep Think — njĂ« AI tĂ« fuqishĂ«m pĂ«r shkencĂ«n, i cili ende "pĂ«rshtat" detyrat me pĂ«rgjigjen

Modeli Gemini 3 Deep Think u shndĂ«rrua nĂ« bazĂ«n e agjentit tĂ« AI, i cili nĂ« laboratorin Google DeepMind mori emrin Aletheia. Ai pĂ«rfshin njĂ« mjet pĂ«r tĂ« verifikuar hipotezat, tĂ« shqiptuara nĂ« gjuhĂ«n natyrore, pĂ«r tĂ« identifikuar tĂ« metat nĂ« zgjidhjet e propozuara; parashikohet njĂ« proces iterativ i gjenerimit dhe rregullimit tĂ« zgjidhjeve. E rĂ«ndĂ«sishme, agjenti mund tĂ« pranojĂ« paaftĂ«sinĂ« e tij pĂ«r t'u pĂ«rgjigjur kĂ«rkesĂ«s. PĂ«r tĂ« trajtuar hulumtimet komplekse, ai i drejtohet shĂ«rbimit tĂ« kĂ«rkimit Google dhe mjeteve tĂ« navigimit tĂ« uebit — kur pĂ«rgatit pĂ«rmbledhje pĂ«r literaturĂ«n e publikuar, ai nuk jep lidhje joekzistuese dhe pĂ«rpiqet tĂ« shmangĂ« pasaktĂ«sitĂ« nĂ« llogaritje.

Niveli aktual dhe perspektiv tĂ« arritjeve tĂ« Aletheia zhvilluesit e Google e shpĂ«rndanĂ« nĂ« pesĂ« grada. NĂ« njĂ« mĂ«nyrĂ« pothuajse tĂ« plotĂ« autonome, agjenti AI pĂ«rcaktoi rrugĂ«t pĂ«r zgjidhjen e tre problemeve tĂ« hapura, tĂ« pĂ«rformuluara nga matematicienti PĂĄl ErdƑs — ky kĂ«rkim u vlerĂ«sua nĂ« nivelin zero, i cili korrespondon me "novitet tĂ« pa rĂ«ndĂ«sishĂ«m". NĂ« tĂ« njĂ«jtĂ«n mĂ«nyrĂ«, ai propozoi njĂ« zgjidhje pĂ«r njĂ« problem tjetĂ«r nga e njĂ«jta grup, duke arritur nivelin e parĂ« ose "novitet minimal". NĂ« nivelin e dytĂ«, "tĂ« pĂ«rshtatshme pĂ«r botim", Aletheia tregoi rezultate nĂ« mĂ«nyrĂ« autonome, nĂ« mĂ«nyrĂ« bashkĂ«punimi me njeriun dhe nĂ« mĂ«nyrĂ« si njĂ« mjet ndihmĂ«s. Niveli i tretĂ« ("pĂ«rparim tĂ« rĂ«ndĂ«sishĂ«m") dhe i katĂ«rt ("pĂ«rparim tĂ« shĂ«nuar") akoma nuk i janĂ« nĂ«nshtruar agjentit AI.

Sipas detyrës së zhvilluesve, Aletheia analizoi 700 probleme matematikore të pazgjidhura deri tani të Erdös dhe arriti të zgjidhte 13 prej tyre. Megjithatë, për 9 nga këto, ekzistonin zgjidhje tashmë të njohura, ndërsa vetëm 4 probleme duken si të zgjidhura për herë të parë. Për më tepër, nga 212 zgjidhje që ofroi AI, vetëm 6.5 % ishin 'të sakta në përmbajtje'. Të tjerat ose kishin mangësi themelore (68.5 %), ose zgjidhnin versione të interpretuara gabimisht të problemeve origjinale (31.5 %).

Si rezultat, zhvilluesit pranuan se AI i tyre tregon ' një prirje për ta kuptuar gabimisht pyetjen në një mënyrë që e bën më të lehtë përgjigjen' dhe mbetet 'jashtëzakonisht i prirur ndaj gabimeve krahasuar me njerëzit'. Me fjalë të tjera, nuk është ende në gjendje të zëvendësojë matematicienët.

Burimet:


Burimi: 3dnews.ru
Bleni hostim tĂ« besueshĂ«m pĂ«r faqe me mbrojtje nga DDoS, serverĂ« VPS VDS đŸ”„ Bleni hostim tĂ« besueshĂ«m pĂ«r faqe me mbrojtje nga DDoS, serverĂ« VPS VDS | ProHoster