Google esitles Gemini 3 Deep Think — vĂ”imsat AI-d teaduse jaoks, mis ikka veel „kohandab” ĂŒlesandeid vastuse jĂ€rgi

Google'i ettevĂ”te avaldas suure uuenduse Gemini 3 Deep Think — arutlevat tehisintellekti platvorm, mis on mĂ”eldud aktuaalsete teaduse ja inseneeria probleemide lahendamiseks.

Google esitles Gemini 3 Deep Think — vĂ”imsat AI-d teaduse jaoks, mis ikka veel „kohandab” ĂŒlesandeid vastuse jĂ€rgi

Uue versiooni Google Gemini 3 Deep Think arendust viisid lĂ€bi teadlased — teenus on vĂ€lja töötatud keeruliste teaduslike kĂŒsimuste lahendamiseks, millel vĂ”ivad olla ebamugavad piirangud vĂ”i ainus Ă”ige lahendus. Seotud andmed vĂ”ivad olla puudulikud vĂ”i mitteametlikud. Uuendatud Deep Think platvorm on katse minna kaugemale abstraktsest teooriast ja liikumiseks praktikas. Uus reĆŸiim on saadaval otse Gemini rakenduses, kuid seda saavad kasutada ainult Google AI Ultra tellijad; ettevĂ”te avab ka esmakordselt juurdepÀÀsu teenusele API Gemini kaudu — insenerid, teadlased ja ettevĂ”tted tuleb esitada vastav taotlus.

Testis Humanity’s Last Exam saavutas Google Gemini 3 Deep Think platvorm 48,4 % ilma kolmandate osapoolte tööriistade kasutamiseta; ARC-AGI-2 etalonil oli tulemus enneolematud 84,6 %. Programmeerimistestil Codeforces oli Elo reiting 3455; 2025. aasta Rahvusvahelise Matemaatika OlĂŒmpiaadi ĂŒlesannetes nĂ€itas sĂŒsteem kuldmedali taset, sama tulemust nĂ€idati ka keemia ja fĂŒĂŒsika olĂŒmpiaadi ĂŒlesannete lahendamisel. CMT-Benchmark testis demonstreeris Google Gemini 3 Deep Think reĆŸiim teoreetilise fĂŒĂŒsika oskuste kĂ”rget taset tulemusega 50,5%.

Google esitles Gemini 3 Deep Think — vĂ”imsat AI-d teaduse jaoks, mis ikka veel „kohandab” ĂŒlesandeid vastuse jĂ€rgi

Model Gemini 3 Deep Think on aluseks AI-agendile, kelle laboratooriumis Google DeepMind sai nimeks Aletheia. See sisaldab hĂŒpoteeside kontrollimise vahendit looduskeeles esitatud lahenduste puuduste tuvastamiseks; on ette nĂ€htud lahenduste loomise ja kohandamise iteratiivne protsess. Oluline on, et agent vĂ”ib tunnistada oma suutmatust vastata pĂ€ringule. Keeruliste teaduslike uuringute puhul pöördub ta Google'i otsinguteenuse ja veebis navigeerimise vahendite poole — kirjanduse kokkuvĂ”tete koostamisel ei esita ta mitteolemasolevaid linke ja pĂŒĂŒab vĂ€ltida arvutuste ebatĂ€psusi.

Google'i arendajad on Aletheia tegelike ja tulevaste saavutuste tasemed jaganud viieks kategooriaks. Peaaegu tĂ€ielikult iseseisvas reĆŸiimis on AI-agendil edenenud kolme avatud ĂŒlesande lahendamine, mille formuleeris matemaatik PĂĄl ErdƑs — selle uurimist hinnati nulltasemel, mis vastab „vĂ€ikesele uudishimu“. Sama reĆŸiimis pakkus ta lahendust veel ĂŒhele ĂŒlesandele samast komplektist, saavutades esimese taseme ehk „minimaalse uudishimu“. Teisel tasemel, „vĂ€ljaandmiseks sobiv“, nĂ€itas Aletheia tulemusi iseseisvas reĆŸiimis, koostöös inimesega ja abivahendina. Kolmas („mĂ€rkimisvÀÀrne lĂ€bimurre“) ja neljas („ajalooline lĂ€bimurre“) pole AI-agendile veel kĂ€tte jĂ”udnud.

Aletheia analĂŒĂŒsis 700 senitĂŒhja matemaatilist ĂŒlesannet, mille on vĂ€lja töötanud ErdƑs, ja suutis neist lahendada 13. TĂ”si, 9 ĂŒlesannet olid juba lahendatud, ning tegelikult on esmakordselt lahendatud vaid 4 ĂŒlesannet. Veelgi enam, 212 lahendusest, mille AI esitas, olid „sisuliselt Ă”iged“ vaid 6,5 %. ÜlejÀÀnud kas sisaldasid pĂ”hialuseid vigu (68,5 %) vĂ”i lahendasid vale tĂ”lgenduse pĂ”hjal agenti ĂŒlesandeid (31,5 %).

SeetĂ”ttu nĂ”ustusid arendajad, et nende AI nĂ€itab „kalduvust valesti mĂ”ista kĂŒsimust viisil, mis muudab vastamise lihtsamaks“ ja on inimestega vĂ”rreldes „ÀÀrmiselt ekslik“. TeisisĂ”nu, AI ei saa matemaatikute asendamiseks veel hakkama.

Allikad:


Allikas: 3dnews.ru
Osta usaldusvÀÀrne hostimine veebilehtede jaoks DDoS-i kaitsega, VPS VDS serverid đŸ”„ Osta usaldusvÀÀrne hostimine veebilehtede jaoks DDoS-i kaitsega, VPS VDS serverid | ProHoster