Google'i ettevĂ”te avaldas suure uuenduse Gemini 3 Deep Think â arutlevat tehisintellekti platvorm, mis on mĂ”eldud aktuaalsete teaduse ja inseneeria probleemide lahendamiseks.

Uue versiooni Google Gemini 3 Deep Think arendust viisid lĂ€bi teadlased â teenus on vĂ€lja töötatud keeruliste teaduslike kĂŒsimuste lahendamiseks, millel vĂ”ivad olla ebamugavad piirangud vĂ”i ainus Ă”ige lahendus. Seotud andmed vĂ”ivad olla puudulikud vĂ”i mitteametlikud. Uuendatud Deep Think platvorm on katse minna kaugemale abstraktsest teooriast ja liikumiseks praktikas. Uus reĆŸiim on saadaval otse Gemini rakenduses, kuid seda saavad kasutada ainult Google AI Ultra tellijad; ettevĂ”te avab ka esmakordselt juurdepÀÀsu teenusele API Gemini kaudu â insenerid, teadlased ja ettevĂ”tted tuleb esitada vastav taotlus.
Testis Humanityâs Last Exam saavutas Google Gemini 3 Deep Think platvorm 48,4 % ilma kolmandate osapoolte tööriistade kasutamiseta; ARC-AGI-2 etalonil oli tulemus enneolematud 84,6 %. Programmeerimistestil Codeforces oli Elo reiting 3455; 2025. aasta Rahvusvahelise Matemaatika OlĂŒmpiaadi ĂŒlesannetes nĂ€itas sĂŒsteem kuldmedali taset, sama tulemust nĂ€idati ka keemia ja fĂŒĂŒsika olĂŒmpiaadi ĂŒlesannete lahendamisel. CMT-Benchmark testis demonstreeris Google Gemini 3 Deep Think reĆŸiim teoreetilise fĂŒĂŒsika oskuste kĂ”rget taset tulemusega 50,5%.

Model Gemini 3 Deep Think on aluseks AI-agendile, kelle laboratooriumis Google DeepMind sai nimeks Aletheia. See sisaldab hĂŒpoteeside kontrollimise vahendit looduskeeles esitatud lahenduste puuduste tuvastamiseks; on ette nĂ€htud lahenduste loomise ja kohandamise iteratiivne protsess. Oluline on, et agent vĂ”ib tunnistada oma suutmatust vastata pĂ€ringule. Keeruliste teaduslike uuringute puhul pöördub ta Google'i otsinguteenuse ja veebis navigeerimise vahendite poole â kirjanduse kokkuvĂ”tete koostamisel ei esita ta mitteolemasolevaid linke ja pĂŒĂŒab vĂ€ltida arvutuste ebatĂ€psusi.
Google'i arendajad on Aletheia tegelike ja tulevaste saavutuste tasemed jaganud viieks kategooriaks. Peaaegu tĂ€ielikult iseseisvas reĆŸiimis on AI-agendil edenenud kolme avatud ĂŒlesande lahendamine, mille formuleeris matemaatik PĂĄl ErdĆs â selle uurimist hinnati nulltasemel, mis vastab âvĂ€ikesele uudishimuâ. Sama reĆŸiimis pakkus ta lahendust veel ĂŒhele ĂŒlesandele samast komplektist, saavutades esimese taseme ehk âminimaalse uudishimuâ. Teisel tasemel, âvĂ€ljaandmiseks sobivâ, nĂ€itas Aletheia tulemusi iseseisvas reĆŸiimis, koostöös inimesega ja abivahendina. Kolmas (âmĂ€rkimisvÀÀrne lĂ€bimurreâ) ja neljas (âajalooline lĂ€bimurreâ) pole AI-agendile veel kĂ€tte jĂ”udnud.
Aletheia analĂŒĂŒsis 700 senitĂŒhja matemaatilist ĂŒlesannet, mille on vĂ€lja töötanud ErdĆs, ja suutis neist lahendada 13. TĂ”si, 9 ĂŒlesannet olid juba lahendatud, ning tegelikult on esmakordselt lahendatud vaid 4 ĂŒlesannet. Veelgi enam, 212 lahendusest, mille AI esitas, olid âsisuliselt Ă”igedâ vaid 6,5 %. ĂlejÀÀnud kas sisaldasid pĂ”hialuseid vigu (68,5 %) vĂ”i lahendasid vale tĂ”lgenduse pĂ”hjal agenti ĂŒlesandeid (31,5 %).
SeetĂ”ttu nĂ”ustusid arendajad, et nende AI nĂ€itab âkalduvust valesti mĂ”ista kĂŒsimust viisil, mis muudab vastamise lihtsamaksâ ja on inimestega vĂ”rreldes âÀÀrmiselt ekslikâ. TeisisĂ”nu, AI ei saa matemaatikute asendamiseks veel hakkama.
Allikad:
Allikas: 3dnews.ru
