Google esitles Gemini 3 Deep Thinki — võimsat tehisintellekti teadusele, mis endiselt „kohandab” ülesandeid vastuse järgi.

Google'i ettevõte avaldas suure värskenduse Gemini 3 Deep Think — loogilise tehisintellekti platvorm, mis on mõeldud aktuaalsete probleemide lahendamiseks teaduse ja inseneritehnika valdkonnas.

Google esitles Gemini 3 Deep Thinki — võimsat tehisintellekti teadusele, mis endiselt „kohandab” ülesandeid vastuse järgi.

Uue versiooni arendamine Google Gemini 3 Deep Think’is toimus koostöös teadlastega — teenus on suunatud keeruliste uurimisülesannete lahendamisele, mille aspektid ei pruugi omada selgeid piirjooni või ühte õiget lahendust ning seotud andmed võivad olla puudulikud või mittesüsteemsed. Uuendatud Deep Think platvorm on katse minna kaugemale abstraktsest teooriast ja liikuda praktilisse rakendusse. Uus režiim on saadaval otse Gemini rakenduses, kuid seda saavad kasutada ainult Google AI Ultra tellijad; ettevõte avab teenusele juurdepääsu ka esmakordselt Gemini API kaudu — insenerid, teadlased ja ettevõtted peavad esitama vastava taotluse.

Testis Humanity’s Last Exam platvorm Google Gemini 3 Deep Think saavutas 48,4% ilma kolmandate tööriistade kasutamiseta; tulemus benchiarkis ARC-AGI-2 oli enneolematud 84,6%. Programmeerimistestis Codeforces Elo reiting oli 3455; 2025. aasta Rahvusvahelise Matemaatika Olümpiaadi ülesannetes näitas süsteem kuldmedali taset, sama tulemust saavutas ta keemia ja füüsika olümpiaadide ülesannete lahendamisel. Testis CMT-Benchmark näitas Google Gemini 3 Deep Think režiim kõrget taset teoreetilise füüsika osas, tulemusega 50,5%.

Google esitles Gemini 3 Deep Thinki — võimsat tehisintellekti teadusele, mis endiselt „kohandab” ülesandeid vastuse järgi.

Mudeli Gemini 3 Deep Think aluseks oli AI-agent, mille Google DeepMind laboris sai nimeks Aletheia. See sisaldab loomuliku keele kasutamise hüpoteeside kontrollimise vahendit, mis aitab tuvastada pakutud lahenduste nõrkusi; ette on nähtud iteratiivne lahenduste genereerimise ja kohandamise protsess. Oluline on, et agent võib tunnistada oma võimetust päringule vastata. Koos keeruliste uuringutega pöördub ta Google'i otsinguteenuse ja veebisirvimise vahendite poole – kokkuvõtete koostamisel avaldatud kirjandusest ei esita ta olematuid linke ja püüab vältida arvutustes ebatäpsusi.

Google'i Aletheia arendajad on tõlgendanud saavutuste praeguseid ja tulevikku suunatud tasemeid viie kategooria kaudu. Peaaegu täielikult autonoomses režiimis on IA-agenti määratlenud kolm avatud ülesannet, mille esitas matemaatik Pál Erdős — see uurimus hinnati nulltasemele, mis vastab "algtaseme uudsusele". Samas režiimis pakkus ta lahendust veel ühele ülesandele samast kogumist, saavutades esimese taseme ehk "minimaalne uudsus". Teisel tasemel, „publikatsiooniks sobiv“, näitas Aletheia tulemusi autonoomses režiimis, inimkoostöö režiimis ja abivahendina. Kolmas („oluline läbimurre") ja neljas („mälestusväärne läbimurre") ei ole IA-agendile veel kätte saadud.

Aletheia arendas 700 veel lahendamata Erdősi matemaatika ülesannet ja suutis neist lahendada 13. Tõsi, 9 ülesande jaoks leiti juba olemasolev lahendus, samas kui tõeliselt esmakordselt lahendatuks näivad vaid 4 ülesannet. Veelgi enam, 212 lahendusest, mille AI andis, olid ainult 6,5 % „sisuliselt õiged“. Ülejäänud olid kas fundamentaalsete puudustega (68,5 %) või lahendasid valesti tõlgendatud ülesannete versioone (31,5 %).

Tulemuseks leppisid arendajad kokku, et nende AI näitab „kalduvust vale küsimuse mõistmiseks nii, et sellele oleks lihtsam vastata“ ja jääb „inimestega võrreldes äärmiselt vigu tekitavaks“. Teisisõnu, AI ei saa matemaatikute asemele veel asendada.

Allikad:


Allikas: 3dnews.ru
Osta usaldusväärne veebihosting DDoS kaitsega, VPS VDS serverid 🔥 Osta usaldusväärne veebihosting DDoS kaitsega, VPS VDS serverid | ProHoster