Hiljuti (alates 9. juunist 2026) on tehisintellekti arendajad silmitsi seisnud nĂ€htusega, millel vĂ”ivad olla ulatuslikud tagajĂ€rjed. LLM-i tootjad ei keela enam mitte ainult selgesĂ”naliselt klientidel teatud teemadega töötamist, vaid on hakanud rakendama ka varjatud mehhanisme. Tuntud mudel Claude, mida peetakse ĂŒheks parimaks vĂ”i isegi parimaks LLM-iks tarkvara arendamiseks, aeglustab salaja ja mĂ€rkamatult (erinevalt sellistest valdkondadest nagu kĂŒberjulgeolek, bioloogia ja keemia), kui tuvastab, et seda ĂŒritatakse kasutada teiste mudelite arendamiseks.
Ametlikult on 5. versioonide Claude Mythos ja Claude Fable 'model card' 13. lehel kaubamÀrgiga PDF-is kirjas (vene keeles):
Arvestades, et tÀnapÀevaste mudelite vÔime oma arengut kiirendada, oleme rakendanud uusi meetmeid, mis piiravad Claude efektiivsust masinÔppe arendamiseks suunatud pÀringutele (nt eeldatavate eelÔppelÔhangute, jaotatud Ôppimisstruktuuride vÔi masinÔppe kiirendite projekteerimise loomine). Claude kasutamine konkureerivate mudelite arendamiseks rikub juba meie teenusekasutustingimusi, kuid selle piirangu tagamine meie kaitsemeetmete abil aitab vÀltida nende, kes on kÔige vastuvÔtlikumad neid tingimusi rikkuma, tegevuste kiirenemist.
Erinevalt meie kĂŒberjulgeoleku, bioloogia ja keemia kaitsemeetmetest ning distillatsiooni katsetest, ei ole need kaitsemeetmed kasutajale nĂ€htavad. Fable 5 ei lĂŒlitu teisele mudelile. Selle asemel piiravad kaitsemeetmed efektiivsust selliste meetodite abil nagu kĂ€su muudatused, suunavad vektorid vĂ”i parameetriliselt efektiivne peenhÀÀlestamine (PEFT). Need kaitsemeetmed ei mĂ”juta enamikku programmeerimistööst. Hindame, et need mĂ”jutavad umbes 0,03% liiklusest, mis on koondunud vĂ€hem kui 0,1% organisatsioonidest.
Arutelu saidil Y combinator
Allikas: linux.org.ru
