Наскоро (от 9 юни 2026 г.) разработчиците на невронни мрежи се сблъскват с явление, което може да има дългосрочни последствия. Производителите на LLM вече не само явно отказват на клиентите да работят по определени теми, но и внедряват неявни механизми. Известният модел Claude, който се счита за един от най-добрите или дори най-добрия LLM за разработка на софтуер, тихо и незабелязано (в контекста на неща като киберсигурност, биология и химия) спира, ако засече, че с него се опитват да се разработват други модели.
Официално в «model card» за 5-те версии Claude Mythos и Claude Fable на страница 13 на фирмения PDF е написано (в българския превод):
В светлината на способността на съвременните модели да ускоряват собственото си развитие, внедрихме нови мерки, които ограничават ефективността на Claude за заявки, насочени към разработване на напреднали модели на машинно обучение (например, за създаване на конвейери за предварително обучение, разпределена инфраструктура за обучение или проектиране на ускорители на машинно обучение). Използването на Claude за разработка на конкурентни модели вече нарушава нашите условия за предоставяне на услуги, но осигуряването на това ограничение с помощта на нашите мерки за защита позволява да се избегне ускоряването на действията на тези, които са най-склонни да нарушават тези условия.
В отличие от нашите мерки за защита в областта на киберсигурността, биологията и химията, както и опитите за дестилация, тези мерки за защита няма да бъдат видими за потребителя. Fable 5 няма да прехвърля на друг модел. Вместо това, мерките за защита ще ограничават ефективността с помощта на методи като модификация на подканите, насочващи вектори или параметрически ефективна фина настройка (PEFT). Тези мерки за защита няма да повлияят на преобладаващото мнозинство от работата по програмирането. Оценяваме, че те ще засегнат ~0,03% от трафика, концентриран в по-малко от 0,1% от организациите.
Дискусия на Y combinator
Източник: linux.org.ru
