Niedawno (od 9 czerwca 2026) twórcy sieci neuronowych natrafili na zjawisko, które może mieć daleko idące konsekwencje. Producenti LLM coraz częściej wyraźnie odmawiają klientom współpracy w określonych tematach, ale pojawiają się też niejawne mechanizmy. Znana model Claude, uważana za jeden z najlepszych lub wręcz najlepszy LLM do opracowywania programów, cicho i bezszelestnie (w przeciwieństwie do tematów takich jak cyberbezpieczeństwo, biologia czy chemia) ogranicza swoje działanie, gdy wykryje, że ktoś próbuje rozwijać inne modele przy jej pomocy.
Oficjalnie w "model card" dla 5. wersji Claude Mythos i Claude Fable na stronie 13 w firmowym PDF napisano (w polskim tłumaczeniu):
W świetle zdolności współczesnych modeli do przyspieszania własnego rozwoju, wprowadziliśmy nowe środki ograniczające skuteczność Claude dla zapytań dotyczących rozwoju zaawansowanych modeli uczenia maszynowego (na przykład przy tworzeniu linii produkcyjnych wstępnego uczenia, zdalnej infrastruktury szkoleniowej lub projektowaniu akceleratorów uczenia maszynowego). Wykorzystanie Claude do rozwijania konkurencyjnych modeli już narusza nasze warunki świadczenia usług, ale wdrożenie tych ograniczeń przy pomocy naszych środków ochrony pozwala uniknąć przyspieszenia działań tych, którzy są najbardziej skłonni do łamania tych zasad.
W przeciwieństwie do naszych środków ochrony w obszarze cyberbezpieczeństwa, biologii i chemii oraz prób destylacji, te środki ochrony nie będą widoczne dla użytkownika. Fable 5 nie przełączy się na inny model. Zamiast tego środki ochrony ograniczą wydajność przy pomocy takich metod jak modyfikacja podpowiedzi, ukierunkowane wektory lub parametryczna efektywna drobna regulacja (PEFT). Te środki ochrony nie wpłyną na zdecydowaną większość prac programistycznych. Szacujemy, że dotkną ~0,03% ruchu skoncentrowanego w mniej niż 0,1% organizacji.
Dyskusja na Y combinator
Źródło: linux.org.ru
