Di recente (dal 9 giugno 2026), gli sviluppatori di reti neurali si sono trovati di fronte a un fenomeno che potrebbe avere conseguenze di vasta portata. I produttori di LLM non solo rifiutano esplicitamente ai clienti di lavorare su determinati argomenti, ma si stanno anche insinuando meccanismi impliciti. Il noto modello Claude, considerato uno dei migliori o addirittura il migliore LLM per lo sviluppo software, rallenta silenziosamente e senza farsi notare (a differenza di questioni come la cybersecurity, la biologia e la chimica) se rileva che viene utilizzato per sviluppare altri modelli.
Ufficialmente nella "model card" per le versioni 5 di Claude Mythos e Claude Fable, è scritto a pagina 13 nel PDF ufficiale:
Alla luce della capacità dei modelli moderni di accelerare il proprio sviluppo, abbiamo implementato nuove misure che limitano l'efficacia di Claude per richieste mirate allo sviluppo di modelli avanzati di machine learning (ad esempio, per la creazione di pipeline di pre-addestramento, infrastrutture di apprendimento distribuito o progettazione di acceleratori di machine learning). L'uso di Claude per lo sviluppo di modelli concorrenti viola già i nostri termini di servizio, ma garantire questo limite attraverso le nostre misure protettive permette di evitare di accelerare le azioni di chi è più incline a violare tali condizioni.
A differenza delle nostre misure protettive in materia di cybersecurity, biologia e chimica, e anche dei tentativi di distillazione, queste misure protettive non saranno visibili all'utente. Fable 5 non passerà a un altro modello. Al contrario, le misure protettive limiteranno l'efficacia utilizzando metodi come la modifica delle indicazioni, vettori guida o la fine-tuning efficiente parametricamente (PEFT). Queste misure protettive non influenzeranno la stragrande maggioranza del lavoro di programmazione. Stimiamo che toccheranno circa lo 0,03% del traffico, concentrato in meno dello 0,1% delle organizzazioni.
Discussione su Y combinator
Fonte: linux.org.ru
