ArtPrompt — attacco ai sistemi AI, permesso di eludere i filtri utilizzando immagini ASCII
Un gruppo di ricercatori delle università di Washington, Illinois e Chicago ha scoperto un nuovo metodo per eludere le restrizioni sulla gestione dei contenuti pericolosi negli AI chatbot basati su modelli di linguaggio di grandi dimensioni (LLM). L'attacco si basa sul fatto che i modelli di linguaggio GPT-3.5, GPT-4 (OpenAI), Gemini (Google), Claude (Anthropic) e Llama2 (Meta) riconoscono e considerano con successo nelle richieste un testo formattato come ASCII art. Così […]
