ArtPrompt — eine Attacke auf KI-Systeme, die die Filter durch ASCII-Bilder umgeht
Eine Gruppe von Forschern der Universitäten Washington, Illinois und Chicago hat eine neue Methode zur Umgehung der Einschränkungen bei der Verarbeitung gefährlicher Inhalte in KI-Chatbots, die auf großen Sprachmodellen (LLM) basieren, aufgezeigt. Der Angriff beruht darauf, dass die Sprachmodelle GPT-3.5, GPT-4 (OpenAI), Gemini (Google), Claude (Anthropic) und Llama2 (Meta) erfolgreich Text erkennen und in Anfragen berücksichtigen, der in Form von ASCII-Grafiken gestaltet ist. Damit […]
