Google hat eine neue Familie großer Sprachmodelle namens Gemma 4 veröffentlicht, die auf der Technologie des Modells Gemini 3 basieren. Gemma 4 wird unter der Apache-Lizenz in Varianten mit 2,3, 4,5, 25,2 und 30,7 Milliarden Parametern (E2B, E4B, 31B und 26B A4B) vertrieben. Die Varianten E2B und E4B sind für den Einsatz auf mobilen Geräten, Internet-of-Things-Systemen (IoT) und Raspberry Pi-Platinen geeignet, während die anderen Varianten für die Anwendung auf Workstations und Systemen mit Consumer-GPUs vorgesehen sind. Der Kontext, den das Modell berücksichtigt, beträgt 128.000 Tokens für die Modelle E2B und E4B und 256.000 Tokens für die Modelle 31B und 26B A4B.
Mehrsprachige und multimodale Modelle: Aus der Box werden 35 Sprachen unterstützt (bei der Schulung wurden über 140 Sprachen verwendet), und Texte sowie Bilder können als Eingaben verarbeitet werden (die Modelle E2B und E4B unterstützen zusätzlich die Verarbeitung von Audio). Das Modell 26B A4B basiert auf der MoE-Architektur (Mixture-of-Experts), bei der das Modell in eine Reihe von Expertengruppen unterteilt ist (bei der Generierung einer Antwort können nur 3,8 Milliarden Parameter verwendet werden, jedoch ist die Geschwindigkeit erheblich höher als bei klassischen großen Modellen), während die anderen Varianten eine klassische monolithische Architektur verwenden.
Die Modelle unterstützen Denkprozesse und anpassbare Denkmodi und bieten eine systematische Rolle (System Role) zur Verarbeitung von Anweisungen (Regeln, Einschränkungen) getrennt von den Daten. Die Modelle können zum Schreiben von Code, zur Objekterkennung in Bildern, zur Einzelbildanalyse von Videos, zur Analyse von Dokumenten und PDFs, zur optischen Zeichenerkennung (OCR) von gedrucktem und handschriftlichem Text, zur Spracherkennung und zum Übersetzen zwischen Sprachen verwendet werden. Sie können als autonome Agenten eingesetzt werden, die mit verschiedenen Tools und APIs interagieren.
In den meisten Tests übertreffen die Modelle der Gemma 4-Serie die Gemma 3 deutlich mit 27 Milliarden Parametern. Gemma 4 unterstützt die Verwendung mit Tools und Bibliotheken wie LiteRT-LM, vLLM, llama.cpp, MLX, Ollama, NVIDIA NIM und NeMo, LM Studio, Unsloth, SGLang, Cactus, Basetan, MaxText, Tunix und Keras.


Quelle: opennet.ru
