Die Firma SUSE hat ein KI-Modell zur Analyse der lizenzrechtlichen Reinheit von Code veröffentlicht.

Das Unternehmen SUSE hat die Veröffentlichung des großen Sprachmodells Cavil-Qwen3-4B unter der Apache 2.0-Lizenz bekannt gegeben. Dieses Modell wird in SUSE- und openSUSE-Projekten im Cavil-Toolset zur Analyse der Lizenzreinheit des Codes verwendet. Das veröffentlichte Modell umfasst 4 Milliarden Parameter und basiert auf dem Modell Qwen3-4B, das zusätzlich für die Textklassifizierung optimiert wurde.

Der Hauptzweck des Modells besteht darin, die in Quellcodes und Dokumentationen verwendeten Lizenzen zu identifizieren. Um diese Aufgabe zu erfüllen, wurde das Modell mit einem Datensatz von 150.000 Beispielen von Überschriften und Kommentaren, in denen Lizenzen im Quellcode erwähnt werden, zusätzlich trainiert. In der Praxis ermöglicht das Modell die Automatisierung der Überprüfung der Lizenzreinheit des Codes, um Lizenzinkompatibilitäten und potenzielle rechtliche Probleme im Zusammenhang mit dem Code zu erkennen.

Die Modellgröße wurde ausgewählt, um eine Kombination aus qualitativem Verständnis sprachlicher Konstrukte und der Leistung auf Systemen mit gängigen Consumer-GPUs zu erreichen. Neben dem Modell steht ein Datensatz, der für das Training verwendet wurde, sowie ein Validierungswerkzeug zur Verfügung. Ebenfalls verfügbar ist ein Handler zur Nutzung des Modells im Cavil-Toolkit, das zur Überprüfung von Quellcode auf Einhaltung rechtlicher Normen und Anforderungen (Lizenzprüfung, Erkennung von Lizenzverletzungen, Risikobewertung) dient.

Quelle: opennet.ru

Zuverlässiges Webhosting mit DDoS-Schutz, VPS- und VDS-Server kaufen 🔥 Zuverlässiges Webhosting mit DDoS-Schutz, VPS- und VDS-Server kaufen | ProHoster