OpenChatKit wurde veröffentlicht, ein Werkzeug zur Erstellung von Chatbots.

Das OpenChatKit ist ein offenes Werkzeug, das darauf abzielt, die Erstellung von Chatbots fĂŒr spezialisierte und allgemeine Anwendungen zu erleichtern. Das System ist darauf angepasst, Aufgaben wie Antwortgebungen, das FĂŒhren mehrstufiger Dialoge, die Zusammenfassung, das Extrahieren von Informationen und die Textklassifikation zu erfĂŒllen. Der Code ist in Python geschrieben und wird unter der Lizenz Apache 2.0 verbreitet. Das Projekt umfasst ein einsatzbereites Modell, Code zur Schulung eines eigenen Modells, Werkzeuge zum Testen der Ergebnisse des Modells sowie Mittel zur ErgĂ€nzung des Modells mit Kontext aus externen Indizes und zur Anpassung des Grundmodells an die eigenen Anforderungen.

Als Grundlage fĂŒr den Bot wird ein Basis-Modell des maschinellen Lernens (GPT-NeoXT-Chat-Base-20B) vorgeschlagen, das mithilfe eines Sprachmodells mit etwa 20 Milliarden Parametern erstellt wurde und fĂŒr die Konversation optimiert ist. FĂŒr das Training des Modells wurden Daten aus den Kollektionen der Projekte LAION, Together und Ontocord.ai verwendet.

Um das vorhandene Wissen zu erweitern, wird ein System vorgeschlagen, das in der Lage ist, zusĂ€tzliche Informationen aus externen Repositories, APIs und anderen Quellen zu extrahieren. Beispielsweise ist eine Aktualisierung von Informationen mit Daten aus Wikipedia und Nachrichtenfeeds möglich. DarĂŒber hinaus steht ein Modell zur Moderation zur VerfĂŒgung, das mit 6 Milliarden Parametern trainiert wurde, auf dem Modell GPT-JT basiert und dafĂŒr gedacht ist, unangemessene Fragen herauszufiltern oder Diskussionen zu bestimmten Themen einzuschrĂ€nken.

Das Projekt ChatLLaMA ist ein separater Aspekt, das eine Bibliothek zur Erstellung intelligenter Assistenten Ă€hnlich wie ChatGPT anbietet. Das Projekt wird mit dem Blick auf die Möglichkeit der AusfĂŒhrung auf eigener Hardware sowie die Schaffung personalisierter Lösungen entwickelt, die auf spezifische Wissensgebiete abzielen (z. B. Medizin, Rechtswissenschaft, Spiele, wissenschaftliche Forschung usw.). Der Code von ChatLLaMA wird unter der Lizenz GPLv3 bereitgestellt.

Das Projekt unterstĂŒtzt die Verwendung von Modellen, die auf der Architektur LLaMA (Large Language Model Meta AI) basieren, die von Meta vorgeschlagen wurde. Das vollstĂ€ndige LLaMA-Modell umfasst 65 Milliarden Parameter, aber fĂŒr ChatLLaMA wird empfohlen, Varianten mit 7 und 13 Milliarden Parametern oder Modelle wie GPTJ (6 Mrd.), GPTNeoX (1,3 Mrd.), 20BOPT (13 Mrd.), BLOOM (7,1 Mrd.) und Galactica (6,7 Mrd.) zu verwenden. UrsprĂŒnglich werden LLaMA-Modelle nur auf spezielle Anfrage an Forscher ausgeliefert, aber da Torrents zum Datentransfer verwendet wurden, haben Enthusiasten ein Skript vorbereitet, das es jedem ermöglicht, das Modell herunterzuladen.

Quelle: opennet.ru

60GB SSD 8Gb DDR4