Nvidias Neuronetz verwandelt einfache Skizzen in atemberaubende Landschaften

Nvidias Neuronetz verwandelt einfache Skizzen in atemberaubende Landschaften
Der Raucher-Wasserfall und der Wasserfall des gesunden Menschen

Wir alle wissen, wie man eine Eule zeichnet. Man beginnt mit einer ovalen Form, fügt einen weiteren Kreis hinzu, und dann erhält man eine prächtige Eule. Natürlich ist das ein Scherz, und ein sehr alter zudem, aber die Ingenieure von Nvidia haben es geschafft, die Vorstellungskraft zur Realität werden zu lassen.

Die neue Entwicklung, die GauGAN genannt wird, erzeugt wunderschöne Landschaften aus sehr einfachen Skizzen (wirklich einfach – Kreise, Linien und das war's). Natürlich basiert diese Entwicklung auf modernen Technologien, genauer gesagt auf generativen, gegnerischen Neuronalen Netzen.

GauGAN ermöglicht es, lebendige virtuelle Welten zu schaffen – und das nicht nur zur Unterhaltung, sondern auch für die Arbeit. So können Architekten, Landschaftsarchitekten und Spielentwickler – sie alle können etwas Nützliches mitnehmen. Die künstliche Intelligenz „versteht“ auf Anhieb, was der Mensch will, und ergänzt die ursprüngliche Idee mit einer Fülle von Details.

„Das Brainstorming zur Designentwicklung fällt mit der Hilfe von GauGAN deutlich leichter, da der intelligente Pinsel die ursprüngliche Skizze mit hochwertigen Bildern ergänzen kann“, erklärte einer der Entwickler von GauGAN.

Benutzer dieses Werkzeugs können das ursprüngliche Konzept verändern, die Landschaft oder andere Bilder modifizieren, Himmel, Sand, Meer und mehr hinzufügen. Alles, was das Herz begehrt, und das Hinzufügen dauert nur ein paar Sekunden.

Das neuronale Netzwerk wurde mit einer Datenbank von Millionen Bildern trainiert. Dadurch kann das System verstehen, was der Mensch möchte und wie es das Gewünschte erreichen kann. Dabei vergisst das neuronale Netzwerk die kleinsten Details nicht. Wenn man zum Beispiel schematisch einen Teich und einige Bäume daneben zeichnet, werden beim Beleben der Landschaft alle nahen Objekte auf der Wasseroberfläche des Teiches reflektiert.

Das System erlaubt es, die Sichtoberfläche anzugeben — sie kann mit Gras, Schnee, Wasser oder Sand bedeckt sein. All dies kann innerhalb von Sekunden umgewandelt werden, sodass Schnee zu Sand wird und anstelle einer verschneiten Einöde der Künstler eine Wüstenlandschaft erhält.

„Es ist wie ein Malbuch, das zeigt, wo der Baum, die Sonne und der Himmel platziert werden sollten. Danach erweckt das neuronale Netzwerk das Bild zum Leben, fügt notwendige Details und Texturen hinzu und zeichnet Reflexionen nach. All dies basiert auf realen Bildern“, sagt einer der Entwickler.

Video abspielen

Obwohl das System nicht über ein „Verständnis“ der realen Welt verfügt, entstehen beeindruckende Landschaften. Das liegt daran, dass hier zwei neuronale Netzwerke verwendet werden: ein Generator und ein Diskriminator. Der Generator erstellt das Bild und zeigt es dem Diskriminator. Dieser wählt basierend auf Millionen zuvor gesehener Bilder die realistischsten Varianten aus.

Genau deshalb „weiß“ der Generator, wo die Reflexionen sein müssen. Es ist bemerkenswert, dass das Werkzeug äußerst flexibel ist und mit einer Vielzahl von Einstellungen ausgestattet ist. So kann man mit ihm Gemälde erstellen, die dem Stil eines bestimmten Künstlers entsprechen, oder einfach mit der schnellen Hinzufügung von Sonnenauf- oder -untergängen experimentieren.

Die Entwickler behaupten, dass das System nicht einfach Bilder irgendwoher nimmt, sie zusammenfügt und ein Ergebnis erhält. Nein, alle erzeugten "Bilder" sind generiert. Das bedeutet, dass das neuronale Netz "kreativ" wird, wie ein echter Künstler (oder sogar besser).

Zurzeit gibt es die Software noch nicht im freien Zugang, aber bald wird sie ausprobiert werden können. Dies wird auf der technologischen Ausstellung der GPU Technology Conference 2019 möglich sein, die derzeit in Kalifornien stattfindet. Glückliche Menschen, die die Ausstellung besuchen konnten, haben bereits die Möglichkeit, GauGAN zu testen.

Neuronale Netze werden schon lange darauf trainiert, am kreativen Prozess teilzunehmen. Zum Beispiel konnten einige von ihnen 3D-Modelle erstellen.Außerdem haben Entwickler von DeepMind ein neuronales Netz trainiert, um dreidimensionale Räume und Objekte anhand von Zeichnungen, Fotos und Skizzen wiederherzustellen. Um eine einfache Figur zu rekonstruieren, genügt dem neuronalen Netz ein einziges Bild; für die Erstellung komplexerer Objekte sind fünf Bilder zur "Schulung" erforderlich.

GauGAN wird mit Sicherheit kommerzielle Anwendungen finden – viele Geschäfts- und Wissenschaftsbereiche benötigen derartige Dienste.

Quelle: habr.com

Zuverlässiges Webhosting mit DDoS-Schutz, VPS- und VDS-Server kaufen 🔥 Zuverlässiges Webhosting mit DDoS-Schutz, VPS- und VDS-Server kaufen | ProHoster