
Der Raucher-Wasserfall und der Wasserfall des gesunden Menschen
Wir alle wissen, wie man eine Eule zeichnet. Man beginnt mit einer ovalen Form, fĂŒgt einen weiteren Kreis hinzu, und dann erhĂ€lt man eine prĂ€chtige Eule. NatĂŒrlich ist das ein Scherz, und ein sehr alter zudem, aber die Ingenieure von Nvidia haben es geschafft, die Vorstellungskraft zur RealitĂ€t werden zu lassen.
, die GauGAN genannt wird, erzeugt wunderschöne Landschaften aus sehr einfachen Skizzen (wirklich einfach â Kreise, Linien und das war's). NatĂŒrlich basiert diese Entwicklung auf modernen Technologien, genauer gesagt auf generativen, gegnerischen Neuronalen Netzen.
GauGAN ermöglicht es, lebendige virtuelle Welten zu schaffen â und das nicht nur zur Unterhaltung, sondern auch fĂŒr die Arbeit. So können Architekten, Landschaftsarchitekten und Spielentwickler â sie alle können etwas NĂŒtzliches mitnehmen. Die kĂŒnstliche Intelligenz âverstehtâ auf Anhieb, was der Mensch will, und ergĂ€nzt die ursprĂŒngliche Idee mit einer FĂŒlle von Details.
âDas Brainstorming zur Designentwicklung fĂ€llt mit der Hilfe von GauGAN deutlich leichter, da der intelligente Pinsel die ursprĂŒngliche Skizze mit hochwertigen Bildern ergĂ€nzen kannâ, erklĂ€rte einer der Entwickler von GauGAN.
Benutzer dieses Werkzeugs können das ursprĂŒngliche Konzept verĂ€ndern, die Landschaft oder andere Bilder modifizieren, Himmel, Sand, Meer und mehr hinzufĂŒgen. Alles, was das Herz begehrt, und das HinzufĂŒgen dauert nur ein paar Sekunden.
Das neuronale Netzwerk wurde mit einer Datenbank von Millionen Bildern trainiert. Dadurch kann das System verstehen, was der Mensch möchte und wie es das GewĂŒnschte erreichen kann. Dabei vergisst das neuronale Netzwerk die kleinsten Details nicht. Wenn man zum Beispiel schematisch einen Teich und einige BĂ€ume daneben zeichnet, werden beim Beleben der Landschaft alle nahen Objekte auf der WasseroberflĂ€che des Teiches reflektiert.
Das System erlaubt es, die SichtoberflĂ€che anzugeben â sie kann mit Gras, Schnee, Wasser oder Sand bedeckt sein. All dies kann innerhalb von Sekunden umgewandelt werden, sodass Schnee zu Sand wird und anstelle einer verschneiten Einöde der KĂŒnstler eine WĂŒstenlandschaft erhĂ€lt.
âEs ist wie ein Malbuch, das zeigt, wo der Baum, die Sonne und der Himmel platziert werden sollten. Danach erweckt das neuronale Netzwerk das Bild zum Leben, fĂŒgt notwendige Details und Texturen hinzu und zeichnet Reflexionen nach. All dies basiert auf realen Bildernâ, sagt einer der Entwickler.

Obwohl das System nicht ĂŒber ein âVerstĂ€ndnisâ der realen Welt verfĂŒgt, entstehen beeindruckende Landschaften. Das liegt daran, dass hier zwei neuronale Netzwerke verwendet werden: ein Generator und ein Diskriminator. Der Generator erstellt das Bild und zeigt es dem Diskriminator. Dieser wĂ€hlt basierend auf Millionen zuvor gesehener Bilder die realistischsten Varianten aus.
Genau deshalb âweiĂâ der Generator, wo die Reflexionen sein mĂŒssen. Es ist bemerkenswert, dass das Werkzeug Ă€uĂerst flexibel ist und mit einer Vielzahl von Einstellungen ausgestattet ist. So kann man mit ihm GemĂ€lde erstellen, die dem Stil eines bestimmten KĂŒnstlers entsprechen, oder einfach mit der schnellen HinzufĂŒgung von Sonnenauf- oder -untergĂ€ngen experimentieren.
Die Entwickler behaupten, dass das System nicht einfach Bilder irgendwoher nimmt, sie zusammenfĂŒgt und ein Ergebnis erhĂ€lt. Nein, alle erzeugten "Bilder" sind generiert. Das bedeutet, dass das neuronale Netz "kreativ" wird, wie ein echter KĂŒnstler (oder sogar besser).
Zurzeit gibt es die Software noch nicht im freien Zugang, aber bald wird sie ausprobiert werden können. Dies wird auf der technologischen Ausstellung der GPU Technology Conference 2019 möglich sein, die derzeit in Kalifornien stattfindet. GlĂŒckliche Menschen, die die Ausstellung besuchen konnten, haben bereits die Möglichkeit, GauGAN zu testen.
Neuronale Netze werden schon lange darauf trainiert, am kreativen Prozess teilzunehmen. Zum Beispiel konnten einige von ihnen AuĂerdem haben Entwickler von DeepMind ein neuronales Netz trainiert, um dreidimensionale RĂ€ume und Objekte anhand von Zeichnungen, Fotos und Skizzen wiederherzustellen. Um eine einfache Figur zu rekonstruieren, genĂŒgt dem neuronalen Netz ein einziges Bild; fĂŒr die Erstellung komplexerer Objekte sind fĂŒnf Bilder zur "Schulung" erforderlich.
GauGAN wird mit Sicherheit kommerzielle Anwendungen finden â viele GeschĂ€fts- und Wissenschaftsbereiche benötigen derartige Dienste.
Quelle: habr.com
