
Wodospad palacza i wodospad zdrowego człowieka
Wszyscy wiemy, jak narysować sowę. Najpierw trzeba narysować owal, potem kolejny okrąg, a potem – wychodzi wspaniała sowa. Oczywiście, to żart, a nawet bardzo stary, ale inżynierowie Nvidii starali się sprawić, aby fantazja stała się rzeczywistością.
, która nazywa się GauGAN, tworzy wspaniałe krajobrazy z bardzo prostych szkiców (naprawdę prostych – okręgów, linii i tym podobnych). Oczywiście, u podstaw tej technologii leżą nowoczesne technologie – a mianowicie generatywne sieci przeciwników.
GauGAN pozwala na tworzenie kolorowych wirtualnych światów – i to nie tylko dla zabawy, ale także do pracy. Tak, architekci, specjaliści od projektowania krajobrazu, twórcy gier – wszyscy oni mogą czerpać coś pożytecznego. Sztuczna inteligencja od razu „rozumie”, czego chce człowiek i uzupełnia początkową ideę ogromną ilością szczegółów.
„Burza mózgów w zakresie projektowania jest znacznie łatwiejsza z pomocą GauGAN, ponieważ inteligentny pędzel może uzupełnić pierwotny szkic, dodając wysokiej jakości obrazy” – powiedział jeden z deweloperów GauGAN.
Użytkownicy tego narzędzia mogą zmieniać pierwotny zamysł, modyfikować krajobraz lub inny obraz, dodawać niebo, piaski, morze itp. Wszystko, co im się podoba, a dodawanie odbywa się w zaledwie kilka sekund.
Sieć neuronowa została wytrenowana z użyciem bazy zawierającej miliony obrazów. Dzięki temu system może zrozumieć, czego chce człowiek i jak osiągnąć pożądany efekt. A sieć nie zapomina o najdrobniejszych szczegółach. Tak, jeśli narysujesz schematycznie staw i jakieś drzewa obok niego, to po ożywieniu krajobrazu wszystkie pobliskie obiekty będą odbijać się w lustrze wody stawu.
Systemowi można wskazać, jaka powinna być widoczna powierzchnia – może być pokryta trawą, śniegiem, wodą lub piaskiem. Wszystko to można w sekundę przekształcić, tak aby śnieg stał się piaskiem, a zamiast zaśnieżonej pustyni artysta otrzymał pustynny krajobraz.
„To jak kolorowanka, w której mówi się, gdzie umieścić drzewo, gdzie — słońce, a gdzie — niebo. Następnie, po pierwotnym zadaniu, sieć neuronowa ożywia obraz, dodaje niezbędne detale i tekstury, rysuje odbicia. Wszystko to opiera się na rzeczywistych obrazach” — mówi jeden z deweloperów.

Mimo że systemowi brakuje „zrozumienia” rzeczywistego świata, potrafi on tworzyć imponujące krajobrazy. Wszystko dzięki zastosowaniu dwóch sieci neuronowych, generatora i dyskryminatora. Generator tworzy obraz i pokazuje go dyskryminatorowi, który na podstawie milionów wcześniej widzianych obrazów wybiera najbardziej realistyczne warianty.
Dlatego generator „wie”, gdzie powinny znajdować się odbicia. Warto zauważyć, że narzędzie jest bardzo elastyczne i wyposażone w wiele ustawień. Dzięki niemu można tworzyć obrazy, dostosowując je do stylu konkretnego artysty lub po prostu bawić się szybkim dodawaniem wschodu lub zachodu słońca.
Deweloperzy twierdzą, że system nie po prostu zbiera zdjęcia z różnych źródeł, łączy je i uzyskuje wynik. Nie, wszystkie generowane „obrazki” są stworzone od podstaw. To znaczy, że sieć neuronowa „tworzy”, jak prawdziwy artysta (a nawet lepiej).
Jak na razie program nie jest dostępny publicznie, ale wkrótce będzie można go przetestować w praktyce. Można to zrobić na wystawie technologicznej GPU Technology Conference 2019, która właśnie trwa w Kalifornii. Szczęśliwcy, którzy mieli okazję odwiedzić wystawę, już mogą przetestować GauGAN.
Sieci neuronowe od dawna uczą się uczestniczyć w procesie twórczym. Na przykład, w zeszłym roku niektóre z nich . Ponadto deweloperzy z DeepMind nauczyli sieć neuronową odbudowywać trójwymiarowe przestrzenie i obiekty na podstawie rysunków, zdjęć i szkiców. Aby odtworzyć prostą figurę, sieci neuronowej wystarcza jedno zdjęcie, a do tworzenia bardziej skomplikowanych obiektów potrzeba pięciu zdjęć do „nauki”.
Jeśli chodzi o GauGAN, to narzędzie z pewnością znajdzie godne zastosowanie komercyjne — wiele dziedzin biznesu i nauki ma potrzebę korzystania z takich serwisów.
Źródło: habr.com
