NeurIPS 2019: ML-Trends, die uns im nÀchsten Jahrzehnt begleiten werden

NeurIPS (Neural Information Processing Systems) – die grĂ¶ĂŸte Konferenz der Welt fĂŒr maschinelles Lernen und kĂŒnstliche Intelligenz sowie das wichtigste Ereignis im Bereich Deep Learning.

Werden wir, die DS-Ingenieure, im neuen Jahrzehnt auch Biologie, Linguistik, Psychologie erlernen? DarĂŒber berichten wir in unserem Überblick.

NeurIPS 2019: ML-Trends, die uns im nÀchsten Jahrzehnt begleiten werden

In diesem Jahr versammelte die Konferenz mehr als 13.500 Teilnehmer aus 80 LĂ€ndern in Vancouver (Kanada). Die Sberbank vertritt Russland seit mehreren Jahren auf der Konferenz – das DS-Team berichtete ĂŒber die Implementierung von ML in Bankprozesse, ĂŒber einen ML-Wettbewerb und ĂŒber die Möglichkeiten der Sberbank DS-Plattform. Was waren die wichtigsten Trends des Jahres 2019 in der ML-Community? Das berichten die Teilnehmer der Konferenz: Andrei Chertok und Tatjana Schavrina.

In diesem Jahr wurden auf NeurIPS mehr als 1400 BeitrĂ€ge angenommen – Algorithmen, neue Modelle und neue Anwendungen fĂŒr neue Daten. Link zu allen Materialien

Inhalt:

  • Trends
    • Interpretierbarkeit von Modellen
    • MultidisziplinaritĂ€t
    • Reasoning
    • RL
    • GAN
  • HauptvortrĂ€ge
    • „Soziale Intelligenz“, Blaise Aguera y Arcas (Google)
    • „Veridical Data Science“, Bin Yu (Berkeley)
    • „Modellierung menschlichen Verhaltens mit maschinellem Lernen: Chancen und Herausforderungen“, Nuria M Oliver, Albert Ali Salah
    • „Von System 1 zu System 2 Deep Learning“, Yoshua Bengio

Trends 2019

1. Interpretierbarkeit von Modellen und neue Methodologie im ML

Das Hauptthema der Konferenz ist die Interpretation und die Beweise, warum wir bestimmte Ergebnisse erzielen. Man kann lange ĂŒber die philosophische Wichtigkeit der Interpretation des „Schwarzen Kastens“ nachdenken, aber es gab mehr praktische Methoden und technische Entwicklungen in diesem Bereich.

Die Methodologie der Reproduzierbarkeit von Modellen und der Wissensgewinnung aus ihnen ist ein neues Werkzeug der Wissenschaft. Modelle können als Instrument zur Gewinnung und ÜberprĂŒfung neuen Wissens dienen, wobei jeder Schritt der Datenvorverarbeitung, des Lernens und der Anwendung des Modells reproduzierbar sein sollte.
Ein wesentlicher Teil der Veröffentlichungen widmet sich nicht dem Aufbau von Modellen und Werkzeugen, sondern den Problemen der Sicherheit, Transparenz und ÜberprĂŒfbarkeit der Ergebnisse. Insbesondere gibt es einen separaten Stream zu Angriffen auf Modelle (adversarial attacks), bei dem sowohl Angriffe auf das Training als auch Angriffe auf die Anwendung betrachtet werden.

Artikel:

NeurIPS 2019: ML-Trends, die uns im nÀchsten Jahrzehnt begleiten werden
ExBert.net zeigt die Interpretation von Modellen fĂŒr Textverarbeitungsaufgaben

2. MultidisziplinaritÀt

Um eine zuverlĂ€ssige PrĂŒfung zu gewĂ€hrleisten und Mechanismen zur PrĂŒfung und Erweiterung von Wissen zu entwickeln, sind Fachleute aus verwandten Bereichen erforderlich, die gleichzeitig ĂŒber Kompetenzen in ML und im Fachgebiet (Medizin, Linguistik, Neurobiologie, Bildung usw.) verfĂŒgen. Besonders hervorzuheben ist die verstĂ€rkte PrĂ€senz von Arbeiten und VortrĂ€gen ĂŒber Neurowissenschaften und kognitive Wissenschaften – es findet eine AnnĂ€herung der Fachleute und eine Übernahme von Ideen statt.

Neben dieser AnnÀherung zeichnen sich multidisziplinÀre AnsÀtze in der gemeinsamen Verarbeitung von Informationen aus verschiedenen Quellen ab: Text und Foto, Text und Spiele, Graphdatenbanken + Text und Foto.

Artikel:

NeurIPS 2019: ML-Trends, die uns im nÀchsten Jahrzehnt begleiten werden
Zwei Modelle — Stratege und ausfĂŒhrender Spieler — basierend auf RL und NLP spielen ein Online-Strategie-Spiel

3. Schlussfolgerung

StĂ€rkung der kĂŒnstlichen Intelligenz – ein Schritt in Richtung selbstlernender Systeme, die 'bewusst', schlussfolgernd und argumentierend sind. Insbesondere entwickelt sich die kausale Inferenz und das gesunde Menschenverstand-Reasoning. Ein Teil der VortrĂ€ge ist dem Meta-Lernen gewidmet (darĂŒber, wie man lernen lernt) und der Verbindung von DL-Technologien mit Logik erster und zweiter Ordnung — der Begriff der Artificial General Intelligence (AGI) wird zunehmend in den PrĂ€sentationen verwendet.

Artikel:

4. VerstÀrkendes Lernen

Der Großteil der Arbeiten konzentriert sich weiterhin auf traditionelle Bereiche des RL — DOTA2, Starcraft, die Verbindung von Architekturen mit Computer Vision, NLP, graphenbasierten Datenbanken.

Ein ganzer Tag der Konferenz war dem RL-Workshop gewidmet, auf dem die Architektur des Optimistic Actor Critic Model vorgestellt wurde, das alle vorherigen Modelle ĂŒbertrifft, insbesondere das Soft Actor Critic.

Artikel:

NeurIPS 2019: ML-Trends, die uns im nÀchsten Jahrzehnt begleiten werden
StarCraft-Spieler kÀmpfen gegen das Alphastar-Modell (DeepMind)

5. GAN

Generative Netze stehen immer noch im Fokus: viele Arbeiten nutzen Vanilla GANs fĂŒr mathematische Beweise und wenden sie in neuen, ungewöhnlichen Varianten an (graphenbasierte generative Modelle, Arbeiten mit Zeitreihen, Anwendung auf Kausalbeziehungen in Daten usw.).

Artikel:

Seit mehr als 1400 werden wir die wichtigsten PrÀsentationen vorstellen.

EinladungsvortrÀge

„Soziale Intelligenz“, Blaise Aguera y Arcas (Google)

Link
Folien und Videos
Der Vortrag widmet sich der allgemeinen Methodologie des maschinellen Lernens und den Perspektiven, die die Industrie gerade jetzt verĂ€ndern – an welcher Weggabelung stehen wir? Wie funktioniert das Gehirn und die Evolution, und warum nutzen wir so wenig von dem, was wir bereits ĂŒber die Entwicklung natĂŒrlicher Systeme wissen?

Die industrielle Entwicklung von ML stimmt in vielerlei Hinsicht mit den Meilensteinen der Entwicklung von Google ĂŒberein, das Jahr fĂŒr Jahr seine Forschungsarbeiten auf NeurIPS veröffentlicht:

  • 1997 – EinfĂŒhrung von Suchleistungen, erste Server, geringe Rechenleistung
  • 2010 – Jeff Dean startet das Google Brain-Projekt, Boom der neuronalen Netze ganz zu Anfang
  • 2015 – industrielle Implementierung von neuronalen Netzen, schnelle Gesichtserkennung direkt auf dem lokalen GerĂ€t, Low-Level-Prozessoren, spezialisiert auf Tensorberechnungen – TPU. Google startet Coral ai – eine Variante von Raspberry Pi, ein Mini-Computer zur Implementierung neuronaler Netze in experimentellen Anwendungen.
  • 2017 – Google beginnt mit der Entwicklung des dezentralisierten Lernens und der Kombination von Lernergebnissen von neuronalen Netzen auf verschiedenen GerĂ€ten zu einem Modell – auf Android.

Heute beschĂ€ftigt sich eine ganze Branche mit Fragen der Datensicherheit, der ZusammenfĂŒhrung und der Reproduktion von Lernergebnissen auf lokalen GerĂ€ten.

Federated Learning – ein Bereich des ML, in dem einzelne Modelle unabhĂ€ngig voneinander lernen und dann in ein einheitliches Modell kombiniert werden (ohne Zentralisierung der Ausgangsdaten), unter BerĂŒcksichtigung seltener Ereignisse, Anomalien, Personalisierung usw. Alle Android-GerĂ€te fungieren im Wesentlichen als ein einziger computergestĂŒtzter Supercomputer fĂŒr Google.

Generative Modelle auf Basis von federated learning – eine vielversprechende Richtung aus Googles Sicht, die sich "in den frĂŒhen Phasen exponentiellen Wachstums" befindet. GANs sind laut dem Vortragenden in der Lage, das Massverhalten von Populationen lebender Organismen zu lernen sowie Denkalgorithmen.

Anhand von zwei einfachen GAN-Architekturen wird gezeigt, dass die Suche nach einem Optimierungsweg im Kreis verlĂ€uft, sodass eine tatsĂ€chliche Optimierung nicht stattfindet. Diese Modelle hingegen simulieren sehr erfolgreich die Experimente, die Biologen mit Bakterienpopulationen durchfĂŒhren, indem sie diese dazu bringen, neue Verhaltensstrategien auf der Suche nach Nahrung zu lernen. Daraus lĂ€sst sich schließen, dass das Leben anders funktioniert als eine Optimierungsfunktion.

NeurIPS 2019: ML-Trends, die uns im nÀchsten Jahrzehnt begleiten werden
Umherirrende Optimierung von GAN

Alles, was wir derzeit im Bereich des maschinellen Lernens tun, sind eng umrissene und stark formalisierte Aufgaben, wĂ€hrend diese Formalismen schlecht verallgemeinerbar sind und nicht mit unserem Fachwissen in Bereichen wie Neurophysiologie und Biologie ĂŒbereinstimmen.

Was wir in naher Zukunft wirklich aus der Neurophysiologie ĂŒbernehmen sollten, sind neue neuronale Architekturen und eine ÜberprĂŒfung der Mechanismen des rĂŒckpropagierten Fehlers.

Das menschliche Gehirn selbst lernt nicht wie ein neuronales Netzwerk:

  • Es hat keine zufĂ€lligen primĂ€ren Eingaben, einschließlich derjenigen, die ĂŒber die Sinne und in der Kindheit geprĂ€gt wurden.
  • Es gibt angelegte Richtungen der instinctiven Entwicklung (das Verlangen eines SĂ€uglings, eine Sprache zu lernen, aufrechtes Gehen).

Das Training des individuellen Gehirns ist eine niedrigstufige Aufgabe. Möglicherweise sollten wir "Kolonien" schnell wechselnder Individuen betrachten, die Wissen austauschen, um Mechanismen der Gruppenevolution zu reproduzieren.

Was wir bereits jetzt in ML-Algorithmen ĂŒbernehmen können:

  • Anwendung von Zelllinienmodellen, die das Lernen der Population ermöglichen, jedoch mit einer kurzen Lebensdauer des Individuums (des "individuellen Gehirns").
  • Few-shot Learning mit einer begrenzten Anzahl an Beispielen.
  • Komplexere neuronale Strukturen und etwas andere Aktivierungsfunktionen.
  • Übertragung des "Genoms" an die nĂ€chsten Generationen – der Algorithmus des RĂŒckpropagierungsfehlers.
  • Sobald wir Neurophysiologie und neuronale Netzwerke verbinden, werden wir lernen, ein multifunktionales Gehirn aus vielen Komponenten zu konstruieren.

Aus dieser Perspektive betrachten die praktischen SOTA-Lösungen als schĂ€dlich und sollten zugunsten der Entwicklung gemeinsamer Aufgaben (Benchmarks) ĂŒberdacht werden.

„Veridical Data Science“, Bin Yu (Berkeley)

Videos und Folien
Der Bericht behandelt die Problematik der Interpretation von Machine-Learning-Modellen und der Methodologie ihrer direkten PrĂŒfung und Verifizierung. Jedes trainierte ML-Modell kann als Wissensquelle betrachtet werden, aus der Erkenntnisse gewonnen werden mĂŒssen.

In vielen Bereichen, insbesondere in der Medizin, ist die Anwendung eines Modells ohne die Extraktion dieser verborgenen Kenntnisse und die Interpretation der Modellresultate unmöglich – andernfalls können wir uns nicht sicher sein, dass die Ergebnisse stabil, nicht zufĂ€llig, zuverlĂ€ssig sind und keinen Patienten gefĂ€hrden. Ein ganzes Methodologiefeld entwickelt sich innerhalb der Deep-Learning-Paradigmatik und geht darĂŒber hinaus – veridical data science. Was ist das?

Wir streben an, eine solche QualitÀt wissenschaftlicher Veröffentlichungen und Reproduzierbarkeit von Modellen zu erreichen, dass sie folgende Eigenschaften aufweisen:

  1. vorhersagbar
  2. berechenbar
  3. stabil

Diese drei Prinzipien bilden die Grundlage einer neuen Methodologie. Wie kann man ML-Modelle auf Übereinstimmung mit diesen Kriterien testen? Der einfachste Weg ist, von Anfang an interpretierbare Modelle (Regressionen, EntscheidungsbĂ€ume) zu bauen. Dennoch möchten wir auch die unmittelbaren Vorteile des Deep Learning nutzen.

Einige bestehende AnsÀtze zur Lösung des Problems sind:

  1. das Modell interpretieren;
  2. Methoden verwenden, die auf Attention basieren;
  3. Ensembles von Algorithmen beim Training einsetzen und sicherstellen, dass lineare, interpretierbare Modelle lernen, dieselben Antworten vorherzusagen wie neuronale Netze, indem sie Merkmale aus dem linearen Modell interpretieren;
  4. Daten fĂŒr das Training Ă€ndern und augmentieren. Dazu gehören das HinzufĂŒgen von Rauschen, Störungen und Data Augmentation;
  5. Alle Methoden, die sicherstellen, dass die Ergebnisse des Modells nicht zufĂ€llig und nicht von kleinen unerwĂŒnschten Störungen (Adversarial Attacks) abhĂ€ngig sind;
  6. Das Modell post-faktum interpretieren, nach dem Training;
  7. Die Gewichtungen der Merkmale auf verschiedene Weise untersuchen;
  8. Die Wahrscheinlichkeiten aller Hypothesen und die Verteilung der Klassen untersuchen.

NeurIPS 2019: ML-Trends, die uns im nÀchsten Jahrzehnt begleiten werden
Adversarial attack auf das Schwein

Modellierungsfehler kosten alle viel: Ein markantes Beispiel ist die Arbeit von Reinhardt und Rogoff "Growth in a time of debt" beeinflusste die Wirtschaftspolitik vieler europĂ€ischer LĂ€nder und zwang sie zu einer Sparpolitik, aber eine sorgfĂ€ltige NachprĂŒfung der Daten und ihrer Verarbeitung viele Jahre spĂ€ter zeigt ein gegenteiliges Ergebnis!

Jede ML-Technologie hat ihren Lebenszyklus von der Implementierung bis zur EinfĂŒhrung. Die Aufgabe der neuen Methodologie besteht darin, die ÜberprĂŒfung nach drei grundlegenden Prinzipien in jeder Phase des Modelllebenszyklus vorzunehmen.

Zusammenfassung:

  • Es laufen mehrere Projekte, die helfen werden, ML-Modelle zuverlĂ€ssiger zu machen. Zum Beispiel deeptune (link to: github.com/ChrisCummins/paper-end2end-dl);
  • FĂŒr die weitere Entwicklung der Methodologie muss die QualitĂ€t der Veröffentlichungen im Bereich ML erheblich gesteigert werden;
  • Maschinenlernen benötigt FĂŒhrungspersönlichkeiten mit multidisziplinĂ€rer Ausbildung und Expertise sowohl in technischen als auch in geisteswissenschaftlichen Bereichen.

„Modellierung menschlichen Verhaltens mit maschinellem Lernen: Chancen und Herausforderungen“ Nuria M Oliver, Albert Ali Salah

Eine Vorlesung ĂŒber die Modellierung menschlichen Verhaltens, deren technologische Grundlagen und Anwendungsmöglichkeiten.

Die Modellierung menschlichen Verhaltens kann unterteilt werden in:

  • individuelles Verhalten
  • Verhalten kleiner Gruppen
  • kollektives Verhalten

Jeder dieser Typen kann mit ML modelliert werden, jedoch mit absolut unterschiedlichen Eingabedaten und Merkmalen. Jeder Typ hat auch seine eigenen ethischen Probleme, die jedes Projekt durchlÀuft:

  • individuelles Verhalten – IdentitĂ€tsdiebstahl, Deepfake;
  • Verhalten von Gruppen – De-Anonymisierung, Informationsbeschaffung ĂŒber Bewegungen, Telefonanrufe usw.;

Individuelles Verhalten

Bezieht sich hauptsĂ€chlich auf das Thema Computer Vision – Erkennung menschlicher Emotionen und Reaktionen. Möglich nur im Kontext, zeitlich oder relativ zu seiner eigenen VariabilitĂ€t der Emotionen. Auf der Folie – Erkennung der Emotionen der Mona Lisa mithilfe des Kontexts aus dem emotionalen Spektrum mediterraner Frauen. Ergebnis: ein LĂ€cheln der Freude, jedoch mit Verachtung und Ekel. Der Grund liegt wahrscheinlich in der technischen Bestimmung der 'neutralen' Emotion.

Verhalten einer kleinen Gruppe von Personen

Wird derzeit am schlechtesten modelliert aufgrund unzureichender Informationen. Als Beispiel wurden Arbeiten aus den Jahren 2018 – 2019 an Dutzenden von Personen ĂŒber Dutzende von Videos gezeigt (vgl. BilddatensĂ€tze 100k++). FĂŒr die beste Modellierung in diesem Rahmen ist multimodale Information erforderlich, idealerweise von Sensoren wie Altimeter, Thermometer, Mikrofonaufnahmen usw.

Massenverhalten

Das am weitesten entwickelte Gebiet, da die Auftraggeber die UNO und viele Staaten sind. Überwachungskameras, Daten von Mobilfunkmasten – Abrechnung, SMS, Anrufe, Daten ĂŒber Bewegungen zwischen den Grenzen der Staaten – all dies gibt ein sehr zuverlĂ€ssiges Bild ĂŒber die Bewegungen von Menschenströmen und soziale Unruhen. Potenzielle Anwendungen der Technologie: Optimierung von Rettungsoperationen, UnterstĂŒtzung und rechtzeitige Evakuierung der Bevölkerung bei NotfĂ€llen. Die verwendeten Modelle sind bisher meist schlecht interpretierbar – es handelt sich um verschiedene LSTM- und Convolutional-Netzwerke. Es gab eine kurze Anmerkung, dass die UNO ein neues Gesetz lobbyiert, das europĂ€ische Unternehmen verpflichtet, anonymisierte Daten, die fĂŒr jegliche Forschungen erforderlich sind, zu teilen.

„Von System 1 zu System 2 Deep Learning“, Yoshua Bengio

Folien
In der Vorlesung von Yoshua Bengio trifft Deep Learning auf Neurowissenschaften auf der Ebene der Zielsetzung.
Bengio hebt zwei Haupttypen von Aufgaben nach der Methodologie des NobelpreistrĂ€gers Daniel Kahneman hervor (Buch „Schnelles Denken, langsames Denken» )
Typ 1 – System 1, unbewusste Handlungen, die wir „automatisch“ ausfĂŒhren (das alte Gehirn): Autofahren auf vertrauten Strecken, Gehen, Gesichtserkennung.
Typ 2 — System 2, bewusstes Handeln (Großhirnrinde), Zielsetzung, Analyse, Denken, komplexe Aufgaben.

KI erreicht bisher nur in Aufgaben des ersten Typs ausreichende Höhen — wĂ€hrend unser Ziel darin besteht, sie zum zweiten zu fĂŒhren, indem wir sie lehren, multidisziplinĂ€re Operationen durchzufĂŒhren und mit Logik sowie hochrangigen kognitiven FĂ€higkeiten zu operieren.

Zur Erreichung dieses Ziels wird vorgeschlagen:

  1. In NLP-Aufgaben attention als SchlĂŒsselmechanismus zur Modellierung des Denkens zu verwenden.
  2. Meta-Learning und Representation Learning fĂŒr ein besseres Modellieren der Merkmale zu nutzen, die das Bewusstsein beeinflussen, und deren Lokalisierung – um auf dieser Basis zu hochrangigen Konzepten ĂŒberzuleiten.

Statt eines Schlusses hinterlassen wir eine Aufzeichnung des eingeladenen Vortrags: Bengio ist einer von vielen Wissenschaftlern, die versuchen, das Gebiet des ML ĂŒber Optimierungsprobleme, SOTA und neue Architekturen hinaus zu erweitern.
Die Frage bleibt offen, inwieweit die Verbindung von Problemen des Bewusstseins, dem Einfluss der Sprache auf das Denken, der Neurowissenschaft und Algorithmen das ist, was uns in Zukunft erwartet und uns zu Maschinen fĂŒhren wird, die "denken" wie Menschen.

Danke!

Video abspielen


Quelle: habr.com
Erwerben Sie zuverlĂ€ssiges Hosting fĂŒr Websites mit DDoS-Schutz, VPS VDS-Server đŸ”„ Kaufen Sie zuverlĂ€ssiges Hosting fĂŒr Websites mit DDoS-Schutz, VPS VDS-Server | ProHoster