Ich habe neulich einen Artikel gelesen, in dem Mark Zuckerberg Prognosen für das nächste Jahrzehnt abgab. Das Thema Prognosen interessiert mich sehr, ich versuche ebenfalls, in dieser Richtung zu denken. In diesem Artikel äußert er, dass alle zehn Jahre eine Veränderung der technologischen Plattform stattfindet. In den 90ern war es der Personal Computer, in den 2000ern das Internet und in den 2010ern das Smartphone. Für die 2020er Jahre erwartet er, dass die nächste Plattform die virtuelle Realität sein wird. Damit kann ich nur teilweise übereinstimmen. Und das aus folgendem Grund…

Eine Person mit einer Virtual-Reality-Brille sieht lächerlich aus. Man kann sie nur zu Hause und nur in vertrauter Umgebung mit verständnisvollen Menschen verwenden. Daher ist die rein virtuelle Realität keine Option für uns. Die Erweiterte Realität hingegen ist bereits interessanter. Aber dazu später.
Dennoch möchte ich die technologische Plattform, die ich in den 2020er Jahren als grundlegend erachte, vorstellen. Sie wird auf drei Säulen basieren:
- Sprachsteuerung
- Biometrische Authentifizierung
- Verteiltes Netzwerk von Geräten
Die Sprachassistenten, die derzeit aus allen Ecken hervorlugen, werden früher oder später zu einem qualitativen Sprung in diesem Bereich führen. Ich glaube, dass wir auf eine Art Engine zusteuern werden, die mit Sprachnachrichten und entsprechenden Erweiterungen für jedes Gebiet arbeitet. Genauso wie wir jetzt Bots für Telegram erstellen, werden wir Erweiterungen für Sprachassistenten entwickeln. Und die hypothetische Alisa wird nicht nur den Wecker stellen, sondern auch in der Lage sein, ein Fast-Food-Bestellung nach Diktat in einer App zu machen, die eine API für eine solche Lösung bereitstellt.
Ganz gleich, wie sehr wir Sprachmemos verfluchen, sie werden bald Teil unseres Lebens sein. Messenger-Dienste migrieren nach und nach in die technologische Kette Audio — Text — Übersetzung — Audio. Die Möglichkeit, über Text zu kommunizieren, wird sicherlich bestehen bleiben, aber sie wird nicht mehr dominieren. Eine neue Generation wächst heran, die es nicht mag, Texte zu tippen, aber gerne kommuniziert. Der Nachrichtenformat in Messengern ist zudem bequemer als ein direktes Telefongespräch, da er die Möglichkeit bietet, eine Pause einzulegen. Übrigens wird damit auch die 'Alphabetisierung' in einem großen Maßstab zunehmen, denn das Schreiben wird der Computer übernehmen, der weniger Fehler macht.
Momentan ist die Arbeit mit Sprachmemos jedoch unkomfortabel. Mindestens muss man sein Smartphone herausnehmen, schauen, von wem die Nachricht ist, die Taste für die Anhörung drücken, die Antwort mit dem Mikrofon des Smartphones aufzeichnen und sie dann an den Gesprächspartner senden. Wenn der Sprachassistent eine solche Nachricht in die Ohren liest, wird das bequemer sein. Ob er Audio vorliest oder Text spricht, ist dabei nicht so entscheidend, beides ist gleichwertig.
Aber das Zuhören ist nur die halbe Miete. Hier kommen noch einige weitere Aspekte hinzu. Zum Beispiel die Sicherheit. Wenn wir geschützt sein wollen, sollten wir den Zugang zur Kommunikation nur vertrauenswürdigen Nutzern. Und die Identifizierung kann durch Biometrie erfolgen. Am einfachsten ist es, die Stimme zu nutzen, wenn wir auf eine Nachricht antworten, zum Beispiel.
Ein anderer Aspekt der Sicherheit ist die Privatsphäre. Wenn wir verbal kommunizieren, können uns die Umstehenden hören. Das ist nicht immer angenehm und akzeptabel. Und das ist ein Problem. Bis wir neuronale Schnittstellen erreichen, werden wir in diesem Jahrzehnt nicht viel weiterkommen. Das bedeutet, wir brauchen etwas, das Flüstern, Artikulation oder Lippenbewegungen unterscheiden kann, um daraus eine textliche oder auditive Nachricht zu generieren. Solche neuronalen Netze gibt es bereits.
Ein weiteres Problem sind Lautsprecher, Mikrofon und/oder Kamera. Es wird unbequem, das Smartphone für jede Sprachnachricht herauszuholen und es ständig in der Hand zu tragen. Deshalb sollten Kamera, Mikrofon und Bildschirm des Smartphones in die Nähe von Mund, Ohren und Augen verlagert werden. Willkommen, Google Glass.
Ich erlaube mir einen kleinen lyrischen Abstecher. Erinnern Sie sich an den Newton-PDA oder das Tablet-PC? Solide Konzepte, die jedoch ihrer Zeit voraus waren. Der Tablet-PC erreichte erst mit dem iPad eine breitere Akzeptanz. Darüber sind viele Diskussionen geführt worden, ich möchte mich nicht vertiefen, aber ich stütze mich auf diese Analogie. Ich denke, die Zeit für smarte Brillen ist noch nicht gekommen, aber sie ist bereits nahe. Denn während es bereits Brillen gibt, fehlt es noch an Massenakzeptanz. Für mich habe ich einen solchen Massenakzeptanz-Kriterium definiert: Wenn etwas bereits im gesamten Bekanntenkreis präsent ist und schließlich auch von meinen Eltern gekauft wird. Dann ist es eine Technologie für die Masse. Die heutigen Brillen haben zu viele Kinderkrankheiten, die behoben werden müssen. Ohne diese bleibt ihnen der Zugang zum Markt verwehrt.
Ob es sich um transparente Brillen mit einem Projektor handelt oder um undurchsichtige Brillen mit Bildschirmen — das ist nicht so wichtig. Nur sehen die undurchsichtigen Brillen merkwürdig aus, worüber ich zu Beginn geschrieben habe, daher denke ich nicht, dass die Evolution der Brillen in diese Richtung gehen wird.
Die erweiterte Realität für solche Brillen ist einfach ein Traum. Sobald Algorithmen und die Videoverarbeitung so schnell und gut sind, dass die Projektion in die sichtbare Welt perfekt ist, werden auch die Smartbrillen an der Reihe sein. Wenn die Projektion nicht auf das Brillenglas, sondern auf die Netzhaut erfolgt, umso besser – Anwendungen wie „Alle Frauen nackt zeigen“ und „Alle Informationen über eine Person zeigen“ werden für Popularität sorgen. Reiner Cyberpunk, und er ist bereits nah.
Offensichtlich sind solche Brillen für Autofahrer nicht geeignet – was, wenn sie ausfallen und die Sicht versperren? (Ja, ja. Drohnen werden in den 20er Jahren noch nicht die dominierende Technologie sein, sie werden gerade dieses Jahrzehnt brauchen, um sich durchzusetzen.) Deshalb wird es dabei einen eigenen Sprachassistenten und ein eigenes Projektsystem für die Windschutzscheibe geben. Ansonsten wird alles gleich bleiben – die Möglichkeit, Nachrichten abzuhören und zu senden, und per Sprache zu steuern usw. Dies setzt ein einheitliches Profil auf allen Geräten voraus, was wir bereits erreicht haben. Der einzige Unterschied wird die transparente Authentifizierung anhand von Gesicht, Stimme oder Netzhaut sein.
Ein Sprachassistent als Teil des Smart Home wird ebenfalls in dieses Ökosystem passen, auch wenn er nicht so populär wird wie tragbare Gadgets. Das gleiche gilt für Fitness-Tracker und Smartwatches – sie werden ihre Nische einnehmen und dort bleiben. Tatsächlich ist das schon geschehen.
Im Grunde wird der Aufstieg jeder IT-Technologie davon bestimmt, wie einfach es ist, damit Geld zu verdienen und Pornos anzusehen. Der Markt für Apps für Brillen und Sprachassistenten ist ein neuer Markt; das Geld wird dort fließen, sobald er groß genug ist. Und Augmented-Reality-Brillen sind einfach dafür gemacht, Pornos anzusehen, also meine Prognose: Die Technologie wird durchstarten und einen Trend für das gesamte Jahrzehnt setzen. Lassen Sie uns in 10 Jahren wiedersehen und die Ergebnisse auswerten.
UPD. Ich möchte nochmal auf den hervorgehobenen Punkt oben eingehen. Die Schnittstellen werden im Grunde sprachbasiert, aber nicht laut sein. Um einen Sprachbefehl zu geben, muss man ihn nicht laut aussprechen oder überhaupt aussprechen. Ja, das klingt jetzt seltsam, aber diese Technologien stehen erst am Anfang.
Quelle: habr.com
