
Primero, un poco de historia.
Web 1.0 — es una red para acceder a contenido alojado en sitios por sus propietarios. Páginas html estáticas, acceso a información solo de lectura, la principal alegría — hiperenlaces que llevan a páginas de este y otros sitios. El formato típico de un sitio web es un recurso informativo. La era de transferir contenido offline a la red: digitalización de libros, escaneo de imágenes (las cámaras digitales aún eran raras).
Web 2.0 — una red social que une a las personas. Los usuarios, inmersos en el espacio en línea, crean contenido directamente en las páginas web. Sitios dinámicos interactivos, etiquetado de contenido, sindicación web, tecnología mash-up, AJAX, servicios web. Los recursos informativos dan paso a redes sociales, blogs y wikis. La era de la generación de contenido online.
Está claro que el término "web 1.0" surgió solo después de la aparición de "web 2.0", para designar la anterior internet. Y casi de inmediato comenzaron las conversaciones sobre la futura versión 3.0. Hubo varias visiones de este futuro, y todas, por supuesto, estaban relacionadas con la superación de las deficiencias y limitaciones de web 2.0.
Al director de Netscape.com, Jason Calacanis, le preocupaba ante todo la baja calidad del contenido generado por los usuarios, y sugirió que el futuro de internet pertenecía a "personas talentosas" que comenzarían a "crear contenido de alta calidad" (Web 3.0, definición "oficial", 2007). La idea es bastante razonable, pero no explicó cómo y dónde lo harían, en qué sitios, no sería en Facebook.
El autor del término "web 2.0", Tim O'Reilly, razonablemente sugirió que no es necesario un intermediario tan poco confiable como el ser humano para alojar información en la web. Los dispositivos técnicos también pueden suministrar datos a internet. Y los mismos dispositivos técnicos pueden leer datos directamente de los almacenes web. De hecho, Tim O'Reilly propuso asociar web 3.0 con el término ya familiar para nosotros, "internet de las cosas".
Uno de los fundadores de la World Wide Web, Tim Berners-Lee, vio en la futura versión de Internet la realización de su antigua (1998) sueño sobre la web semántica. Y su interpretación del término triunfó: la mayoría de quienes mencionaban “web 3.0” hasta hace poco en realidad se referían a la web semántica, es decir, una red en la que el contenido de las páginas web fuera significativo para las computadoras, legible por máquinas. Alrededor de 2010-2012 se hablaba mucho de ontologización, se generaron numerosos proyectos semánticos, pero el resultado es conocido por todos: aún utilizamos Internet versión 2.0. En esencia, solo sobrevivieron la etiqueta semántica Schema.org y los grafos de conocimiento de los gigantes de Internet como Google, Microsoft, Facebook, LinkedIn.
Las nuevas y poderosas olas de innovaciones digitales ayudaron a ocultar el fracaso de la web semántica. El interés de la prensa y de los ciudadanos se volvió hacia los grandes datos, el Internet de las cosas, el aprendizaje profundo, los drones, la realidad aumentada y, por supuesto, la blockchain. Si los primeros de la lista son en su mayoría tecnologías offline, la blockchain es un proyecto netamente en red. En el apogeo de su popularidad, entre 2017 y 2018, incluso aspiraba a convertirse en el nuevo Internet (una idea que fue repetidamente expresada por uno de los fundadores de Ethereum, Joseph Lubin).
Pero pasó el tiempo, y la palabra “blockchain” comenzó a asociarse no con un avance hacia el futuro, sino más bien con esperanzas no cumplidas. Y de manera natural surgió la idea del rebranding: ¿por qué no dejar de hablar de blockchain como un proyecto autosuficiente y en su lugar incluirlo en un stack de tecnologías que representan todo lo nuevo y brillante? Así, para esta “nueva” idea se encontró un nombre (aunque no nuevo) “web 3.0”. Y para justificar de algún modo esta falta de novedad en el nombre, se incluyó en el stack “brillante” a la red semántica.
Así que, ahora no está de moda el blockchain, sino la infraestructura del internet descentralizado web 3.0, que consiste en varias tecnologías fundamentales: blockchain, aprendizaje automático, web semántica e internet de las cosas. En muchos de los textos que han surgido en el último año sobre la nueva reencarnación del web 3.0, se puede conocer en detalle cada uno de sus componentes, pero, aquí está el problema, no hay respuesta a preguntas naturales: ¿cómo se combinan estas tecnologías en algo integral, para qué necesitan las redes neuronales el internet de las cosas, y el blockchain para la web semántica? La mayoría de los equipos siguen centrándose simplemente en el blockchain (probablemente con la esperanza de crear una criptomoneda capaz de superar al bitcoin, o simplemente recuperando inversiones), pero bajo el nuevo rótulo de “web 3.0”. Aun así, al menos hay algo sobre el futuro, no solo sobre esperanzas infundadas.
Pero no todo es tan sombrío. Ahora intentaré responder brevemente a las preguntas planteadas anteriormente.
¿Para qué necesita la red semántica blockchain? Por supuesto, aquí no debemos hablar de blockchain como tal (la cadena de bloques criptográficamente encadenados), sino de la tecnología que proporciona la identificación de usuarios, la validación de consenso y la protección de contenido basada en métodos criptográficos en una red peer-to-peer. Así que, el grafo semántico, como tal red, obtiene un almacenamiento descentralizado confiable con identificación criptográfica de registros y usuarios. Esto no es la simple semántica de páginas en un hosting gratuito.
¿Para qué necesita el blockchain condicional la semántica? La ontología, en realidad, trata sobre la distribución de contenido por áreas temáticas y niveles. Y esto significa que la web semántica, aplicada sobre una red peer-to-peer, —o si se quiere, la organización de datos de red en un único grafo semántico—, permite una natural clasificación de la red, es decir, su escalabilidad horizontal. La organización por niveles del grafo permite paralelizar el procesamiento de datos semánticamente independientes. Esto ya es una arquitectura de datos, no solo tirar todo sin un orden en bloques y almacenar en todos los nodos.
¿Por qué necesita el Internet de las Cosas semántica y blockchain? Con blockchain parece ser todo trivial: es necesario como un almacenamiento confiable con un sistema de identificación integrado para los actores (incluidos los sensores IoT) basado en claves criptográficas. Por otro lado, la semántica permite segmentar el flujo de datos en clústeres temáticos, es decir, alivia la carga de los nodos, y, además, hace que los datos enviados por los dispositivos IoT sean significativos, y por lo tanto independientes de las aplicaciones. Podremos olvidarnos de solicitar la documentación de la API de las aplicaciones.
Y queda por descubrir cuál es el beneficio mutuo de cruzar el aprendizaje automático y la red semántica. Bueno, aquí todo es extremadamente simple. ¿Dónde, sino en el gráfico semántico, se puede encontrar una enorme cantidad de datos validados, estructurados y semánticamente definidos en un formato único, tan necesario para entrenar redes neuronales? Por otro lado, ¿qué mejor que una red neuronal para analizar el gráfico en busca de anomalías útiles o dañinas, digamos, para identificar nuevos conceptos, sinónimos o spam?
Y así, necesitamos un web 3.0 así. Jason Calacanis dirá: ya les dije que esto sería una herramienta para crear contenido de alta calidad por personas talentosas. Tim Berners-Lee estará satisfecho: la semántica reina. Y Tim O'Reilly también tendrá razón: el web 3.0 es sobre 'la interacción de Internet con el mundo físico', sobre borrar la línea entre lo online y lo offline, cuando olvidemos las palabras 'conéctate a la red'.
Mis enfoques anteriores sobre el tema
- (2012)
- (video, 2013)
- (2015)
- (2019)
Fuente: habr.com
