- — datos de visitantes de la tienda: id, género, edad, ingresos, clasificación de gastos. (Opción de aplicación: )
- — conjunto de datos para principiantes, que contiene las dimensiones de los sépalos y pétalos de varias flores.
- — conjunto de datos de cifras escritas a mano. 60,000 imágenes de entrenamiento y 10,000 imágenes de prueba.
- — conjunto de datos popular para el reconocimiento de patrones. Contiene información sobre viviendas en Boston: número de apartamentos, costo de alquiler, índice de criminalidad.
- — contiene 7796 registros etiquetados de noticias: verdad o mentira. (Opción de aplicación con código fuente en Python: )
- — contiene información sobre el vino: 4898 registros con 14 parámetros.
- — una buena opción para empezar. Contiene 25,000 registros sobre altura y peso de personas de 18 años.
Este artículo fue traducido con el apoyo de EDISON Software, que , así como . - — 195 registros sobre pacientes con la enfermedad de Parkinson, con 25 parámetros de análisis. Puede ser utilizado para una evaluación preliminar de la diferenciación entre personas enfermas y sanas. (Opción de aplicación con código fuente en Python: )
- — contiene información sobre pasajeros (edad, género, familiares a bordo, etc.) 891 en el conjunto de entrenamiento y 418 en el de prueba.
- — información sobre 4.5 millones de viajes de Uber en 2014 y 14 millones en 2015. (Opción de aplicación con código fuente en R: )
- — contiene imágenes de símbolos Británicos y Canadienses de 64 clases: 0-9, A-Z, a-z. 7700 imágenes naturales, 3400 escritas a mano, 62000 fuentes sintetizadas por computadora.
- — contiene información sobre transacciones de tarjetas de crédito comprometidas. (Opción de aplicación con código fuente: )
- — archivo JSON que contiene varias etiquetas: saludos, despedidas, búsqueda de hospital, búsqueda de farmacia, etc. Contiene un conjunto de plantillas de "pregunta-respuesta". (Opción de aplicación con código fuente en Python: )
- — contiene medio millón de correos de 150 gerentes de Enron.
- — contiene 1.2 millones de recomendaciones de 1.6 millones de usuarios sobre 1.2 millones de organizaciones.
- — más de 200,000 registros de "pregunta-respuesta" de un popular programa de televisión.
- — portal con una colección de conjuntos de datos de la Universidad de UCSD. Contiene registros de reseñas en sitios populares (Goodreads, Amazon). Ideal para crear sistemas de recomendación. (Opción de aplicación con código fuente en R: )
- — conjunto de datos para entrenamiento en la detección de spam. Contiene 4601 correos electrónicos con 57 parámetros de metadatos.
- — más de 30,000 imágenes y sus leyendas. ( — 8000 imágenes. Proyecto con código fuente en Python: )
- — 25,000 reseñas de películas en el conjunto de entrenamiento y 25,000 en el de prueba. (Opción de aplicación con código fuente en R: )
- — 1.5 millones de imágenes etiquetadas.
- — CIFAR-10 contiene 60,000 pequeñas imágenes de 32*32 píxeles de los números 0-9. CIFAR-100, en consecuencia, de 0 a 100.
- — 50,000 imágenes de 43 señales de tráfico. (Opción de aplicación con código fuente en Python: )
- — contiene más de 100,000 frases y alrededor de 1000 imágenes por frase.
- — el conjunto de datos contiene imágenes de muestras de cáncer de mama. (Aplicación con código fuente en )
- — contiene anotaciones de alta calidad de secuencias de video de calles de diferentes ciudades.
- — contiene enlaces URL a alrededor de 6.5 millones de videos de alta calidad.
- — el conjunto de datos contiene 25,000 imágenes de poses humanas con anotaciones de articulaciones.
- — conjunto de videos de alta calidad que muestran cómo una persona realiza diversas acciones.
- — conjunto de datos de imágenes de alta calidad con cuadros delimitadores de objetos.
- — contiene más de 1000 imágenes con sus dibujos de contornos.
- — el conjunto de datos contiene 491 escaneos de cabeza por TC con 193,317 cortes.
- — conjunto de datos con más de 5 millones de imágenes faciales etiquetadas por género y edad. (Aplicación con código fuente en )
- — conjunto de datos de videos etiquetados que contiene 6.1 millones de identificadores de videos de Youtube.
- — conjunto de datos de sonidos urbanos (contiene 8732 sonidos urbanos de 10 clases).
- — conjunto de datos compuesto de millones de imágenes a color de escenas y objetos (alrededor de 59 millones de imágenes, 10 categorías de escenas distintas y 20 categorías de objetos distintas).
- — base de datos audiovisual de habla emocional. (Aplicación con código fuente en )
- — el conjunto de datos contiene 1000 horas de habla en inglés con diferentes acentos.
- — conjunto de datos para el desarrollo de tecnologías de conducción autónoma.
- — almacén de datos económicos y financieros (hay contenido gratuito y de pago).
- — información sobre los préstamos otorgados por el Banco Mundial a países en desarrollo.
- — portal del Fondo Monetario Internacional que publica datos sobre finanzas internacionales, tasas de deuda, inversiones, reservas de divisas y mercancías.
- — recurso para buscar datos macroeconómicos de EE. UU.
- — los datos de tendencias de Google se pueden utilizar para explorar y analizar datos visualmente.
- — recurso para obtener información actualizada sobre los mercados financieros de todo el mundo.
- — portal de datos abiertos del gobierno de EE. UU. (agricultura, salud, clima, educación, energía, finanzas, ciencia y investigación, etc.).
- — plataforma de datos abiertos del gobierno de India.
- — contiene datos de investigaciones sobre nutrición en EE. UU.
- — este es el portal del Departamento de Salud y Servicios Humanos de EE. UU.
- — contiene una amplia gama de datos relacionados con la salud.
- — datos sobre la vida de las personas en Londres.
- — portal de datos abiertos sobre los canadienses (agricultura, arte, música, educación, gobierno, salud, etc.)
Leer más
Fuente: habr.com
