- — dati dei visitatori del negozio: id, sesso, età, reddito, punteggio di spesa. (Caso d'uso: )
- — dataset per principianti, contiene le dimensioni dei sepali e dei petali di diversi fiori.
- — dataset di cifre scritte a mano. 60.000 immagini di addestramento e 10.000 immagini di test.
- — un dataset popolare per il riconoscimento di modelli. Contiene informazioni sulle abitazioni a Boston: numero di appartamenti, costo d'affitto, indice di criminalità.
- — contiene 7796 record con etichettatura delle notizie: vero o falso. (Caso d'uso con sorgente in Python: )
- — contiene informazioni sul vino: 4898 record con 14 parametri.
- — una buona opzione per iniziare. Contiene 25.000 record su altezze e pesi di persone di 18 anni.
L'articolo è stato tradotto con il supporto di EDISON Software, che , così come . - — 195 record di pazienti affetti da malattia di Parkinson, con 25 parametri di analisi. Può essere utilizzato per una valutazione preliminare della differenza tra persone malate e sane. (Caso d'uso con sorgente in Python: )
- — contiene informazioni sui passeggeri (età, sesso, parenti a bordo, ecc.) 891 nel set di addestramento e 418 nel set di test.
- — informazioni su 4,5 milioni di viaggi Uber del 2014 e 14 milioni del 2015. (Caso d'uso con sorgente in R: )
- — contiene immagini di simboli britannici e canadesi di 64 classi: 0-9, A-Z, a-z. 7700 immagini naturali, 3400 scritte a mano, 62000 font sintetizzati al computer.
- — contiene informazioni su transazioni con carte di credito compromesse. (Caso d'uso con sorgente: )
- — file JSON che contiene vari tag: saluti, addio, ricerca ospedale, ricerca farmacia, ecc. Contiene un insieme di modelli "domanda-risposta". (Caso d'uso con sorgente in Python: )
- — contiene mezzo milione di email da 150 manager di Enron.
- — contiene 1,2 milioni di recensioni da 1,6 milioni di utenti su 1,2 milioni di organizzazioni.
- — oltre 200.000 record "domanda-risposta" dal popolare gioco televisivo.
- — portale con una collezione di dataset dall'università UCSD. Contiene record di recensioni su siti popolari (Goodreads, Amazon). Ottimo per la creazione di sistemi di raccomandazione. (Caso d'uso con sorgente in R: )
- — dataset per l'addestramento per la rilevazione dello spam. Contiene 4601 email con 57 parametri di metadati.
- — oltre 30.000 immagini con relative didascalie. ( — 8000 immagini. Progetto con sorgente in Python: )
- — 25.000 recensioni di film nel set di addestramento e 25.000 nel set di test. (Caso d'uso con sorgente in R: )
- — 1,5 milioni di immagini annotate.
- — CIFAR-10 contiene 60.000 piccole immagini di 32x32 pixel con cifre da 0 a 9. CIFAR-100 — da 0 a 100.
- — 50.000 immagini di 43 segnali stradali. (Caso d'uso con sorgente in Python: )
- — contiene oltre 100.000 frasi e circa 1000 immagini per frase.
- — il dataset contiene immagini di campioni di cancro al seno. (Caso d'uso con sorgente in )
- — contiene annotazioni di alta qualità su sequenze video di strade di diverse città.
- — contiene URL per circa 6,5 milioni di video di alta qualità.
- — il dataset contiene 25.000 immagini di pose umane annotate con giunture.
- — una raccolta di video di alta qualità che mostrano come una persona svolge determinate azioni.
- — dataset di immagini di alta qualità con bounding box per oggetti.
- — contiene oltre 1000 immagini con i loro disegni a contorni.
- — il dataset contiene 491 scansioni CT della testa con 193.317 sezioni.
- — il dataset contiene oltre 5 milioni di immagini di volti con etichettatura di sesso e età. (Caso d'uso con sorgente in )
- — set di dati video etichettato che contiene 6,1 milioni di identificatori video di Youtube
- — insieme di dati sonori urbani (contiene 8732 suoni urbani da 10 classi).
- — insieme di dati composto da milioni di immagini colorate di scene e oggetti (circa 59 milioni di immagini, 10 categorie di scene e 20 categorie di oggetti).
- — database audiovisiivo di discorsi emotivi. (Caso d'uso con sorgente in )
- — il dataset contiene 1000 ore di discorsi in inglese con diversi accenti.
- — dataset per lo sviluppo delle tecnologie di guida autonoma.
- — archivio di dati economici e finanziari (con contenuti gratuiti e a pagamento).
- — informazioni sui prestiti concessi dalla Banca Mondiale ai paesi in via di sviluppo.
- — portale del Fondo Monetario Internazionale che pubblica dati su finanze internazionali, tassi di debito, investimenti, riserve valutarie e merci.
- — risorsa per cercare dati macroeconomici degli Stati Uniti.
- — i dati sulle tendenze di Google possono essere utilizzati per esplorare e analizzare visivamente i dati.
- — risorsa per ottenere informazioni aggiornate sui mercati finanziari di tutto il mondo.
- — portale di dati aperti del governo degli Stati Uniti (agricoltura, sanità, clima, istruzione, energia, finanza, scienza e ricerca, ecc.).
- — piattaforma di dati governativi aperti dell'India.
- — contiene dati di ricerca sull'alimentazione negli Stati Uniti.
- — è il portale del Dipartimento della Salute e dei Servizi Umani degli Stati Uniti.
- — contiene un'ampia gamma di dati relativi alla salute.
- — dati sulla vita delle persone a Londra.
- — portale di dati aperti sui canadesi (agricoltura, arte, musica, istruzione, governo, salute, ecc.)
Leggi di più
Fonte: habr.com
