52 dataset per progetti di allenamento

  1. Dataset dei Clienti del Mall — dati dei visitatori del negozio: id, sesso, età, reddito, punteggio di spesa. (Caso d'uso: Progetto di Segmentazione Clienti con Machine Learning)
  2. Dataset Iris — dataset per principianti, contiene le dimensioni dei sepali e dei petali di diversi fiori.
  3. Dataset MNIST — dataset di cifre scritte a mano. 60.000 immagini di addestramento e 10.000 immagini di test.
  4. Dataset sulle abitazioni di Boston — un dataset popolare per il riconoscimento di modelli. Contiene informazioni sulle abitazioni a Boston: numero di appartamenti, costo d'affitto, indice di criminalità.
  5. Dataset per la Rilevazione di Fake News — contiene 7796 record con etichettatura delle notizie: vero o falso. (Caso d'uso con sorgente in Python: Progetto di Rilevazione di Fake News in Python )
  6. Dataset sulla qualità del vino — contiene informazioni sul vino: 4898 record con 14 parametri.
  7. Dataset SOCR – Altezze e Pesi — una buona opzione per iniziare. Contiene 25.000 record su altezze e pesi di persone di 18 anni.

    52 dataset per progetti di allenamento

    L'articolo è stato tradotto con il supporto di EDISON Software, che gestisce ordini da Sud della Cina "in modo eccellente", così come sviluppa applicazioni web e siti.

  8. Dataset di Parkinson — 195 record di pazienti affetti da malattia di Parkinson, con 25 parametri di analisi. Può essere utilizzato per una valutazione preliminare della differenza tra persone malate e sane. (Caso d'uso con sorgente in Python: Progetto di Machine Learning per la Rilevazione della Malattia di Parkinson)
  9. Dataset del Titanic — contiene informazioni sui passeggeri (età, sesso, parenti a bordo, ecc.) 891 nel set di addestramento e 418 nel set di test.
  10. Dataset dei Pickups di Uber — informazioni su 4,5 milioni di viaggi Uber del 2014 e 14 milioni del 2015. (Caso d'uso con sorgente in R: Progetto di Analisi Dati di Uber in R)
  11. Dataset Chars74k — contiene immagini di simboli britannici e canadesi di 64 classi: 0-9, A-Z, a-z. 7700 immagini naturali, 3400 scritte a mano, 62000 font sintetizzati al computer.
  12. Dataset per la Rilevazione di Frodi con Carta di Credito — contiene informazioni su transazioni con carte di credito compromesse. (Caso d'uso con sorgente: Progetto di Machine Learning per la Rilevazione di Frodi con Carta di Credito)
  13. Dataset delle Intenzioni del Chatbot — file JSON che contiene vari tag: saluti, addio, ricerca ospedale, ricerca farmacia, ecc. Contiene un insieme di modelli "domanda-risposta". (Caso d'uso con sorgente in Python: Progetto di Chatbot in Python)
  14. Dataset delle Email Enron — contiene mezzo milione di email da 150 manager di Enron.
  15. Dataset di Yelp — contiene 1,2 milioni di recensioni da 1,6 milioni di utenti su 1,2 milioni di organizzazioni.
  16. Dataset di Jeopardy — oltre 200.000 record "domanda-risposta" dal popolare gioco televisivo.
  17. Dataset per Sistemi di Raccomandazione — portale con una collezione di dataset dall'università UCSD. Contiene record di recensioni su siti popolari (Goodreads, Amazon). Ottimo per la creazione di sistemi di raccomandazione. (Caso d'uso con sorgente in R: Progetto di Sistema di Raccomandazione di Film in R )
  18. Dataset UCI Spambase — dataset per l'addestramento per la rilevazione dello spam. Contiene 4601 email con 57 parametri di metadati.
  19. Dataset Flickr 30k — oltre 30.000 immagini con relative didascalie. (Dataset Flickr 8k — 8000 immagini. Progetto con sorgente in Python: Progetto Generatore di Didascalie Immagini in Python)
  20. Recensioni IMDB — 25.000 recensioni di film nel set di addestramento e 25.000 nel set di test. (Caso d'uso con sorgente in R: Progetto di Analisi del Sentiment nel Data Science)
  21. Dataset MS COCO — 1,5 milioni di immagini annotate.
  22. Dataset CIFAR-10 e CIFAR-100 — CIFAR-10 contiene 60.000 piccole immagini di 32x32 pixel con cifre da 0 a 9. CIFAR-100 — da 0 a 100.
  23. Dataset GTSRB (German traffic sign recognition benchmark) — 50.000 immagini di 43 segnali stradali. (Caso d'uso con sorgente in Python: Progetto di Riconoscimento dei Segnali Stradali in Python)
  24. Dataset ImageNet — contiene oltre 100.000 frasi e circa 1000 immagini per frase.
  25. Dataset di Immagini Istologiche del Cancro al Seno — il dataset contiene immagini di campioni di cancro al seno. (Caso d'uso con sorgente in Progetto di Classificazione del Cancro al Seno in Python)
  26. Dataset Cityscapes — contiene annotazioni di alta qualità su sequenze video di strade di diverse città.
  27. Dataset Kinetics — contiene URL per circa 6,5 milioni di video di alta qualità.
  28. Dataset MPII per posizioni umane — il dataset contiene 25.000 immagini di pose umane annotate con giunture.
  29. Dataset 20BN-something-something v2 — una raccolta di video di alta qualità che mostrano come una persona svolge determinate azioni.
  30. Dataset Object 365 — dataset di immagini di alta qualità con bounding box per oggetti.
  31. Dataset per il Fotoritocco — contiene oltre 1000 immagini con i loro disegni a contorni.
  32. Dataset CQ500 — il dataset contiene 491 scansioni CT della testa con 193.317 sezioni.
  33. Dataset IMDB-Wiki — il dataset contiene oltre 5 milioni di immagini di volti con etichettatura di sesso e età. (Caso d'uso con sorgente in Progetto di Rilevazione di Genere e Età in Python)
  34. Dataset Youtube 8M — set di dati video etichettato che contiene 6,1 milioni di identificatori video di Youtube
  35. Dataset Urban Sound 8K — insieme di dati sonori urbani (contiene 8732 suoni urbani da 10 classi).
  36. Dataset LSUN — insieme di dati composto da milioni di immagini colorate di scene e oggetti (circa 59 milioni di immagini, 10 categorie di scene e 20 categorie di oggetti).
  37. Dataset RAVDESS — database audiovisiivo di discorsi emotivi. (Caso d'uso con sorgente in Progetto di Riconoscimento delle Emozioni Vocali in Python)
  38. Dataset Librispeech — il dataset contiene 1000 ore di discorsi in inglese con diversi accenti.
  39. Baidu Apolloscape Dataset — dataset per lo sviluppo delle tecnologie di guida autonoma.
  40. Portale Dati Quandl — archivio di dati economici e finanziari (con contenuti gratuiti e a pagamento).
  41. Portale Dati Aperti della Banca Mondiale — informazioni sui prestiti concessi dalla Banca Mondiale ai paesi in via di sviluppo.
  42. Portale Dati FMI — portale del Fondo Monetario Internazionale che pubblica dati su finanze internazionali, tassi di debito, investimenti, riserve valutarie e merci.
  43. Portale Dati dell'American Economic Association (AEA) — risorsa per cercare dati macroeconomici degli Stati Uniti.
  44. Portale Dati Google Trends — i dati sulle tendenze di Google possono essere utilizzati per esplorare e analizzare visivamente i dati.
  45. Portale Dati di Mercato del Financial Times — risorsa per ottenere informazioni aggiornate sui mercati finanziari di tutto il mondo.
  46. Portale Data.gov — portale di dati aperti del governo degli Stati Uniti (agricoltura, sanità, clima, istruzione, energia, finanza, scienza e ricerca, ecc.).
  47. Portale Dati: dati aperti del governo (India) — piattaforma di dati governativi aperti dell'India.
  48. Portale Dati Food Environment Atlas — contiene dati di ricerca sull'alimentazione negli Stati Uniti.
  49. Portale Dati Sanitari — è il portale del Dipartimento della Salute e dei Servizi Umani degli Stati Uniti.
  50. Portale Dati dei Centri per il Controllo e la Prevenzione delle Malattie — contiene un'ampia gamma di dati relativi alla salute.
  51. Portale London Datastore — dati sulla vita delle persone a Londra.
  52. Portale Dati Aperti del Governo Canadese — portale di dati aperti sui canadesi (agricoltura, arte, musica, istruzione, governo, salute, ecc.)

Leggi di più

Fonte: habr.com

Acquista hosting affidabile per siti web con protezione DDoS, server VPS VDS 🔥 Acquista hosting affidabile per siti web con protezione DDoS, server VPS VDS | ProHoster