{"id":34083,"date":"2019-10-31T21:56:19","date_gmt":"2019-10-31T18:56:19","guid":{"rendered":"https:\/\/prohoster.info\/blog\/kto-takie-data-inzhenery-i-kak-imi-stanovyatsya\/"},"modified":"2019-10-31T21:56:19","modified_gmt":"2019-10-31T18:56:19","slug":"kto-takie-data-inzhenery-i-kak-imi-stanovyatsya","status":"publish","type":"post","link":"https:\/\/prohoster.info\/nl\/blog\/administrirovanie\/kto-takie-data-inzhenery-i-kak-imi-stanovyatsya","title":{"rendered":"Wie zijn data-engineers, en hoe word je er een?","gt_translate_keys":[{"key":"rendered","format":"text"}]},"content":{"rendered":"<p>En opnieuw, hallo! De titel van het artikel spreekt voor zich. Voorafgaand aan de start van de cursus <noindex><a rel=\"nofollow\" href=\"https:\/\/otus.pw\/a4Uj\/\">\u00abData Engineer\u00bb<\/a><\/noindex> stellen we voor om te onderzoeken wie dataverwerkers eigenlijk zijn. In het artikel staan veel nuttige links. Veel leesplezier.<\/p>\n<p><img decoding=\"async\" alt=\"Wie zijn data-engineers, en hoe word je er een?\" src=\"\/wp-content\/uploads\/2019\/05\/5f831df35ab1292adafca20f937ed22d.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<br \/>\n<i>Een eenvoudige gids over hoe je de golf van Data Engineering kunt vangen en niet in de afgrond kunt worden getrokken.<\/i><\/p>\n<p>Het lijkt wel alsof tegenwoordig iedereen datascientist (Data Scientist) wil worden. Maar hoe zit het met Data Engineering? <i>In wezen is het een soort hybride tussen data-analist en data-scientist; een data-engineer is doorgaans verantwoordelijk voor het beheer van workflows, verwerkingspijplijnen en ETL-processen<\/i>. Gezien het belang van deze functies, is het momenteel weer een populaire professionele term die actief aan populariteit wint.<\/p>\n<p>Een hoog salaris en een enorme vraag zijn slechts een klein deel van wat deze baan uiterst aantrekkelijk maakt! Als je je wilt voegen bij de helden, is het nooit te laat om te leren. In deze post heb ik alle nodige informatie verzameld om je te helpen je eerste stappen te zetten.<\/p>\n<p>Laten we beginnen!<noindex><a rel=\"nofollow\" name=\"habracut\"><\/a><\/noindex><\/p>\n<p><b>Wat is Data Engineering?<\/b><\/p>\n<p>Eerlijk gezegd is er geen betere uitleg dan dit:<\/p>\n<blockquote><p><i>\u201eEen wetenschapper kan een nieuwe ster ontdekken, maar kan deze niet cre\u00ebren. Hij zal de ingenieur moeten vragen dit voor hem te doen.\u201d<\/i><\/p>\n<p>\u2013Gordon Lindsey Glegg<\/p><\/blockquote>\n<p>Dus, de rol van de data-engineer is vrij aanzienlijk.<\/p>\n<p>Uit de naam blijkt dat data-engineering gerelateerd is aan data, namelijk hun levering, opslag en verwerking. Dienovereenkomstig is de hoofdfunctie van ingenieurs het waarborgen van een betrouwbare infrastructuur voor data. Als we kijken naar de hi\u00ebrarchie van behoeften in AI, bevinden de data-engineeringprocessen zich in de eerste 2-3 fasen: <b>verzameling, verplaatsing en opslag, gegevensvoorbereiding<\/b>.<\/p>\n<p><img decoding=\"async\" alt=\"Wie zijn data-engineers, en hoe word je er een?\" src=\"\/wp-content\/uploads\/2019\/05\/377481f2f52a4ed771508a450678afd0.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<br \/>\n<b>Waar houdt een data-engineer zich mee bezig?<\/b><\/p>\n<p>Met de komst van big data is het verantwoordelijkheidsgebied drastisch veranderd. Waar deze experts vroeger grote SQL-queries schreven en gegevens verwerkten met hulpmiddelen zoals Informatica ETL, Pentaho ETL, Talend, zijn de eisen aan data-engineers 'nu gestegen.<\/p>\n<p>De meeste bedrijven die vacatures hebben voor data-engineers stellen de volgende eisen:<\/p>\n<ul>\n<li>Uitstekende kennis van SQL en Python.<\/li>\n<li>Ervaring met cloudplatforms, met name Amazon Web Services.<\/li>\n<li>Bij voorkeur kennis van Java\/Scala.<\/li>\n<li>Een goed begrip van SQL- en NoSQL-databases (gegevensmodellering, opslag van gegevens).<\/li>\n<\/ul>\n<p>Houd er rekening mee dat dit alleen het noodzakelijke is. Uit deze lijst kan worden afgeleid dat data-engineers specialisten zijn op het gebied van softwareontwikkeling en back-end.<br \/>\nAls bijvoorbeeld een bedrijf begint met het genereren van een grote hoeveelheid gegevens uit verschillende bronnen, is het jouw taak als data-engineer om de informatieverzameling, verwerking en opslag te organiseren.<\/p>\n<p>De lijst met tools die in dit geval worden gebruikt, kan verschillen, afhankelijk van de hoeveelheid gegevens, de snelheid van binnenkomst en de heterogeniteit. De meeste bedrijven komen helemaal niet in aanraking met grote gegevens, dus als een gecentraliseerde opslag, het zogenaamde datawarehouse, kan een SQL-database (PostgreSQL, MySQL, enz.) worden gebruikt met een kleine set scripts die de gegevens naar de opslag sturen.<\/p>\n<p>IT-giganten zoals Google, Amazon, Facebook of Dropbox stellen hogere eisen: kennis van Python, Java of Scala.<\/p>\n<ul>\n<li>Ervaring met big data: Hadoop, Spark, Kafka.<\/li>\n<li>Kennis van algoritmen en datastructuren.<\/li>\n<li>Begrip van de fundamenten van gedistribueerde systemen.<\/li>\n<li>Ervaring met datavisualisatietools zoals Tableau of ElasticSearch is een grote plus.<\/li>\n<\/ul>\n<p>Hieruit blijkt een duidelijke verschuiving naar big data, met name in hun verwerking bij hoge belasting. Deze bedrijven hebben verhoogde eisen aan de systeemweerstand.<\/p>\n<p><b>Data-engineers versus data-scientists<\/b><\/p>\n<p><img decoding=\"async\" alt=\"Wie zijn data-engineers, en hoe word je er een?\" src=\"\/wp-content\/uploads\/2019\/05\/f01dd66863fcc0a89ab0b763d208a863.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<i>Ok\u00e9, dat was een eenvoudige en leuke vergelijking (niets persoonlijks), maar in werkelijkheid is het veel ingewikkelder.<\/i><\/p>\n<p>Ten eerste moet je weten dat er veel onduidelijkheid is over de afbakening van de rollen en vaardigheden van data-scientists en data-engineers. Dat betekent dat je gemakkelijk in de war kunt raken over welke vaardigheden nodig zijn voor een succesvolle data-engineer. Natuurlijk zijn er bepaalde vaardigheden die overlappen tussen beide rollen. Maar er zijn ook een aantal diametraal tegenovergestelde vaardigheden.<\/p>\n<p>Data science is serieus werk, maar we bewegen naar een wereld met functionele data science, waar praktijkmensen in staat zijn om hun eigen analyses te doen. Om data pipelines en ge\u00efntegreerde datastructuren te benutten, heb je data-engineers nodig, geen wetenschappers.<\/p>\n<p><b>Is een data-engineer meer gevraagd dan een data-scientist?<\/b><\/p>\n<blockquote><p><i> \u2014 Ja, want voordat je een worteltaart kunt maken, moet je eerst wortels verzamelen, schillen en voorraad inslaan!<\/i><\/p><\/blockquote>\n<p>Een data-engineer is beter in programmeren dan een data-scientist, maar als het op statistiek aankomt, is het precies andersom.<\/p>\n<p>Maar dit is het voordeel van een data-engineer:<\/p>\n<p>zonder hem\/haar is de waarde van een prototype-model, dat meestal bestaat uit een fragment code van slechte kwaliteit in een Python-bestand, verkregen van een data-scientist en op de een of andere manier resultaat oplevert, geneigd naar nul.<\/p>\n<p>Zonder een data-engineer zal deze code nooit een project worden en zal geen enkel zakelijke probleem effectief worden opgelost. Een data-engineer probeert dit allemaal om te zetten in een product.<\/p>\n<p><b>Basisinformatie die een data-engineer moet weten<\/b><\/p>\n<p><img decoding=\"async\" alt=\"Wie zijn data-engineers, en hoe word je er een?\" src=\"\/wp-content\/uploads\/2019\/05\/f724004e5a30a0c021c4377d66985d16.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<br \/>\nDus als deze baan je enthousiast maakt en je gemotiveerd bent - je kunt het leren, je kunt alle benodigde vaardigheden beheersen en een echte rockster worden op het gebied van data-ontwikkeling. En ja, je kunt dit zelfs zonder programmeervaardigheden of andere technische kennis bereiken. Het is moeilijk, maar mogelijk!<\/p>\n<p><b>Wat zijn de eerste stappen?<\/b><\/p>\n<blockquote><p><i>Je moet een algemeen idee hebben van wat wat is.<\/i><\/p><\/blockquote>\n<p>Allereerst verwijst Data Engineering naar informatica. Specifiek - je moet effectieve algoritmes en datastructuren begrijpen. Ten tweede, aangezien data-engineers met gegevens werken, is begrip van de principes van databases en de structuren die eraan ten grondslag liggen noodzakelijk.<\/p>\n<p>Bijvoorbeeld, gewone B-tree SQL-databases zijn gebaseerd op een datastructuur genaamd B-Tree, evenals in moderne gedistribueerde repositories, LSM-Tree en andere varianten van hash-tabellen.<\/p>\n<p><i>* Deze stappen zijn gebaseerd op een geweldig artikel <noindex><a rel=\"nofollow\" href=\"https:\/\/medium.com\/@adil_45422\">Adil Hashtamov<\/a><\/noindex>. Dus als je de Russische taal kent, steun deze auteur en lees <noindex><a rel=\"nofollow\" href=\"https:\/\/khashtamov.com\/ru\/data-engineer\/\">zijn post<\/a><\/noindex>.<\/i><\/p>\n<p><b>1. Algoritmes en datastructuren<\/b><\/p>\n<p>Het gebruik van de juiste datastructuur kan de prestaties van een algoritme aanzienlijk verbeteren. Idealiter zouden we allemaal datastructuren en algoritmes op school moeten leren, maar dit wordt zelden behandeld. Hoe dan ook, het is nooit te laat om kennis te maken.<br \/>\nDus hier zijn mijn favoriete gratis cursussen voor het leren van datastructuren en algoritmes:<\/p>\n<ul>\n<li><noindex><a rel=\"nofollow\" href=\"https:\/\/www.udemy.com\/introduction-to-data-structures\/?ranMID=39197&amp;ranEAID=JVFxdTr9V80&amp;ranSiteID=JVFxdTr9V80-fcVI3mDcwPC4Q5dpzDABSg&amp;LSNPUBID=JVFxdTr9V80\">Van eenvoudig naar complex: Datastructuren (Udemy)<\/a><\/noindex><\/li>\n<li><noindex><a rel=\"nofollow\" href=\"https:\/\/www.coursera.org\/learn\/algorithms-part1?ranMID=40328&amp;ranEAID=JVFxdTr9V80&amp;ranSiteID=JVFxdTr9V80-Y2SOzvEQ5UCqGZ8SQ8yPFA&amp;siteID=JVFxdTr9V80-Y2SOzvEQ5UCqGZ8SQ8yPFA&amp;utm_content=10&amp;utm_medium=partners&amp;utm_source=linkshare&amp;utm_campaign=JVFxdTr9V80\">Algoritmes, Deel I (Coursera)<\/a><\/noindex><\/li>\n<li><noindex><a rel=\"nofollow\" href=\"https:\/\/www.coursera.org\/learn\/algorithms-part2?ranMID=40328&amp;ranEAID=JVFxdTr9V80&amp;ranSiteID=JVFxdTr9V80-sXWvgPKRyzYEBJ33lVooUQ&amp;siteID=JVFxdTr9V80-sXWvgPKRyzYEBJ33lVooUQ&amp;utm_content=10&amp;utm_medium=partners&amp;utm_source=linkshare&amp;utm_campaign=JVFxdTr9V80\">Algoritmes, Deel II (Coursera)<\/a><\/noindex>\n <\/li>\n<\/ul>\n<p>Plus vergeet niet het klassieke werk over algoritmes van Thomas H. Cormen \u2014 <noindex><a rel=\"nofollow\" href=\"https:\/\/www.amazon.com\/gp\/product\/0262033844\/ref=as_li_tl?ie=UTF8&amp;camp=1789&amp;creative=9325&amp;creativeASIN=0262033844&amp;linkCode=as2&amp;tag=adilkhash-20&amp;linkId=74742875db503b1a899ca35159749067\">Inleiding tot algoritmes<\/a><\/noindex>. Dit is de perfecte handleiding wanneer je je geheugen wilt opfrissen.<\/p>\n<ul>\n<li>Om je vaardigheden te verbeteren, gebruik <noindex><a rel=\"nofollow\" href=\"https:\/\/leetcode.com\/problemset\/algorithms\/\">Leetcode<\/a><\/noindex>.<\/li>\n<\/ul>\n<p>Je kunt ook de wereld van databases verkennen met de geweldige video's van Carnegie Mellon University op YouTube:<\/p>\n<ul>\n<li><noindex><a rel=\"nofollow\" href=\"https:\/\/www.youtube.com\/playlist?list=PLSE8ODhjZXjYutVzTeAds8xUt1rcmyT7x\">Inleiding tot databasesystemen<\/a><\/noindex>.<\/li>\n<li><noindex><a rel=\"nofollow\" href=\"https:\/\/www.youtube.com\/playlist?list=PLSE8ODhjZXja7K1hjZ01UTVDnGQdx5v5U\">Geavanceerde databasesystemen<\/a><\/noindex>.<\/li>\n<\/ul>\n<p><b>2. SQL leren<\/b><\/p>\n<p>Ons hele leven draait om gegevens. En om deze gegevens uit een database te halen, moet je \"met hen praten\" in dezelfde taal.<\/p>\n<p>SQL (Structured Query Language \u2014 gestructureerde query-taal) is de communicatietaal in de wereld van data. Hoe dan ook, SQL is geboren, leeft en zal nog lange tijd leven.<\/p>\n<p>Als je lang in de ontwikkeling hebt gezeten, heb je waarschijnlijk opgemerkt dat de geruchten over de naderende dood van SQL periodiek opduiken. De taal werd in de vroege jaren '70 ontwikkeld en is nog steeds erg populair onder analisten, ontwikkelaars en gewoon enthousiastelingen.<br \/>\nZonder kennis van SQL is er niets te doen in data-engineering, want je zult onvermijdelijk queries moeten opstellen om gegevens op te halen. Alle moderne data-opslagplaatsen ondersteunen SQL:<\/p>\n<ul>\n<li>Amazon Redshift<\/li>\n<li>HP Vertica<\/li>\n<li>Oracle<\/li>\n<li>SQL Server<\/li>\n<\/ul>\n<p>\u2026 en nog veel meer.<\/p>\n<p>Voor de analyse van grote hoeveelheden gegevens opgeslagen in gedistribueerde systemen zoals HDFS, zijn SQL-mechanismen uitgevonden: Apache Hive, Impala, enzovoort. Zie je, het verdwijnt nergens naartoe.<\/p>\n<p>Hoe leer je SQL? Gewoon door het in de praktijk te doen.<\/p>\n<p>Daarom raad ik aan om kennis te maken met een geweldige handleiding die, trouwens, gratis is, van <noindex><a rel=\"nofollow\" href=\"https:\/\/mode.com\/sql-tutorial\/introduction-to-sql\/\">Mode Analytics<\/a><\/noindex>.<\/p>\n<ol>\n<li><noindex><a rel=\"nofollow\" href=\"https:\/\/www.datacamp.com\/courses\/intermediate-sql\/\">Gemiddeld niveau SQL<\/a><\/noindex><\/li>\n<li><noindex><a rel=\"nofollow\" href=\"https:\/\/www.datacamp.com\/courses\/joining-data-in-postgresql\">Gegevens samenvoegen in SQL<\/a><\/noindex><\/li>\n<\/ol>\n<p>Een bijzonder kenmerk van deze cursussen is de aanwezigheid van een interactieve omgeving waarin je SQL-queries direct in je browser kunt schrijven en uitvoeren. De bron <noindex><a rel=\"nofollow\" href=\"https:\/\/modern-sql.com\/\">Modern SQL<\/a><\/noindex> is zeker nuttig. En je kunt deze kennis toepassen in <noindex><a rel=\"nofollow\" href=\"https:\/\/leetcode.com\/problemset\/database\/\">de taken van Leetcode<\/a><\/noindex> in de sectie Database.<\/p>\n<p><b>3. Programmeren in Python en Java\/Scala<\/b><\/p>\n<p>Waarom je de programmeertaal Python zou moeten leren, heb ik al besproken in het artikel <noindex><a rel=\"nofollow\" href=\"https:\/\/medium.com\/datadriveninvestor\/python-vs-r-choosing-the-best-tool-for-ai-ml-data-science-7e0c2295e243\">Python vs R. De beste tool voor AI, ML en Data Science<\/a><\/noindex>. Wat betreft Java en Scala, de meeste tools voor het opslaan en verwerken van enorme hoeveelheden gegevens zijn in deze talen geschreven. Bijvoorbeeld:<\/p>\n<ul>\n<li>Apache Kafka (Scala)<\/li>\n<li>Hadoop, HDFS (Java)<\/li>\n<li>Apache Spark (Scala)<\/li>\n<li>Apache Cassandra (Java)<\/li>\n<li>HBase (Java)<\/li>\n<li>Apache Hive (Java)<\/li>\n<\/ul>\n<p>Om te begrijpen hoe deze tools werken, moet je de talen kennen waarin ze zijn geschreven. De functionele benadering van Scala stelt je in staat om effici\u00ebnt om te gaan met parallelle gegevensverwerking. Python kan helaas niet bogen op snelheid en parallelle verwerkingscapaciteiten. Over het algemeen heeft kennis van meerdere talen en programmeerparadigma's een positieve invloed op de verscheidenheid aan benaderingen voor probleemoplossing.<\/p>\n<p>Om in de Scala-taal te duiken, kun je lezen <noindex><a rel=\"nofollow\" href=\"https:\/\/www.amazon.com\/gp\/product\/0981531687\/ref=as_li_tl?ie=UTF8&amp;camp=1789&amp;creative=9325&amp;creativeASIN=0981531687&amp;linkCode=as2&amp;tag=adilkhash-20&amp;linkId=69314619f1e546e3921eb97c72cf4850\">Programmeren in Scala<\/a><\/noindex> door de auteur van de taal. Ook bedrijf Twitter heeft een goede introductiegids gepubliceerd \u2014 <noindex><a rel=\"nofollow\" href=\"https:\/\/twitter.github.io\/scala_school\/\">Scala School<\/a><\/noindex>.<\/p>\n<p>Wat betreft Python, vind ik <noindex><a rel=\"nofollow\" href=\"https:\/\/www.amazon.com\/gp\/product\/1491946008\/ref=as_li_tl?ie=UTF8&amp;camp=1789&amp;creative=9325&amp;creativeASIN=1491946008&amp;linkCode=as2&amp;tag=adilkhash-20&amp;linkId=8a663e966770c24874e323133cc7a005\">Fluent Python<\/a><\/noindex> de beste boek voor gemiddeld niveau.<\/p>\n<p><b>4. Tools voor big data<\/b><\/p>\n<p>Hier is een lijst van de populairste tools in de wereld van big data:<\/p>\n<ul>\n<li>Apache Spark<\/li>\n<li>Apache Kafka<\/li>\n<li>Apache Hadoop (HDFS, HBase, Hive)<\/li>\n<li>Apache Cassandra<\/li>\n<\/ul>\n<p>Voor meer informatie over het bouwen van grote gegevensblokken, kun je deze geweldige <noindex><a rel=\"nofollow\" href=\"http:\/\/xyz.insightdataengineering.com\/blog\/pipeline_map\/\">interactieve omgeving<\/a><\/noindex>. De populairste tools zijn Spark en Kafka. Ze zijn zeker de moeite waard om te bestuderen, idealiter om te begrijpen hoe ze van binnenuit werken. Jay Kreps (mede-oonwerper van Kafka) publiceerde in 2013 een monumentaal werk <noindex><a rel=\"nofollow\" href=\"https:\/\/engineering.linkedin.com\/distributed-systems\/log-what-every-software-engineer-should-know-about-real-time-datas-unifying\">The Log: wat elke softwareontwikkelaar moet weten over de abstractie van het samenvoegen van gegevens in realtime<\/a><\/noindex>, trouwens, de belangrijkste idee\u00ebn uit deze gids zijn gebruikt voor de ontwikkeling van Apache Kafka.<\/p>\n<ul>\n<li>Een inleiding tot Hadoop kan zijn <noindex><a rel=\"nofollow\" href=\"https:\/\/data-flair.training\/blogs\/hadoop-tutorials-home\/\">De ultieme gids voor het leren van Hadoop (gratis)<\/a><\/noindex>.<\/li>\n<li>De meest uitgebreide gids voor Apache Spark voor mij is \u2014 <noindex><a rel=\"nofollow\" href=\"https:\/\/www.amazon.com\/gp\/product\/1491912219\/ref=as_li_tl?ie=UTF8&amp;camp=1789&amp;creative=9325&amp;creativeASIN=1491912219&amp;linkCode=as2&amp;tag=adilkhash-20&amp;linkId=5b206424060cfc80a33d13b05c0bfee2\">Spark: de complete gids<\/a><\/noindex>.<\/li>\n<\/ul>\n<p><b>5. Cloudplatforms<\/b><\/p>\n<p><img decoding=\"async\" alt=\"Wie zijn data-engineers, en hoe word je er een?\" src=\"\/wp-content\/uploads\/2019\/05\/cc435bc9f9b91ec87d1cf7a591cf84a2.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<br \/>\nKennis van ten minste \u00e9\u00e9n cloudplatform staat op de lijst van basisvereisten voor sollicitanten naar de functie van data-engineer. Werkgevers geven de voorkeur aan Amazon Web Services, op de tweede plaats staat Google Cloud Platform, en Microsoft Azure sluit de top drie af.<\/p>\n<p>Je moet goed bekend zijn met Amazon EC2, AWS Lambda, Amazon S3, DynamoDB.<\/p>\n<p><b>6. Gedistribueerde systemen<\/b><\/p>\n<p>Werken met big data impliceert het bestaan van clusters van onafhankelijk werkende computers, waarvan de communicatie via een netwerk verloopt. Hoe groter het cluster, hoe groter de kans op falen van de knooppunten. Om een geweldige expert in data te worden, moet je de problemen en bestaande oplossingen voor gedistribueerde systemen begrijpen. Dit gebied is oud en complex.<\/p>\n<p>Andrew Tanenbaum wordt beschouwd als een pionier op dit gebied. Voor degenen die niet bang zijn voor theorie, raad ik zijn boek aan <noindex><a rel=\"nofollow\" href=\"https:\/\/www.amazon.com\/gp\/product\/1543057381\/ref=as_li_tl?ie=UTF8&amp;camp=1789&amp;creative=9325&amp;creativeASIN=1543057381&amp;linkCode=as2&amp;tag=adilkhash-20&amp;linkId=721aedeb23c313bc46a92c134c5baafa\">\u00abGedistribueerde systemen\u00bb<\/a><\/noindex>, voor beginners kan het wat moeilijk lijken, maar het zal je helpen je vaardigheden echt te verfijnen.<\/p>\n<p>Ik geloof <noindex><a rel=\"nofollow\" href=\"https:\/\/www.amazon.com\/gp\/product\/1449373321\/ref=as_li_tl?ie=UTF8&amp;camp=1789&amp;creative=9325&amp;creativeASIN=1449373321&amp;linkCode=as2&amp;tag=adilkhash-20&amp;linkId=e7e0e096aa5761066245eb90965ac849\">dat \u00abData-intensive application design\u00bb van Martin Kleppmann<\/a><\/noindex> de beste inleiding is. Trouwens, Martin heeft een geweldige <noindex><a rel=\"nofollow\" href=\"https:\/\/martin.kleppmann.com\/\">blog<\/a><\/noindex>. Zijn werk helpt om kennis over de opbouw van moderne infrastructuur voor de opslag en verwerking van grote data te systematiseren.<br \/>\nVoor degenen die van video houden, is er een cursus op Youtube over <noindex><a rel=\"nofollow\" href=\"https:\/\/www.youtube.com\/watch?v=w8KFPWkK0bI&amp;list=PLawkBQ15NDEkDJ5IyLIJUTZ1rRM9YQq6N&amp;index=2&amp;t=0s\">Gedistribueerde computersystemen<\/a><\/noindex>.<\/p>\n<p><b>7. Datapeer<\/b><\/p>\n<p><img decoding=\"async\" alt=\"Wie zijn data-engineers, en hoe word je er een?\" src=\"\/wp-content\/uploads\/2019\/05\/cf1c8e2baad0cc79c0b8c3707741353a.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<br \/>\nDatapeer is iets waar je als data-engineer niet zonder kunt leven.<\/p>\n<p>De meeste tijd bouwt een data-engineer wat men een datapeer noemt, dat wil zeggen, het cre\u00ebren van een proces voor het verplaatsen van gegevens van de ene plek naar de andere. Dit kunnen gebruikersscenario's zijn die naar de API van een externe service gaan of SQL-query's uitvoeren, gegevens aanvullen en deze in een centrale opslag (opslagplaats voor gegevens) of een opslag voor ongestructureerde gegevens (data lakes) plaatsen.<\/p>\n<p><b>Samenvattend: de belangrijkste checklist voor een data-engineer<\/b><\/p>\n<p><img decoding=\"async\" alt=\"Wie zijn data-engineers, en hoe word je er een?\" src=\"\/wp-content\/uploads\/2019\/05\/de0eca662b2246e63901afb89c9f255f.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<br \/>\nLaten we samenvatten \u2014 het is belangrijk om goed inzicht te hebben in het volgende:<\/p>\n<ul>\n<li>Informatiesystemen;<\/li>\n<li>Softwareontwikkeling (Agile, DevOps, Ontwerpmethoden, SOA);<\/li>\n<li>Gedistribueerde systemen en parallel programmeren;<\/li>\n<li>Fundamentals van databases \u2014 planning, ontwerp, werking en probleemoplossing;<\/li>\n<li>Experimenteel ontwerp \u2014 A\/B-tests om concepten te bewijzen, de betrouwbaarheid en prestaties van systemen vast te stellen, evenals het ontwerpen van betrouwbare wegen voor het operationeel aanbieden van goede oplossingen.<\/li>\n<\/ul>\n<p>Dit zijn slechts enkele vereisten om data-engineer te worden, dus verken en begrijp data systemen, informatiesystemen, continue levering\/implementatie\/integratie, programmeertalen en andere onderwerpen in informatica (niet in alle onderwerpen).<\/p>\n<p><b>En tot slot, het laatste maar zeer belangrijke wat ik wil zeggen.<\/b><\/p>\n<blockquote><p><i><b>Het pad naar Data Engineering is niet zo eenvoudig als het lijkt. Het is genadeloos, frustrerend, en je moet er klaar voor zijn. Sommige momenten in deze reis kunnen je ertoe aanzetten alles op te geven. Maar het is echt hard werken en een leerproces.<\/b><\/i><\/p><\/blockquote>\n<p>Versier het niet vanaf het begin. Het doel van de reis is om zoveel mogelijk te leren en je voor te bereiden op nieuwe uitdagingen.<br \/>\nHier is een geweldige afbeelding die ik tegenkwam, die dit moment goed illustreert:<\/p>\n<p><img decoding=\"async\" alt=\"Wie zijn data-engineers, en hoe word je er een?\" src=\"\/wp-content\/uploads\/2019\/05\/9cc8db9011e5f54717d7e9f31f915523.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<br \/>\nEn ja, vergeet niet om burn-out te vermijden en rust te nemen. Dit is ook erg belangrijk. Veel succes!<\/p>\n<p>Wat vinden jullie van het artikel, vrienden? We nodigen jullie uit voor <noindex><a rel=\"nofollow\" href=\"https:\/\/otus.pw\/RCuj\/\">een gratis webinar<\/a><\/noindex>, dat vandaag al om 20.00 uur zal plaatsvinden. Tijdens het webinar bespreken we hoe je een effectief en schaalbaar gegevensverwerkingssysteem kunt opzetten voor een klein bedrijf of startup met minimale kosten. We zullen ook kennis maken met Google Cloud gegevensverwerkingstools als onderdeel van de praktijk. Tot dan!<br \/>\n<br \/>Bron: <a content=\"nofollow\" rel=\"nofollow\" href=\"https:\/\/habr.com\/ru\/company\/otus\/blog\/452670\/\">habr.com<\/a><\/p>","protected":false,"gt_translate_keys":[{"key":"rendered","format":"html"}]},"excerpt":{"rendered":"<p>\u0418 \u0441\u043d\u043e\u0432\u0430 \u0437\u0434\u0440\u0430\u0432\u0441\u0442\u0432\u0443\u0439\u0442\u0435! \u0417\u0430\u0433\u043e\u043b\u043e\u0432\u043e\u043a \u0441\u0442\u0430\u0442\u044c\u0438 \u0433\u043e\u0432\u043e\u0440\u0438\u0442 \u0441\u0430\u043c \u043e \u0441\u0435\u0431\u0435. \u0412 \u043f\u0440\u0435\u0434\u0434\u0432\u0435\u0440\u0438\u0438 \u0441\u0442\u0430\u0440\u0442\u0430 \u043a\u0443\u0440\u0441\u0430 \u00abData Engineer\u00bb \u043f\u0440\u0435\u0434\u043b\u0430\u0433\u0430\u0435\u043c \u0440\u0430\u0437\u043e\u0431\u0440\u0430\u0442\u044c\u0441\u044f \u0432 \u0442\u043e\u043c, \u043a\u0442\u043e \u0436\u0435 \u0442\u0430\u043a\u0438\u0435 \u0434\u0430\u0442\u0430-\u0438\u043d\u0436\u0435\u043d\u0435\u0440\u044b. \u0412 \u0441\u0442\u0430\u0442\u044c\u0435 \u043e\u0447\u0435\u043d\u044c \u043c\u043d\u043e\u0433\u043e \u043f\u043e\u043b\u0435\u0437\u043d\u044b\u0445 \u0441\u0441\u044b\u043b\u043e\u043a. \u041f\u0440\u0438\u044f\u0442\u043d\u043e\u0433\u043e \u043f\u0440\u043e\u0447\u0442\u0435\u043d\u0438\u044f. \u041f\u0440\u043e\u0441\u0442\u043e\u0435 \u0440\u0443\u043a\u043e\u0432\u043e\u0434\u0441\u0442\u0432\u043e \u043e \u0442\u043e\u043c, \u043a\u0430\u043a \u043f\u043e\u0439\u043c\u0430\u0442\u044c \u0432\u043e\u043b\u043d\u0443 Data Engineering \u0438 \u043d\u0435 \u0434\u0430\u0442\u044c \u0435\u0439 \u0437\u0430\u0442\u044f\u043d\u0443\u0442\u044c \u0432\u0430\u0441 \u0432 \u043f\u0443\u0447\u0438\u043d\u0443. \u0421\u043a\u043b\u0430\u0434\u044b\u0432\u0430\u0435\u0442\u0441\u044f \u0432\u043f\u0435\u0447\u0430\u0442\u043b\u0435\u043d\u0438\u0435, \u0447\u0442\u043e \u0432 \u043d\u0430\u0448\u0438 \u0434\u043d\u0438 \u043a\u0430\u0436\u0434\u044b\u0439 [&hellip;]<\/p>\n","protected":false,"gt_translate_keys":[{"key":"rendered","format":"html"}]},"author":1,"featured_media":25729,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[688],"tags":[],"class_list":["post-34083","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-administrirovanie"],"aioseo_notices":[],"aioseo_head":"\n\t\t<!-- All in One SEO 5.0.3 - aioseo.com -->\n\t<meta name=\"description\" content=\"\u0418 \u0441\u043d\u043e\u0432\u0430 \u0437\u0434\u0440\u0430\u0432\u0441\u0442\u0432\u0443\u0439\u0442\u0435! \u0417\u0430\u0433\u043e\u043b\u043e\u0432\u043e\u043a \u0441\u0442\u0430\u0442\u044c\u0438 \u0433\u043e\u0432\u043e\u0440\u0438\u0442 \u0441\u0430\u043c \u043e \u0441\u0435\u0431\u0435.\" \/>\n\t<meta name=\"robots\" content=\"max-image-preview:large\" \/>\n\t<meta name=\"author\" content=\"Yuri Gagarin\"\/>\n\t<link rel=\"canonical\" href=\"https:\/\/prohoster.info\/nl\/blog\/administrirovanie\/kto-takie-data-inzhenery-i-kak-imi-stanovyatsya\" \/>\n\t\t<meta name=\"generator\" content=\"All in One SEO (AIOSEO) 5.0.3\" \/>\n\t\t<meta property=\"og:locale\" content=\"nl_NL\" \/>\n\t\t<meta property=\"og:site_name\" content=\"ProHoster | \u041a\u0443\u043f\u0438\u0442\u044c \u043d\u0430\u0434\u0435\u0436\u043d\u044b\u0439 \u0445\u043e\u0441\u0442\u0438\u043d\u0433 \u0434\u043b\u044f \u0441\u0430\u0439\u0442\u043e\u0432 \u0441 \u0437\u0430\u0449\u0438\u0442\u043e\u0439 \u043e\u0442 DDoS, VPS VDS \u0441\u0435\u0440\u0432\u0435\u0440\u044b\" \/>\n\t\t<meta property=\"og:type\" content=\"article\" \/>\n\t\t<meta property=\"og:title\" content=\"\ud83e\udd47\u041a\u0442\u043e \u0442\u0430\u043a\u0438\u0435 \u0434\u0430\u0442\u0430-\u0438\u043d\u0436\u0435\u043d\u0435\u0440\u044b, \u0438 \u043a\u0430\u043a \u0438\u043c\u0438 \u0441\u0442\u0430\u043d\u043e\u0432\u044f\u0442\u0441\u044f? | ProHoster\" \/>\n\t\t<meta property=\"og:description\" content=\"\u0418 \u0441\u043d\u043e\u0432\u0430 \u0437\u0434\u0440\u0430\u0432\u0441\u0442\u0432\u0443\u0439\u0442\u0435! \u0417\u0430\u0433\u043e\u043b\u043e\u0432\u043e\u043a \u0441\u0442\u0430\u0442\u044c\u0438 \u0433\u043e\u0432\u043e\u0440\u0438\u0442 \u0441\u0430\u043c \u043e \u0441\u0435\u0431\u0435.\" \/>\n\t\t<meta property=\"og:url\" content=\"https:\/\/prohoster.info\/nl\/blog\/administrirovanie\/kto-takie-data-inzhenery-i-kak-imi-stanovyatsya\" \/>\n\t\t<meta property=\"og:image\" content=\"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg\" \/>\n\t\t<meta property=\"og:image:secure_url\" content=\"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg\" \/>\n\t\t<meta property=\"og:image:width\" content=\"350\" \/>\n\t\t<meta property=\"og:image:height\" content=\"350\" \/>\n\t\t<meta property=\"article:published_time\" content=\"2019-10-31T18:56:19+00:00\" \/>\n\t\t<meta property=\"article:modified_time\" content=\"2019-10-31T18:56:19+00:00\" \/>\n\t\t<meta property=\"article:publisher\" content=\"https:\/\/www.facebook.com\/prohoster\" \/>\n\t\t<meta property=\"article:author\" content=\"https:\/\/www.facebook.com\/prohoster\" \/>\n\t\t<!-- All in One SEO -->\n\n","aioseo_head_json":{"title":"\ud83e\udd47Wie zijn data-engineers en hoe word je er een? | ProHoster","description":"En weer hallo! De titel van het artikel spreekt voor zich.","canonical_url":"https:\/\/prohoster.info\/nl\/blog\/administrirovanie\/kto-takie-data-inzhenery-i-kak-imi-stanovyatsya","robots":"max-image-preview:large","keywords":"","webmasterTools":{"miscellaneous":""},"schema":null,"og:locale":"nl_NL","og:site_name":"ProHoster | \u041a\u0443\u043f\u0438\u0442\u044c \u043d\u0430\u0434\u0435\u0436\u043d\u044b\u0439 \u0445\u043e\u0441\u0442\u0438\u043d\u0433 \u0434\u043b\u044f \u0441\u0430\u0439\u0442\u043e\u0432 \u0441 \u0437\u0430\u0449\u0438\u0442\u043e\u0439 \u043e\u0442 DDoS, VPS VDS \u0441\u0435\u0440\u0432\u0435\u0440\u044b","og:type":"article","og:title":"\ud83e\udd47\u041a\u0442\u043e \u0442\u0430\u043a\u0438\u0435 \u0434\u0430\u0442\u0430-\u0438\u043d\u0436\u0435\u043d\u0435\u0440\u044b, \u0438 \u043a\u0430\u043a \u0438\u043c\u0438 \u0441\u0442\u0430\u043d\u043e\u0432\u044f\u0442\u0441\u044f? | ProHoster","og:description":"\u0418 \u0441\u043d\u043e\u0432\u0430 \u0437\u0434\u0440\u0430\u0432\u0441\u0442\u0432\u0443\u0439\u0442\u0435! \u0417\u0430\u0433\u043e\u043b\u043e\u0432\u043e\u043a \u0441\u0442\u0430\u0442\u044c\u0438 \u0433\u043e\u0432\u043e\u0440\u0438\u0442 \u0441\u0430\u043c \u043e \u0441\u0435\u0431\u0435.","og:url":"https:\/\/prohoster.info\/nl\/blog\/administrirovanie\/kto-takie-data-inzhenery-i-kak-imi-stanovyatsya","og:image":"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg","og:image:secure_url":"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg","og:image:width":350,"og:image:height":350,"article:published_time":"2019-10-31T18:56:19+00:00","article:modified_time":"2019-10-31T18:56:19+00:00","article:publisher":"https:\/\/www.facebook.com\/prohoster","article:author":"https:\/\/www.facebook.com\/prohoster"},"aioseo_meta_data":{"post_id":"34083","title":null,"description":null,"keywords":null,"keyphrases":null,"primary_term":null,"canonical_url":null,"og_title":null,"og_description":null,"og_object_type":"default","og_image_type":"default","og_image_url":null,"og_image_width":null,"og_image_height":null,"og_image_custom_url":null,"og_image_custom_fields":null,"og_video":null,"og_custom_url":null,"og_article_section":null,"og_article_tags":null,"twitter_use_og":false,"twitter_card":"default","twitter_image_type":"default","twitter_image_url":null,"twitter_image_custom_url":null,"twitter_image_custom_fields":null,"twitter_title":null,"twitter_description":null,"schema":{"blockGraphs":[],"customGraphs":[],"default":{"data":{"Article":[],"Course":[],"Dataset":[],"FAQPage":[],"Movie":[],"Person":[],"Product":[],"ProductReview":[],"Car":[],"Recipe":[],"Service":[],"SoftwareApplication":[],"WebPage":[]},"graphName":"","isEnabled":true},"graphs":[]},"schema_type":null,"schema_type_options":null,"pillar_content":false,"robots_default":true,"robots_noindex":false,"robots_noarchive":false,"robots_nosnippet":false,"robots_nofollow":false,"robots_noimageindex":false,"robots_noodp":false,"robots_notranslate":false,"robots_max_snippet":null,"robots_max_videopreview":null,"robots_max_imagepreview":"large","priority":null,"frequency":null,"local_seo":null,"seo_analyzer_scan_date":"2026-01-21 17:49:20","breadcrumb_settings":null,"limit_modified_date":false,"reviewed_by":null,"ai":null,"created":"2021-03-01 02:28:35","updated":"2026-01-21 17:49:20","focus_keyword":null,"additional_keywords":null,"truseo_locale":null},"gt_translate_keys":[{"key":"link","format":"url"}],"_links":{"self":[{"href":"https:\/\/prohoster.info\/nl\/wp-json\/wp\/v2\/posts\/34083","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/prohoster.info\/nl\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/prohoster.info\/nl\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/prohoster.info\/nl\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/prohoster.info\/nl\/wp-json\/wp\/v2\/comments?post=34083"}],"version-history":[{"count":0,"href":"https:\/\/prohoster.info\/nl\/wp-json\/wp\/v2\/posts\/34083\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/prohoster.info\/nl\/wp-json\/wp\/v2\/media\/25729"}],"wp:attachment":[{"href":"https:\/\/prohoster.info\/nl\/wp-json\/wp\/v2\/media?parent=34083"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/prohoster.info\/nl\/wp-json\/wp\/v2\/categories?post=34083"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/prohoster.info\/nl\/wp-json\/wp\/v2\/tags?post=34083"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}