introduction
Combien d'entre vous seraient d'accord / pas d'accord avec cette affirmation?
Est-ce que Google vous connaît et vous comprend mieux que vous-même?
Faites-moi part de vos opinions à travers les commentaires ci-dessous..
Je réfléchis à la déclaration ci-dessus depuis un certain temps et il peut être difficile de prendre une position absolue, mais le fait même que vous ayez besoin d'y penser signifie l'importance des données. Pensez-y, notre opinion de nous-mêmes est biaisée par ce que nous voulons être. Notre vision de nous-mêmes est influencée par les émotions, l'actualité et les limites de la mémoire humaine. Mais Google n'a pas ces limitations !!
Les entreprises sont désormais plus conscientes de notre mode de vie, choix et la routine quotidienne que nous. Grâce à nos données stockées par les smartphones, bracelets, Traqueur de Fitness, Factures d'achat, etc.
Mais, A quoi serviront mes données pour ces entreprises? Je me suis posé la même question jusqu'à ce que je lis l'un des livres énumérés ci-dessous. Des technologies comme Hadoop, CarteRéduireMapReduce est un modèle de programmation conçu pour traiter et générer efficacement de grands ensembles de données. Propulsé par Google, Cette approche décompose le travail en tâches plus petites, qui sont répartis entre plusieurs nœuds d’un cluster. Chaque nœud traite sa partie, puis les résultats sont combinés. Cette méthode vous permet de faire évoluer les applications et de gérer d’énormes volumes d’informations, fondamental dans le monde du Big Data...., Apache SparkApache Spark est un moteur de traitement de données open source qui permet l'analyse de grands volumes d'informations de manière rapide et efficace. Sa conception est basée sur la mémoire, ce qui optimise les performances par rapport à d'autres outils de traitement par lots. Spark est largement utilisé dans les applications de big data, apprentissage automatique et analyse en temps réel, grâce à sa facilité d'utilisation et.... han supuesto una revolución en las formas de analizar big data. Étincelle, étant le dernier, promete una ‘computación en grappeUn cluster est un ensemble d’entreprises et d’organisations interconnectées qui opèrent dans le même secteur ou la même zone géographique, et qui collaborent pour améliorer leur compétitivité. Ces regroupements permettent le partage des ressources, Connaissances et technologies, favoriser l’innovation et la croissance économique. Les grappes peuvent couvrir une variété d’industries, De la technologie à l’agriculture, et sont fondamentaux pour le développement régional et la création d’emplois.... ultrarrápida’.
C'est probablement le meilleur moment pour faire carrière dans le Big Data. Je pense que rien ne vaut les livres quand il s'agit d'apprendre un concept fondamental. Dans cet article, J'ai répertorié les meilleurs livres pour débutants sur Hadoop, Apache Spark et Big Data.

A qui s'adresse cet article?
Cet article est destiné aux débutants complets en Big Data. Ne suppose aucune connaissance préalable des mégadonnées.
Pour simplifier l'expérience d'apprentissage, J'ai également divisé les livres en 2 groupes:
- Big Data pour le profane
- Big Data pour les experts en technologie.
Comme le nom le suggère, le premier cluster présente l'immense monde du Big Data aux gens ordinaires. Ces livres ne vous apprendront pas les techniques de développement des capacités Big Data., mais ils vous permettront de comprendre le domaine.
Le deuxième groupe de livres est destiné aux experts en technologie: les personnes cherchant à développer une carrière dans le Big Data. Ces livres sont des trésors de connaissances techniques, cela devrait vous permettre une brillant Faire avancer sa carrière.
Big Data pour le profane
Le visage humain du Big Data

Ce livre est écrit par Rick Smolan et Jennifer Erwitt. Dans ce livre, découvrez comment les mégadonnées rendent la vie plus saine pour les enfants et les personnes âgées. Il a 10 des essais et des infographies époustouflantes publiées par les principaux rédacteurs de l'industrie. Connectez le Big Data à des histoires réelles de la vie humaine et de sa transformation. Je suis sûr que ce livre ajoutera certainement à votre point de vue actuel sur les mégadonnées..
Big Data: une révolution qui va transformer notre façon de vivre, nous travaillons et pensons

Ce livre est écrit par Kenneth Cukier et Viktor Mayer Schonberger. Ce livre vous emmène dans un tour du monde des valeurs ajoutées par le big data dans toutes les industries.. Ce livre vous aidera à garder une longueur d'avance sur les tendances clés qui définiront les entreprises pour les années à venir.. Jeff Jonas, Scientifique en chef, IBM Entity Analytics, mentionné: « Le livre regorge d'informations intéressantes sur les nouvelles façons d'exploiter l'information et offre une vision convaincante de l'avenir.. C'est une lecture essentielle pour quiconque utilise, ou être affecté par, Big Data ‘.
Datacylsm: qui sommes nous (quand on pense que personne ne regarde)

Ce livre est écrit par Christian Rudder. C'est un New York Times Best-seller. Dois-je dire autre chose? ¡Bien! voici un rapide coup d'oeil. Ce livre couvre certains des meilleurs cas de big data et son impact profond sur nos vies.. Il présente un monde qui est principalement basé sur des nombres et des données que seuls les humains. Certainement un must pour garder le livre dans son propre livre.
Signal et bruit: pourquoi tant de prédictions échouent, mais certains ne le font pas

Ce livre est écrit par Nate Silver. Il est composé de cas intéressants motivés par des statistiques, économie, prédictions. Il permet également de prendre conscience des erreurs courantes à éviter lors de la réalisation de prévisions et offre une mine de connaissances sur la prévision et la prévision.. C'est un livre incontournable pour les data scientists, analystes, les statisticiens et tous ceux qui admirent le pouvoir des données.
La deuxième ère des machines: travail, progrès et prospérité à l'ère des technologies brillantes

Ce livre est écrit par Erik Brynjolfsson, Andrew McAfee et Jeff Cummings. Avant de commencer à le lire, il faut savoir que c'est un livre audio. Ce livre fait un pas de géant dans le futur et montre le règne indomptable des machines et des ordinateurs chez les humains.. Il définit l'ère de la révolution industrielle et la suivante aussi (peut-être la prochaine). Présente une version réaliste des avancées numériques dans diverses facettes de la vie humaine.
Big Data pour les techniciens – Hadoop
Hadoop pour les nuls

Ce livre est écrit par Dirk Deroos. Ce livre est facile à lire et à comprendre, et est destiné aux débutants (comme le nom le suggère). Fait comprendre au lecteur la valeur du big data et du hadoop. Expliquer l'origine du hadoop, ses avantages, Fonctionnalité, applications pratiques et vous fait vous sentir à l'aise lors de sa manipulation. Il vous familiarise également avec l'écosystème hadoop, grappe, carteréduire, modèles de mise en page et bien d'autres opérations Hadoop.
Hadoop: le guide définitif

Ce livre est écrit par Tom White. Décrit des méthodes utiles pour la construction, maintenir des systèmes fiables, évolutif et distribué avec Apache Hadoop. Explica el concepto de HDFSHDFS, o Système de fichiers distribués Hadoop, Il s’agit d’une infrastructure clé pour stocker de gros volumes de données. Conçu pour fonctionner sur du matériel commun, HDFS permet la distribution des données sur plusieurs nœuds, Garantir une disponibilité élevée et une tolérance aux pannes. Son architecture est basée sur un modèle maître-esclave, où un nœud maître gère le système et les nœuds esclaves stockent les données, faciliter le traitement efficace de l’information.. y Mapreduce con gran detalle. Ce livre offre d'excellents résultats lorsqu'il est lu avec discipline. Les débutants auront du mal à comprendre au début. Mais, en lisant les chapitres, va commencer à les aimer.
Opérations Hadoop

Ce livre est écrit par Eric Sammer. Comme le nom le suggère, Ce livre vous apprendra les méthodes pour maintenir des groupes hadoop grands et complexes. Eric n'a pas seulement couvert l'essentiel de Hadoop, il a également fourni des approches inestimables qui peuvent aider une personne à effectuer ces tâches efficacement. Vous trouverez des chapitres dédiés à la maintenance, les sauvegardes, la surveillance, la résolutionLa "résolution" fait référence à la capacité de prendre des décisions fermes et d’atteindre les objectifs fixés.. Dans des contextes personnels et professionnels, Il s’agit de définir des objectifs clairs et d’élaborer un plan d’action pour les atteindre. La résolution est essentielle à la croissance personnelle et à la réussite dans divers domaines de la vie, car cela vous permet de surmonter les obstacles et de rester concentré sur ce qui compte vraiment.... des problèmes, etc. Couvre tous les composants Hadoop possibles qu'un ingénieur Big Data doit connaître.
Science des données agile: créer des applications d'analyse de données avec Hadoop

Ce livre est écrit par Russell Jurney. Ce livre vous fournit les connaissances dont vous avez besoin pour créer de puissantes applications analytiques à l'aide d'Hadoop dans un environnement d'entreprise.. Utiliser des outils comme Python, Apache PorcLe cochon, un mammifère domestiqué de la famille des Suidés, est connu pour sa polyvalence dans l'agriculture et la production alimentaire. Originaire d'Asie, son élevage s'est étendu dans le monde entier. Les cochons sont omnivores et possèdent une grande capacité d'adaptation à divers habitats. En outre, ils jouent un rôle important dans l'économie, fournissant de la viande, du cuir et d'autres produits dérivés. Leur intelligence et leur comportement social sont également..., D3.js pour créer un environnement agile pour l'exploration de données à l'aide d'exemples. Ces exemples de codes sont disponibles sur github. Este libro es adecuado para usuarios intermedios que tengan un buen conocimiento de la analytiqueL’analytique fait référence au processus de collecte, Mesurer et analyser les données pour obtenir des informations précieuses qui facilitent la prise de décision. Dans divers domaines, Comme les affaires, Santé et sport, L’analytique peut identifier des modèles et des tendances, Optimiser les processus et améliorer les résultats. L’utilisation d’outils et de techniques statistiques de pointe est essentielle pour transformer les données en connaissances applicables et stratégiques.... de données.
Hadoop en pratique

Ce livre est écrit par Alex Holmes. C'est probablement le livre des meilleures pratiques sur Hadoop. Il a 85 Exemples Hadoop au format questions-réponses. Utiliser ces problèmes, vous explorerez les aspects cachés de hadoop et apprendrez les moyens de créer et de mettre en œuvre une solution spécifique en fonction des besoins desservis. Plus que des exemples, Il vous présentera également les méthodes pour intégrer MapReduce et R. L'auteur a expliqué sans effort des concepts compliqués en anglais clair et simple. Il est fortement recommandé pour les débutants.
Solutions Hadoop professionnelles

Ce livre est écrit par Boris Lublinsky, Kevin T Smith, Alexeï Yakoubovitch. Ce livre est un guide détaillé qui explique l'intégration du framework Hadoop et des API pour fournir des solutions du monde réel.. En outre, expose le fonctionnement interne des API pour permettre aux architectes et aux développeurs de mieux les exploiter et de les personnaliser. Plus qu'une simple implication, enseigne les meilleurs scénarios dans lesquels ces codes doivent être utilisés (Java et XML).
MapReduce design patterns: créer des algorithmes et des analyses efficaces pour Hadoop

Ce livre est écrit par Donald Miner. Ce livre suppose que le lecteur a une compréhension de base de hadoop. Il convient mieux aux débutants avancés qui souhaitent maîtriser les algorithmes de réduction de carte. Décrit diverses utilisations de MapReduce avec Hadoop. Contient plusieurs méthodologies utiles pour résoudre rapidement de nombreux problèmes hadoop. Résumez ces concepts avec des exemples intéressants.
Big Data pour les techniciens: Apache Spark
Étincelle d'apprentissage: Analyse de Big Data ultra-rapide

Ce livre est écrit par Holden Karau, Andy Konwinski, Patrick Wendell et Matei Zaharia. Ceci est plus approprié pour les nouveaux utilisateurs de Spark. Expliquer des concepts difficiles dans un anglais simple et facile à comprendre. Je recommande ce livre pour les débutants. Ce livre vous apprend à tirer parti des puissantes bibliothèques intégrées de Spark, inclut Spark SQL, Spark Streaming et Mlib. Surtout, vous permettra de maîtriser des sujets comme le partitionnement des données et les variables partagées.
Étincelle: Apprenez Spark en un JOUR!

Ce livre est écrit par Acodemy. Un autre livre pour les débutants. Ce livre couvre les bases de Spark et de ses composants associés. C'est assez bon pour commencer avec Spark, mais je ne peux pas attendre plus que ça. Suivez une méthode étape par étape pour expliquer les théories et les concepts abscons. À la fin, Ce livre vous apprendra les méthodes que vous devez utiliser pour générer Spark à sa pleine capacité..
Analyse avancée avec Spark: modèles pour apprendre des données à grande échelle

Ce livre est écrit par Sandy Ryza, Uri Laserson, Sean Owen et Josh Wills. Une fois que vous avez lu l'un des livres mentionnés ci-dessus, c'est la prochaine étape naturelle. Il est temps d'augmenter vos connaissances sur les étincelles. Ce livre met en évidence la procédure pour aborder l'analyse de données à grande échelle avec Spark. Avec Spark, couvre les méthodes statistiques pour enseigner l'approche analytique idéale. Ce livre offre une compréhension de base de l'apprentissage automatique, statistiques, Java, Python ou Scala.
Divulgation: Les liens Amazon dans cet article sont des liens d'affiliation. Si vous achetez un livre via ce lien, ils nous paieront via Amazon. C'est l'une des façons dont nous pouvons couvrir nos coûts alors que nous continuons à créer ces articles incroyables.. En outre, la liste reflète notre recommandation basée sur le contenu du livre et n'est en aucun cas influencée par la commission.
Remarques finales
Dans cet article, J'ai répertorié quelques-uns des meilleurs livres (qu'est-ce que je perçois) sur les mégadonnées, Hadoop et Apache Spark. Ces livres sont indispensables pour les débutants qui souhaitent faire carrière dans le Big Data..
Les livres demandent de la discipline et de la persévérance. je n'en avais pas. Jusqu'à ce que je choisisse un livre et le lis d'un bout à l'autre. Si vous ne l'avez pas déjà fait, maintenant c'est ton tour. Les livres listés ci-dessus regroupent toutes les connaissances essentielles pour faire le premier pas dans le big data. Des technologies comme Hadoop, Apache Spark est très demandé dans le monde. Les entreprises ont des données, ils ont même des technologies, mais ils n'ont pas de main-d'œuvre qualifiée pour y travailler.
Ai-je oublié un livre utile sur le Big Data, Hadoop ou Apache Spark? Partagez vos pensées dans la section des commentaires ci-dessous..
Si vous aimez ce que vous venez de lire et souhaitez continuer à apprendre sur l'analyse, abonnez-vous à nos e-mails, Suivez-nous sur Twitter ou comme le nôtre page le Facebook.
En rapport
Articles Similaires:
- Diffusion Spark | Guide du débutant sur le streaming Spark
- Architecture d'étincelle | Architecture Apache Spark pour les ingénieurs de données
- Spark Streaming en temps réel | Transmission de données en temps réel avec Apache Spark
- Ecosistema Hadoop | Hadoop pour le Big Data et l'ingénierie des données



