Chapitre 2. Gestion des données avec Delta Lake
Cet ouvrage a été traduit à l'aide de l'IA. Tes réactions et tes commentaires sont les bienvenus : translation-feedback@oreilly.com
Les lacs de données s'appuient sur des cadres de stockage spécialisés pour améliorer la fonctionnalité des lacs de données traditionnels. Parmi ces frameworks, Delta Lake se distingue comme une technologie de pointe qui alimente la plateforme Databricks Lakehouse. Dans ce chapitre, nous allons explorer les concepts fondamentaux de Delta Lake en présentant d'abord ses principes de base, puis en plongeant dans son utilisation pratique. Par la suite, nous nous concentrerons sur des sujets avancés de Delta Lake tels que le voyage dans le temps, l'optimisation des tables et les opérations sous vide.
Présentation du Delta Lake
Les lacs de données traditionnels souffrent souvent d'inefficacité et rencontrent divers défis dans le traitement des big data. La technologie Delta Lake est une solution innovante conçue pour fonctionner au-dessus des lacs de données afin de surmonter ces problèmes. Pour établir une compréhension claire de Delta Lake, étudions d'abord sa définition telle qu'elle est fournie par ses créateurs originaux chez Databricks.
Qu'est-ce que le Delta Lake ?
Delta Lake est une couche de stockage open-source qui apporte de la fiabilité aux lacs de données en ajoutant une couche de stockage transactionnel au-dessus des données stockées dans le cloud.
Les banques de données
Dans le contexte des ...
Become an O’Reilly member and get unlimited access to this title plus top books and audiobooks from O’Reilly and nearly 200 top publishers, thousands of courses curated by job role, 150+ live events each month,
and much more.
Read now
Unlock full access