Capítulo 3. Dominando entidades relacionais em Databricks
Este trabalho foi traduzido com recurso a IA. Agradecemos o teu feedback e comentários: translation-feedback@oreilly.com
As entidades relacionais, particularmente bancos de dados, tabelas e exibições, são componentes essenciais para organizar e gerenciar dados estruturados em Databricks. Entender como essas entidades interagem com o metastore e os locais de armazenamento é crucial para a consulta eficiente e o gerenciamento de dados. Neste capítulo, abordaremos em detalhes como essas entidades funcionam no ambiente do Databricks e entenderemos seu relacionamento com o armazenamento subjacente.
Compreender as entidades relacionais
Esta secção fornece uma compreensão detalhada das entidades relacionais na Databricks, abrangendo bases de dados, tabelas e vistas, com foco nas suas interações com o metastore e os sistemas de armazenamento.
Bases de dados em Databricks
Na Databricks, um banco de dados corresponde essencialmente a um esquema em um catálogo de dados. Isto significa que quando cria uma base de dados, está essencialmente a definir uma estrutura lógica onde as tabelas, vistas e funções podem ser organizadas. Esta coleção de objectos de base de dados é designada por esquema. Tens a flexibilidade de criar uma base de dados utilizando a sintaxe CREATE DATABASE ou CREATE SCHEMA, uma vez que são funcionalmente equivalentes.
Cada espaço de trabalho do Databricks inclui um catálogo de dados local, chamado hive_metastore ...
Become an O’Reilly member and get unlimited access to this title plus top books and audiobooks from O’Reilly and nearly 200 top publishers, thousands of courses curated by job role, 150+ live events each month,
and much more.
Read now
Unlock full access