Capítulo 6. Criando pipelines de produção
Este trabalho foi traduzido com recurso a IA. Agradecemos o teu feedback e comentários: translation-feedback@oreilly.com
À medida que nossos pipelines de dados crescem em complexidade, precisamos considerar como produzi-los para garantir confiabilidade, escalabilidade e facilidade de manutenção. É aqui que entra a criação de pipelines de produção, que é o foco das páginas a seguir. Neste capítulo, exploraremos como criar pipelines de produção robustos e eficientes usando Delta Live Tables e Databricks Jobs. Vamos nos aprofundar nas nuances do controle da qualidade dos dados, capturando alterações de dados e orquestrando fluxos de trabalho para automatizar nossos pipelines.
Explorar as mesas Delta Live
O Delta Live Tables (DLT) é uma ferramenta poderosa que permite-te criar facilmente pipelines de dados de produção. Ao fornecer uma forma simples e intuitiva de gerir pipelines de dados, a DLT permite-te concentrar-te na extração de informações dos teus dados. Nesta secção, vamos mergulhar no mundo das Tabelas dinâmicas Delta, explorando as suas principais funcionalidades, vantagens e casos de utilização.
Apresentamos-te as mesas Delta Live
O Delta Live Tables é uma estrutura ETL declarativa alimentada pelo Apache Spark para criar pipelines de dados fiáveis e fáceis de manter. Foi concebido para simplificar o processo de criação de pipelines de processamento de dados em grande escala, mantendo as dependências de tabelas e a qualidade dos ...
Become an O’Reilly member and get unlimited access to this title plus top books and audiobooks from O’Reilly and nearly 200 top publishers, thousands of courses curated by job role, 150+ live events each month,
and much more.
Read now
Unlock full access