Capítulo 4. Lagos de dados escaláveis
Este trabalho foi traduzido com recurso a IA. Agradecemos o teu feedback e comentários: translation-feedback@oreilly.com
Se mudares a tua forma de ver as coisas, as coisas que vês mudam.
Wayne Dyer
Depois de ler os três primeiros capítulos, deves ter tudo o que precisas para colocar a tua arquitetura de data lake a funcionar na Cloud, com um perfil de custo razoável para a tua organização. Teoricamente, também terás o primeiro conjunto de casos de uso e cenários executados com sucesso na produção. O teu lago de dados é tão bem sucedido que a procura de mais cenários é agora maior, e estás ocupado a servir as necessidades dos teus novos clientes. O teu negócio está em expansão e o teu património de dados está a crescer rapidamente. Como se diz nos negócios, ir de zero a um é um desafio diferente de ir de um a cem ou de cem a mil. Para garantir que o teu design também é escalável e continua a funcionar à medida que os teus dados e os casos de utilização crescem, é importante perceber os vários factores que afectam a escala e o desempenho do teu lago de dados. Ao contrário da opinião popular, a escala e o desempenho nem sempre são uma solução de compromisso com os custos, mas andam muito de mãos dadas. Neste capítulo, analisaremos mais de perto essas considerações, bem como as estratégias para otimizar seu data lake para escala enquanto continuamos a otimizar os custos. Mais uma vez, usaremos a Klodars Corporation, uma organização fictícia, ...
Become an O’Reilly member and get unlimited access to this title plus top books and audiobooks from O’Reilly and nearly 200 top publishers, thousands of courses curated by job role, 150+ live events each month,
and much more.
Read now
Unlock full access