Wprowadzenie
Witamy w drugim wydaniu książki Spark. Błyskawiczna analiza danych. Minęło już kilka lat od pojawienia się w 2015 roku wydania pierwszego, którego autorami byli Holden Karau, Andy Konwinski, Patrick Wendell i Matei Zaharia. Nowe wydanie zostało uaktualnione, tak aby odzwierciedlało ewolucję Apache Spark w wersjach 2.x i 3.x, uwzględniając m.in. rozszerzony ekosystem wbudowanych i zewnętrznych źródeł danych, rozwiązania z zakresu uczenia maszynowego oraz technologie strumieniowania, z którymi framework ten jest ściśle zintegrowany.
Przez lata, które upłynęły od wydania wersji 1.x, oprogramowanie Apache Spark stało się praktycznie ujednoliconym silnikiem przetwarzania w systemach big data. W tym czasie poszerzono jego możliwości o ...
Become an O’Reilly member and get unlimited access to this title plus top books and audiobooks from O’Reilly and nearly 200 top publishers, thousands of courses curated by job role, 150+ live events each month,
and much more.
Read now
Unlock full access