Kapitel 7. Pandas, Dask und Polare
Diese Arbeit wurde mithilfe von KI übersetzt. Wir freuen uns über dein Feedback und deine Kommentare: translation-feedback@oreilly.com
Viele wissenschaftliche und datenwissenschaftliche Projekte verwenden tabellarische Daten, die in einen Datenrahmen passen. Ein Datenrahmen fasst in der Regel eine heterogene (d.h. gemischte) Sammlung von Datentypen zusammen, wobei die Datentypen den Spalten zugeordnet sind. Jeder Eintrag im Datenrahmen ist eine Zeile - im Allgemeinen sehen sie aus wie eine Tabellenkalkulation, wie du sie in Excel sehen könntest.
Pandas wurde 2008 veröffentlicht und entwickelte sich schnell zur wichtigsten Datenrahmen-Bibliothek im Python-Ökosystem. Im Laufe ihrer Entwicklung wurden viele Mängel diskutiert, die später in Wes McKinneys berüchtigtem Blogpost "Apache Arrow and the '10 Things I Hate About pandas'" von 2017 dokumentiert wurden . Zum Zeitpunkt der Erstellung dieses Artikels, acht Jahre nach diesem Blogpost, ist Pandas ...
Become an O’Reilly member and get unlimited access to this title plus top books and audiobooks from O’Reilly and nearly 200 top publishers, thousands of courses curated by job role, 150+ live events each month,
and much more.
Read now
Unlock full access