Databases & Data Warehouses
In-Process Analytical Database
★ 4.8
Document NoSQL Database
★ 4.6
pip install duckdbpip install pymongopip install duckdbpip install pymongoPython data engineers use DuckDB to run fast analytical SQL queries directly on Parquet files in a data lake without a database server. `duckdb.query('SELECT * FROM parquet_scan("s3://bucket/file.parquet")')` returns an Arrow table convertible to pandas — enabling complex aggregations on large files in seconds without loading them fully into memory.
Python data engineers connect to MongoDB using the pymongo driver or the higher-level Motor library for async workflows. MongoDB is commonly used as a landing zone for semi-structured API responses, event logs, and document data before transformation into a relational warehouse. The aggregation pipeline enables Python engineers to push transformation logic into the database, reducing data movement in ETL workflows.
Databases & Data Warehouses
MongoDB vs PostgreSQL
Databases & Data Warehouses
PostgreSQL vs Redis
Databases & Data Warehouses
Apache Cassandra vs PostgreSQL
Databases & Data Warehouses
Neo4j vs PostgreSQL
Databases & Data Warehouses
InfluxDB vs PostgreSQL
Databases & Data Warehouses
Elasticsearch vs PostgreSQL
Individual Tool Pages