Zum Inhalt springen

SQL auf Pandas

Pandas-DataFrames, die in lokalen Variablen gespeichert sind, können abgefragt werden, als wären sie normale Tabellen in DuckDB.

import duckdb
import pandas
# Create a Pandas dataframe
my_df = pandas.DataFrame.from_dict({'a': [42]})
# query the Pandas DataFrame "my_df"
# Note: duckdb.sql connects to the default in-memory database connection
results = duckdb.sql("SELECT * FROM my_df").df()

Die nahtlose Integration von Pandas-DataFrames in DuckDB-SQL-Abfragen wird durch Replacement Scans ermöglicht. Diese ersetzen Zugriffe auf die Tabelle my_df (die in DuckDB nicht existiert) durch eine Tabellenfunktion, die den DataFrame my_df liest.