Messages by Thread
-
-
Re: [D] Policy on uptick of LLM PRs from new contributors [datafusion]
via GitHub
-
Re: [PR] Add support for dictionary for approx_distinct [datafusion]
via GitHub
-
[I] Join planning inserts IS NOT NULL filters that provably pass 100% of rows when input statistics report zero nulls [datafusion]
via GitHub
-
[PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [I] Proto decode silently truncates limits and sizes to `usize` on 32-bit targets [datafusion]
via GitHub
-
[I] [Bug] spark factorial rejects STRING, DECIMAL and floating-point inputs that Spark implicitly casts to INT [datafusion]
via GitHub
-
[I] [Bug] spark factorial rejects BIGINT and untyped integer literals that Spark accepts [datafusion]
via GitHub
-
[PR] [Comet] Recover native Celeborn shuffle from oversized rows [datafusion-comet]
via GitHub
-
Re: [I] [Incompatibility] Document array_join null handling differences [datafusion-comet]
via GitHub
-
[PR] fix: preserve Arrow field metadata on scalar subquery expressions [datafusion]
via GitHub
-
Re: [PR] deps: bump DataFusion 55.0 and Arrow/Parquet 59.2 [datafusion-comet]
via GitHub
-
[PR] fix: compare nested list scalars with a dynamic comparator [datafusion]
via GitHub
-
[I] `min` / `max` over a list of lists (or of structs) fails with "Internal error: Uncomparable values" [datafusion]
via GitHub
-
[PR] fix: `make_array` over NULL-typed columns returns one list per row [datafusion]
via GitHub
-
Re: [I] make_array returns wrong row count for null-array input [datafusion]
via GitHub
-
[D] Sharing benchmark observations on decimal floating-point compression: comparing integer mapping with Gorilla/Chimp on time-series datasets [datafusion]
via GitHub
-
[PR] perf: slice the child instead of gathering it when unnesting [datafusion-comet]
via GitHub
-
[I] Emit the final (post-AQE) physical plan to the event log [datafusion-ballista]
via GitHub
-
[PR] fix: cap the field list in "No field named" errors [datafusion]
via GitHub
-
[PR] feat: experiment with `RealUsagePool` [datafusion-comet]
via GitHub
-
[PR] Add reproducing case [datafusion]
via GitHub
-
[PR] fix(ci): pin tinyvec in the MSRV dependency checker [datafusion-ballista]
via GitHub
-
[I] msrv dependency check fails to build tinyvec 1.13.0 [datafusion-ballista]
via GitHub
-
Re: [I] Native Celeborn shuffle: reflectively replacing Celeborn's final fields can release push admission while payloads are in flight [datafusion-comet]
via GitHub
-
Re: [PR] test: add explode operator microbenchmark [datafusion-comet]
via GitHub
-
[PR] docs(bench): refresh TPC-H SF1000 results at 67b3a19b [datafusion-ballista]
via GitHub
-
[I] Scalar subqueries drop extension metadata from their result [datafusion]
via GitHub
-
[PR] docs(plans): TPC-H SF1000 query plans for community review (not for merge) [datafusion-ballista]
via GitHub
-
[PR] fix: preserve Parquet sort pushdown across proto roundtrips [datafusion]
via GitHub
-
[I] Cancelling a running job leaks its executor vcores and wedges the scheduler under PushStaged [datafusion-ballista]
via GitHub
-
[PR] fix: prevent DISTINCT ORDER BY LIMIT from returning too few rows [datafusion]
via GitHub
-
[PR] Redshift: Support APPROXIMATE PERCENTILE_DISC [datafusion-sqlparser-rs]
via GitHub
-
[PR] `PostgreSQL`: Support the `VARIADIC` function call argument marker [datafusion-sqlparser-rs]
via GitHub
-
Re: [I] Destructure proto hooks for the Parquet source and sink [datafusion]
via GitHub
-
Re: [PR] docs: refresh benchmarking.md with SF1000 results after #2315 (AQE default-on) [datafusion-ballista]
via GitHub
-
[I] SELECT DISTINCT ... ORDER BY ... LIMIT can return too few rows with multiple partitions [datafusion]
via GitHub
-
[PR] Add datafusion.execution.soft_max_bytes_per_output_file config parameter [datafusion]
via GitHub
-
[PR] feat: add an async API for spill file writing [datafusion]
via GitHub
-
Re: [PR] MySQL: print a space before PARTITION when displaying a table factor [datafusion-sqlparser-rs]
via GitHub
-
[I] SingleDistinctToGroupBy fires where it costs far more memory: adding count(*) makes a query ~1000x cheaper [datafusion]
via GitHub
-
Re: [I] `arrays_zip` falls back to Spark for map element types [datafusion-comet]
via GitHub
-
Re: [PR] feat(optimizer): coalesce peer first_value / last_value into a single struct aggregate [datafusion]
via GitHub
-
Re: [PR] docs: document DELETE and UPDATE for SQL users and table provider authors [datafusion]
via GitHub
-
Re: [PR] fix(executor): wake graceful shutdown after tasks drain [datafusion-ballista]
via GitHub
-
Re: [PR] Escape closing brackets in bracket-quoted identifiers [datafusion-sqlparser-rs]
via GitHub
-
Re: [I] Improve DataFrame::from_columns input types [datafusion]
via GitHub
-
[I] JVM exit hangs when the application returns from main without SparkContext.stop() [datafusion-comet]
via GitHub
-
[PR] fix(celeborn): reject unsafe native push completion tracking [datafusion-comet]
via GitHub
-
[PR] copy paste aggregates as is to aggregates_blocked [datafusion]
via GitHub