Messages by Thread
-
-
Re: [PR] fix: native ansi-errors raised as spark error [datafusion-comet]
via GitHub
-
[PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
Re: [PR] feat: adaptive placement of Parquet scan filters (row filter, post-scan, skip) [datafusion]
via GitHub
-
[PR] feat: per-conjunct pruning statistics for PruningPredicate [datafusion]
via GitHub
-
Re: [PR] test: cover JSON and cast expression routing [datafusion-comet]
via GitHub
-
Re: [PR] fix: preserve Spark errors for Parquet timestamp overflow [datafusion-comet]
via GitHub
-
Re: [PR] feat: support direct Variant projection in native Parquet scans [datafusion-comet]
via GitHub
-
Re: [PR] perf: fuse Comet cache vector reads into Spark codegen [datafusion-comet]
via GitHub
-
Re: [PR] fix: gate array distinct and union signed-zero semantics by Spark version [datafusion-comet]
via GitHub
-
Re: [PR] fix: match Spark ordering in native array extrema [datafusion-comet]
via GitHub
-
Re: [PR] fix: report `Input` column when native Iceberg scan is enabled or native shuffle is enabled [datafusion-comet]
via GitHub
-
Re: [PR] fix: support CalendarIntervalType hashing [datafusion-comet]
via GitHub
-
Re: [PR] test: report which writer ran each Iceberg write in the Iceberg CI jobs [datafusion-comet]
via GitHub
-
Re: [PR] fix: preserve nested log and power results [datafusion]
via GitHub
-
Re: [I] power and log simplifications return wrong results for base 1, 0 or negative [datafusion]
via GitHub
-
Re: [PR] fix: Native S3 scan on EKS/IRSA turns a transient STS throttle into a had 403 storm [datafusion-comet]
via GitHub
-
Re: [I] Substrait consumer rejects multi-needle InPredicate for row-valued IN subqueries [datafusion]
via GitHub
-
Re: [PR] Make `RowValues::compare`'s current-offset assumption self-checking [datafusion]
via GitHub
-
Re: [I] Estimate equality to a scalar subquery without a blanket 20% fallback [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [I] SortMergeJoinExec reads and sorts the whole buffered side of a partition whose streamed side is empty [datafusion]
via GitHub
-
Re: [PR] perf: avoid unnecessary aggregate spill rewrites [datafusion]
via GitHub
-
Re: [PR] fix: reject a file without field ids at any depth whether or not id matching is on [datafusion-comet]
via GitHub
-
Re: [PR] ci: shard the Iceberg extensions test task [datafusion-comet]
via GitHub
-
Re: [PR] fix: let explicit Hadoop Azure auth outrank ambient AZURE_* environment variables [datafusion-comet]
via GitHub
-
Re: [PR] fix: end a sort-merge join partition once its streamed side is exhausted, and release its reservations before the final output [datafusion]
via GitHub
-
Re: [PR] feat: execute scalar Arrow Python UDFs in native Comet [datafusion-comet]
via GitHub
-
Re: [I] Make RowValues::compare's current-offset assumption self-checking [datafusion]
via GitHub
-
Re: [PR] feat: decouple partition location from executor metadata [datafusion-ballista]
via GitHub
-
Re: [PR] Scheduler client reuse [datafusion-ballista]
via GitHub
-
Re: [PR] feat: add docker-compose.quick.yml and fix onboarding docs [datafusion-ballista]
via GitHub
-
Re: [PR] fix: avoid panic in array_position start_from near i64::MIN [datafusion]
via GitHub
-
Re: [PR] perf: passthrough last stream is `SortPreservingMergeStream` [datafusion]
via GitHub
-
Re: [PR] feat: add spark.comet.explain.planOnly.enabled [datafusion-comet]
via GitHub
-
Re: [I] Add mode to run Comet planning but execute with Spark, so users can assess potential Comet coverage [datafusion-comet]
via GitHub
-
Re: [PR] fix: match Spark's duplicate field and field id semantics in parquet field lookup [datafusion-comet]
via GitHub
-
[PR] feat: bucket the hash table of single stage aggregations that run on every partition [datafusion]
via GitHub
-
Re: [PR] refactor: track NestedLoopJoin fallback matches in one left bitmap and drop the cancel protocol [datafusion]
via GitHub
-
[PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate a large final hash table as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
[PR] perf: Optimize `array_agg(... IGNORE NULLS)` [datafusion]
via GitHub
-
Re: [PR] refactor: use row-group-local selections for Parquet scans [datafusion]
via GitHub
-
Re: [I] perf: allocation accounting wrapper costs ~5% on TPC-H Q21 from thread-local lookups in the dlopened library [datafusion-comet]
via GitHub
-
Re: [PR] perf: make one thread-local access per tracked allocation [datafusion-comet]
via GitHub
-
Re: [PR] feat: Column statistics support v1 [datafusion-ballista]
via GitHub
-
Re: [PR] feat(agg): add initial Blocked aggregate api [datafusion]
via GitHub
-
Re: [PR] perf: mirror ASOF equality-key filters to right [datafusion]
via GitHub