Messages by Thread
-
-
[PR] feat: preserving grouped state reads [datafusion]
via GitHub
-
[PR] chore: Bench string [datafusion-comet]
via GitHub
-
[PR] fix: preserve narrowing TRY_CAST comparison semantics [datafusion]
via GitHub
-
[PR] chore(ci): bump taiki-e/install-action from 2.86.6 to 2.86.7 [datafusion-ballista]
via GitHub
-
Re: [I] [EPIC] Implement Range Partitioning [datafusion]
via GitHub
-
[I] Allow for scaling RangePartitioning [datafusion]
via GitHub
-
Re: [I] Pluggable operator-level statistics propagation (StatisticsRegistry) [datafusion]
via GitHub
-
Re: [PR] feat: add native support for MergeRowsExec (row-level MERGE INTO) [datafusion-comet]
via GitHub
-
Re: [PR] feat: account JVM UDF Arrow allocations in Spark task memory [datafusion-comet]
via GitHub
-
Re: [PR] fix: address escape literal issue #21516 [datafusion]
via GitHub
-
Re: [PR] fix: make table function arg coercion non-fatal, add raw_exprs accessor [datafusion]
via GitHub
-
Re: [PR] fix: preserve MERGE target qualifier bindings [datafusion]
via GitHub
-
Re: [PR] fix: hash join dynamic filter with dictionary-encoded join keys [datafusion]
via GitHub
-
[I] Compact `IN`-list pruning excludes `NOT IN` and NULL-containing lists [datafusion]
via GitHub
-
[I] Extend the compact `IN`-list pruning benchmark [datafusion]
via GitHub
-
[I] Revisit the 20-value lower bound for compact `IN`-list pruning [datafusion]
via GitHub
-
[I] Extend compact `IN`-list pruning beyond string types [datafusion]
via GitHub
-
[I] Consider an enclosing-range fallback for `IN` lists above `max_in_list_size` [datafusion]
via GitHub
-
[PR] Add per-aggregate metrics to non-grouped AggregateStream [datafusion]
via GitHub
-
[PR] [TESTING] arrow 10859 [datafusion]
via GitHub
-
[PR] Feat/map sql extension types [datafusion]
via GitHub
-
[PR] feat: bind task-owned RSS callbacks to native shuffle plans (4/n) [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimizing take_n for DictionaryGroupValuesColumn [datafusion]
via GitHub
-
[I] ci: Prebuild Linux CI images with toolchains and dependencies [datafusion-comet]
via GitHub
-
[PR] ci: extend Maven setup and retry dependency downloads [datafusion-comet]
via GitHub
-
Re: [I] Grouped approx_distinct can overflow Arrow BinaryArray state offsets [datafusion]
via GitHub
-
Re: [I] Long poll (async runtime stall) in HashAggregate when emitting large number of groups [datafusion]
via GitHub
-
Re: [I] Generate GroupByHash output in multiple `RecordBatch`es rather than one large one [datafusion]
via GitHub
-
Re: [I] Hash aggregation produces batches reporting huge memory size [datafusion]
via GitHub
-
Re: [I] [EPIC] Eliminate Long Polls in HashAggregate via Chunked Storage and Incremental Emission [datafusion]
via GitHub
-
Re: [I] Track long-term replacement for destructive EmitTo::First in aggregation [datafusion]
via GitHub
-
Re: [I] Grouping operations on large datasets can overflow i32 offsets [datafusion]
via GitHub
-
Re: [I] Manage group values and states by blocks in aggregation [datafusion]
via GitHub
-
Re: [I] Fixed blocks in aggregation state for better memory management [datafusion]
via GitHub
-
[I] Large-offset Arrow vectors from PyArrow UDFs cannot be serialized for broadcast or collect [datafusion-comet]
via GitHub
-
Re: [I] Proposal: DataFusion Cookbook [datafusion]
via GitHub
-
[I] Improve aggregate performance with adaptive sizing in accumulators / avoiding reallocations in accumulators [datafusion]
via GitHub
-
[I] [EPIC] Use blocked / chunked memory management in hash aggregation [datafusion]
via GitHub
-
Re: [PR] Add DataFusion 55.0.0 release blog post [datafusion-site]
via GitHub
-
Re: [I] Bug triage results: 2026-08-24 [datafusion-comet]
via GitHub
-
Re: [PR] fix(proto): check plan integer conversions across usize boundaries [datafusion]
via GitHub
-
[I] Adopt techniques from Spark's ArrowCachedBatchSerializer (SPARK-57268) in Comet's cache format [datafusion-comet]
via GitHub
-
[I] AQE + DPP + spark.comet.exec.transitionRevert.enabled fails with "SubqueryAdaptiveBroadcastExec does not support the execute() code path" [datafusion-comet]
via GitHub
-
[I] Cached reads that feed Spark operators are slower than Spark's own cache format [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
Re: [PR] feat: add experimental native support for in-memory cache, disabled by default [datafusion-comet]
via GitHub
-
[I] Comet cache decode ignores column projection, making narrow reads of wide cached relations slower than Spark [datafusion-comet]
via GitHub
-
[PR] fix: preserve current AQE logical-stage links on Comet operators [datafusion-comet]
via GitHub
-
[PR] feat: widen output decimal type for decimal ceil/floor [datafusion]
via GitHub