github
Thread
Date
Earlier messages
Messages by Thread
Re: [I] Signed-zero array test fixtures claim the literal case agrees with Spark when it does not [datafusion-comet]
via GitHub
Re: [I] skip expensive ptr chase & comparission in ByteGroupValueBuilder [datafusion]
via GitHub
[I] eliminate double copy in Top-K, hash join, and sort-merge join using `BatchCoalescer::push_batch_interleaved` [datafusion]
via GitHub
[PR] Render prefix ~ operator with a space [datafusion-sqlparser-rs]
via GitHub
[PR] [branch-55] fix: update rustls to address RUSTSEC-2026-0285 (#25309) [datafusion]
via GitHub
Re: [PR] [branch-55] fix: update rustls to address RUSTSEC-2026-0285 (#25309) [datafusion]
via GitHub
[PR] fix: honor the volatility of aggregate, window and higher-order functions in `Expr::is_volatile` [datafusion]
via GitHub
[I] FilterExec: fuse filter and coalesce to avoid intermediate RecordBatch allocation [datafusion]
via GitHub
[PR] Fix unary minus rendering into -- line comments [datafusion-sqlparser-rs]
via GitHub
[PR] fix: respect volatility for all function expressions [datafusion]
via GitHub
Re: [PR] fix: respect volatility for all function expressions [datafusion]
via GitHub
[PR] fix: remove the ineffective spark.executor.memoryOverhead adjustment from the driver plugin [datafusion-comet]
via GitHub
Re: [PR] fix: remove the ineffective spark.executor.memoryOverhead adjustment from the driver plugin [datafusion-comet]
via GitHub
[PR] build(deps): bump arrow-schema from 59.3.0 to 60.0.0 [datafusion-python]
via GitHub
[PR] build(deps): bump arrow-select from 59.3.0 to 60.0.0 [datafusion-python]
via GitHub
[PR] build(deps): bump arrow-array from 59.3.0 to 60.0.0 [datafusion-python]
via GitHub
[PR] build(deps): bump arrow from 59.3.0 to 60.0.0 [datafusion-python]
via GitHub
Re: [I] Object store cache key drops the ABFS container, so two containers in one storage account share a store instance [datafusion-comet]
via GitHub
[PR] feat: account for Comet in spark.executor.memoryOverhead in off-heap mode [datafusion-comet]
via GitHub
Re: [PR] feat: account for Comet in spark.executor.memoryOverhead in off-heap mode [datafusion-comet]
via GitHub
Re: [PR] feat: account for Comet in spark.executor.memoryOverhead in off-heap mode [datafusion-comet]
via GitHub
[PR] perf: Avoid needless conversion of `Metadata` to `HashMap` [datafusion]
via GitHub
Re: [PR] perf: Avoid needless conversion of `Metadata` to `HashMap` [datafusion]
via GitHub
Re: [PR] perf: Avoid needless conversion of `Metadata` to `HashMap` [datafusion]
via GitHub
Re: [PR] perf: Avoid needless conversion of `Metadata` to `HashMap` [datafusion]
via GitHub
[PR] PostgreSQL: Render prefix @ operator with a space [datafusion-sqlparser-rs]
via GitHub
[PR] docs: add a scan contributor guide and a scan PR review skill [datafusion-comet]
via GitHub
Re: [PR] docs: add a scan contributor guide and a scan PR review skill [datafusion-comet]
via GitHub
[I] Consider accounting for Comet in spark.executor.memoryOverhead when off-heap memory is enabled [datafusion-comet]
via GitHub
Re: [I] Consider accounting for Comet in spark.executor.memoryOverhead when off-heap memory is enabled [datafusion-comet]
via GitHub
Re: [I] Consider accounting for Comet in spark.executor.memoryOverhead when off-heap memory is enabled [datafusion-comet]
via GitHub
[I] `binary_as_string` over a Parquet `Binary` column with invalid UTF-8 causes a segfault [datafusion]
via GitHub
[PR] docs: recommend setting spark.executor.memoryOverhead alongside off-heap memory [datafusion-comet]
via GitHub
Re: [PR] docs: recommend setting spark.executor.memoryOverhead alongside off-heap memory [datafusion-comet]
via GitHub
Re: [PR] docs: recommend setting spark.executor.memoryOverhead alongside off-heap memory [datafusion-comet]
via GitHub
[PR] fix: account for hash-join row-index storage [datafusion]
via GitHub
Re: [PR] fix: account for hash-join row-index storage [datafusion]
via GitHub
[I] Wrong results: a correlated filter under the nullable side of an outer join is pulled above the join [datafusion]
via GitHub
[PR] fix: truncate scalar timestamps in their own unit in date_trunc [datafusion]
via GitHub
Re: [PR] fix: truncate scalar timestamps in their own unit in date_trunc [datafusion]
via GitHub
Re: [PR] fix: truncate scalar timestamps in their own unit in date_trunc [datafusion]
via GitHub
Re: [PR] fix: truncate scalar timestamps in their own unit in date_trunc [datafusion]
via GitHub
Re: [PR] fix: truncate scalar timestamps in their own unit in date_trunc [datafusion]
via GitHub
Re: [PR] fix: truncate scalar timestamps in their own unit in date_trunc [datafusion]
via GitHub
Re: [PR] fix: truncate scalar timestamps in their own unit in date_trunc [datafusion]
via GitHub
[PR] docs: correct the stale range-partitioning strict floating-point rule [datafusion-comet]
via GitHub
[I] `ORDER BY CAST(ts AS TIME)` can return incorrectly ordered results across midnight [datafusion]
via GitHub
Re: [I] `ORDER BY CAST(ts AS TIME)` can return incorrectly ordered results across midnight [datafusion]
via GitHub
[I] Spark `xxhash64` ignores validity buffer [datafusion]
via GitHub
[I] `Expr::is_volatile` ignores the volatility of aggregate, window and higher-order functions [datafusion]
via GitHub
Re: [I] [COMET NATIVE WRITER] INSERT INTO TABLE - complex type but different names [datafusion-comet]
via GitHub
[PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [PR] WIP: coalesce: expose push_batch_with_filter on LimitedBatchCoalescer [datafusion]
via GitHub
Re: [I] Comet writer doesn't create _SUCCESS file [datafusion-comet]
via GitHub
Re: [I] [Native Writer] INSERT INTO ... SELECT fails due to stale catalog cache after write [datafusion-comet]
via GitHub
[PR] feat: trace Arrow memory held on the JVM side [datafusion-comet]
via GitHub
Re: [PR] feat: trace Arrow memory held on the JVM side [datafusion-comet]
via GitHub
Re: [PR] feat: trace Arrow memory held on the JVM side [datafusion-comet]
via GitHub
Re: [PR] feat: trace Arrow memory held on the JVM side [datafusion-comet]
via GitHub
Re: [PR] feat: trace Arrow memory held on the JVM side [datafusion-comet]
via GitHub
Re: [PR] feat: trace Arrow memory held on the JVM side [datafusion-comet]
via GitHub
[I] Tracing does not report Arrow memory held on the JVM side [datafusion-comet]
via GitHub
[PR] perf: Size builder capacity using visible array span, not total size [datafusion]
via GitHub
Re: [PR] perf: Size builder capacity using visible array span, not total size [datafusion]
via GitHub
[PR] fix: preserve Spark row index read errors [datafusion-comet]
via GitHub
Re: [PR] fix: preserve Spark row index read errors [datafusion-comet]
via GitHub
[PR] fix: gate the regr_r2 degenerate-case swap on the Spark patch release [datafusion-comet]
via GitHub
Re: [PR] fix: gate the regr_r2 degenerate-case swap on the Spark patch release [datafusion-comet]
via GitHub
Re: [PR] fix(core): reject a DELETE or an UPDATE whose WHERE clause cannot reach the provider [datafusion]
via GitHub
[I] Range-partitioning strict-mode rule in the shuffle review skill and native_shuffle.md is stale after #5981 [datafusion-comet]
via GitHub
[PR] perf: Share backing buffers in string view functions [datafusion]
via GitHub
Re: [PR] perf: Share backing buffers in string view functions [datafusion]
via GitHub
[I] Variance and standard deviation return incorrect results for large nearby values [datafusion-comet]
via GitHub
[I] Sliding-window SUM(BIGINT) ignores ANSI and TRY overflow semantics [datafusion-comet]
via GitHub
Re: [I] Sliding-window SUM(BIGINT) ignores ANSI and TRY overflow semantics [datafusion-comet]
via GitHub
Re: [PR] build: enable Spark SQL tests for released Spark 4.2.0 [datafusion-comet]
via GitHub
[PR] fix: let decimal SUM recover from an intermediate overflow like Spark [datafusion-comet]
via GitHub
Re: [PR] fix: let decimal SUM recover from an intermediate overflow like Spark [datafusion-comet]
via GitHub
Re: [PR] fix: let decimal SUM recover from an intermediate overflow like Spark [datafusion-comet]
via GitHub
Re: [PR] fix: let decimal SUM recover from an intermediate overflow like Spark [datafusion-comet]
via GitHub
Re: [PR] fix: let decimal SUM recover from an intermediate overflow like Spark [datafusion-comet]
via GitHub
Re: [PR] fix: let decimal SUM recover from an intermediate overflow like Spark [datafusion-comet]
via GitHub
Re: [I] Comet throws RuntimeException instead of SparkException for invalid row index column type [datafusion-comet]
via GitHub
Re: [I] Comet throws RuntimeException instead of SparkException for invalid row index column type [datafusion-comet]
via GitHub
Re: [PR] docs: document DELETE and UPDATE for SQL users and table provider authors [datafusion]
via GitHub
[I] Nothing guards page skipping in the native Iceberg scan [datafusion-comet]
via GitHub
Re: [I] Nothing guards page skipping in the native Iceberg scan [datafusion-comet]
via GitHub
[PR] test: guard page skipping in the native Iceberg scan [datafusion-comet]
via GitHub
Re: [PR] test: guard page skipping in the native Iceberg scan [datafusion-comet]
via GitHub
Re: [PR] test: guard page skipping in the native Iceberg scan [datafusion-comet]
via GitHub
[PR] feat: recognize more lossless casts for statistics and ordering [datafusion]
via GitHub
Re: [PR] feat: recognize more lossless casts for statistics and ordering [datafusion]
via GitHub
Re: [PR] feat: recognize more lossless casts for statistics and ordering [datafusion]
via GitHub
Re: [PR] Refresh statistics parser settings between query files [datafusion]
via GitHub
Re: [I] [DISCUSSION] Clarify public ExecutionPlan transformation contracts for optimizer-added state [datafusion]
via GitHub
Re: [I] [DISCUSSION] Clarify public ExecutionPlan transformation contracts for optimizer-added state [datafusion]
via GitHub
[PR] chore: add a native Iceberg write benchmark [datafusion-comet]
via GitHub
Re: [PR] chore: add a native Iceberg write benchmark [datafusion-comet]
via GitHub
Re: [PR] chore: add a native Iceberg write benchmark [datafusion-comet]
via GitHub
Re: [PR] chore: add a native Iceberg write benchmark [datafusion-comet]
via GitHub
[I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
Re: [I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
Re: [I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
Re: [I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
Re: [I] Ordered ARRAY_AGG accumulator retains one Arrow array per update_batch call, inflating per-row memory for grouped aggregation [datafusion]
via GitHub
[PR] perf(functions-aggregate): coalesce small ordered ARRAY_AGG batches [datafusion]
via GitHub
Re: [PR] perf(functions-aggregate): coalesce small ordered ARRAY_AGG batches [datafusion]
via GitHub
Re: [PR] perf(functions-aggregate): coalesce small ordered ARRAY_AGG batches [datafusion]
via GitHub
Re: [PR] perf(functions-aggregate): coalesce small ordered ARRAY_AGG batches [datafusion]
via GitHub
Re: [I] CAST statistics can produce incorrect MIN/MAX results [datafusion]
via GitHub
[PR] Fuzz: Add curated seed corpus [datafusion-sqlparser-rs]
via GitHub
[PR] fix: reserve the concatenated build batch and computed join keys in HashJoinExec [datafusion]
via GitHub
Re: [PR] fix: reserve the concatenated build batch and computed join keys in HashJoinExec [datafusion]
via GitHub
Re: [I] width_bucket bypasses CometExpressionSerde framework [datafusion-comet]
via GitHub
[PR] docs: Document the convention for internal public APIs [datafusion]
via GitHub
Re: [PR] docs: Document the convention for internal public APIs [datafusion]
via GitHub
Re: [PR] docs: Document the convention for internal public APIs [datafusion]
via GitHub
Re: [I] Support `length` function with non-string input [datafusion-comet]
via GitHub
Re: [I] Add User Guide section on using object stores such as S3 [datafusion]
via GitHub
[PR] perf: copy bitmaps a word at a time in `pre_selection_scatter` [datafusion]
via GitHub
[PR] Fuzz: Display roundtrip [datafusion-sqlparser-rs]
via GitHub
Re: [PR] feat(spark): support the scale argument in Spark ceil [datafusion]
via GitHub
Re: [PR] feat(spark): support the scale argument in Spark ceil [datafusion]
via GitHub
Re: [PR] feat(spark): support the scale argument in Spark ceil [datafusion]
via GitHub
Re: [PR] feat(spark): support the scale argument in Spark ceil [datafusion]
via GitHub
[PR] Remove deprecated Parquet metadata / statistics APIs that are past the API [datafusion]
via GitHub
[PR] fix: shrink NLJ load outcome to satisfy Clippy [datafusion]
via GitHub
Re: [PR] fix: shrink NLJ load outcome to satisfy Clippy [datafusion]
via GitHub
Re: [PR] fix: shrink NLJ load outcome to satisfy Clippy [datafusion]
via GitHub
Re: [PR] perf: preserve left functional dependencies for ASOF joins [datafusion]
via GitHub
Re: [PR] perf: preserve left functional dependencies for ASOF joins [datafusion]
via GitHub
Re: [PR] perf: preserve left functional dependencies for ASOF joins [datafusion]
via GitHub
Re: [PR] fix: preserve current AQE logical-stage links on Comet operators [datafusion-comet]
via GitHub
[PR] perf: reuse prepared broadcast builds across executor tasks [datafusion-comet]
via GitHub
[PR] feat: support reusable prepared hash-join builds [datafusion]
via GitHub
Re: [PR] feat: support reusable prepared hash-join builds [datafusion]
via GitHub
Re: [PR] feat: support reusable prepared hash-join builds [datafusion]
via GitHub
Re: [PR] feat: support reusable prepared hash-join builds [datafusion]
via GitHub
Re: [PR] feat: support reusable prepared hash-join builds [datafusion]
via GitHub
Re: [PR] feat: support reusable prepared hash-join builds [datafusion]
via GitHub
Re: [PR] feat: support reusable prepared hash-join builds [datafusion]
via GitHub
Re: [PR] feat: support reusable prepared hash-join builds [datafusion]
via GitHub
Re: [PR] feat: support reusable prepared hash-join builds [datafusion]
via GitHub
Re: [PR] feat: support reusable prepared hash-join builds [datafusion]
via GitHub
[PR] feat: admit string maps in Spark-to-Comet conversion [datafusion-comet]
via GitHub
Re: [PR] feat: admit string maps in Spark-to-Comet conversion [datafusion-comet]
via GitHub
[PR] fix: defer throwing literal casts to Spark at runtime [datafusion-comet]
via GitHub
Re: [PR] fix: defer throwing literal casts to Spark at runtime [datafusion-comet]
via GitHub
Re: [PR] fix: defer throwing literal casts to Spark at runtime [datafusion-comet]
via GitHub
[I] Audit Comet logical-link repair across AQE replanning [datafusion-comet]
via GitHub
Re: [PR] fix: validate map constructor row lengths and null short-circuiting [datafusion-comet]
via GitHub
[PR] refactor: factor SortMergeJoinExec::execute into a reusable sort_merge_join_stream [datafusion]
via GitHub
Re: [PR] refactor: factor SortMergeJoinExec::execute into a reusable sort_merge_join_stream [datafusion]
via GitHub
[PR] fix: sort-merge join filter columns follow the filter's own column order [datafusion]
via GitHub
Re: [PR] fix: sort-merge join filter columns follow the filter's own column order [datafusion]
via GitHub
Re: [PR] fix: sort-merge join filter columns follow the filter's own column order [datafusion]
via GitHub
Re: [PR] fix: sort-merge join filter columns follow the filter's own column order [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
[I] UDF: consider returning an enum for `return_type` [datafusion]
via GitHub
Re: [I] UDF: consider returning an enum for `return_type` [datafusion]
via GitHub
Re: [I] Native Iceberg writes drop Hadoop GCS configuration for HadoopFileIO + gs:// [datafusion-comet]
via GitHub
[PR] docs: explain that Comet's memory comes out of the executor container [datafusion-comet]
via GitHub
Re: [PR] docs: explain that Comet's memory comes out of the executor container [datafusion-comet]
via GitHub
[I] Tuning guide does not explain that Comet's memory comes out of the executor container [datafusion-comet]
via GitHub
[PR] feat: scope-aware object_store cache for the S3 credential SPI [datafusion-comet]
via GitHub
Re: [PR] feat: scope-aware object_store cache for the S3 credential SPI [datafusion-comet]
via GitHub
Re: [PR] feat: scope-aware object_store cache for the S3 credential SPI [datafusion-comet]
via GitHub
Re: [PR] feat: scope-aware object_store cache for the S3 credential SPI [datafusion-comet]
via GitHub
[PR] docs: document the 24-hour review window for non-trivial pull requests [datafusion-comet]
via GitHub
Re: [PR] docs: document the 24-hour review window for non-trivial pull requests [datafusion-comet]
via GitHub
[PR] docs: show which config value sizes each region in the memory cgroup diagram [datafusion-comet]
via GitHub
Re: [PR] docs: show which config value sizes each region in the memory cgroup diagram [datafusion-comet]
via GitHub
Re: [PR] docs: show which config value sizes each region in the memory cgroup diagram [datafusion-comet]
via GitHub
Re: [PR] docs: show which config value sizes each region in the memory cgroup diagram [datafusion-comet]
via GitHub
Re: [PR] docs: show which config value sizes each region in the memory cgroup diagram [datafusion-comet]
via GitHub
Re: [PR] docs: show which config value sizes each region in the memory cgroup diagram [datafusion-comet]
via GitHub
[I] Memory management cgroup diagram does not show which config value sizes each region [datafusion-comet]
via GitHub
[PR] playground [datafusion]
via GitHub
Re: [PR] playground [datafusion]
via GitHub
Re: [PR] playground [datafusion]
via GitHub
Re: [PR] playground [datafusion]
via GitHub
Re: [PR] playground [datafusion]
via GitHub
Re: [PR] playground [datafusion]
via GitHub
Re: [PR] playground [datafusion]
via GitHub
Re: [PR] playground [datafusion]
via GitHub
Re: [PR] playground [datafusion]
via GitHub
Earlier messages