github
Thread
Date
Earlier messages
Later messages
Messages by Date
2026/08/20
Re: [I] Support functions date_bin and date_trunc in range partition satisfaction [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: use compact pruning for large string IN lists [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: honor Parquet byte-array statistics ordering [datafusion]
via GitHub
2026/08/20
[PR] chore: fix clippy warnings for Rust 1.98 [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] feat(parquet): add `bytes_processed` scan-completion metric [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: make UnnestExec respect datafusion.execution.batch_size [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: Native shuffle fails with a 2GB task serialization OOM on jobs with many partitions [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] perf: skip eval of standard window functions for unchanged partitions [datafusion]
via GitHub
2026/08/20
[PR] feat(parquet): add `bytes_processed` scan-completion metric [datafusion]
via GitHub
2026/08/20
Re: [PR] feat(parquet): add `bytes_processed` scan-completion metric [datafusion]
via GitHub
2026/08/20
Re: [I] Remove deprecated `ScalarUDF` / `ScalarUDFImpl` methods that are past the API health policy [datafusion]
via GitHub
2026/08/20
Re: [PR] feat(parquet): add `bytes_processed` scan-completion metric [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: optimizing take_n for DictionaryGroupValuesColumn [datafusion]
via GitHub
2026/08/20
[I] CI: Rust 1.98 Clippy lints break rust-test [datafusion-comet]
via GitHub
2026/08/20
Re: [I] Parquet scan silently drops one of two columns with the same name [datafusion]
via GitHub
2026/08/20
Re: [I] CSVReader behavior with dataset that has duplicate column headers is confusing [datafusion]
via GitHub
2026/08/20
[I] Derive a distinct count from primary key and unique constraints [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: Validate duration format at `SET` time [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: Validate filter selectivity at `SET` time [datafusion]
via GitHub
2026/08/20
[I] Filtered Parquet scans issue additional object-store requests after ParquetPushDecoder migration [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: parallel prefix scan for UNBOUNDED PRECEDING window aggregates [datafusion-ballista]
via GitHub
2026/08/20
Re: [PR] feat: derive a distinct count from primary key and unique constraints [datafusion]
via GitHub
2026/08/20
Re: [PR] IN LIST: reuse primitive filters for FixedSizeBinary [datafusion]
via GitHub
2026/08/20
Re: [PR] docs(dataframe): improve dataframe! and from_columns documentation (#… [datafusion]
via GitHub
2026/08/20
Re: [I] The config values aren't checked [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: use compact pruning for large string IN lists [datafusion]
via GitHub
2026/08/20
Re: [PR] [branch-55] fix: apply struct field filters when the file schema needs adaptation (#24125) [datafusion]
via GitHub
2026/08/20
Re: [PR] test: add range-partitioned sorted time-bin aggregation coverage [datafusion]
via GitHub
2026/08/20
[PR] fix: preserve nullability for non-empty scalar subqueries [datafusion]
via GitHub
2026/08/20
Re: [I] Inline ORDER BY drops arguments for approximate percentile aggregates [datafusion]
via GitHub
2026/08/20
[PR] fix: Validate duration format at `SET` time [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: add projection support to SortMergeJoinExec [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: preserve MERGE target qualifier bindings [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: adapt input batches with stricter nested nullability to planned schema in aggregation [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
Re: [PR] chore: add missing `since` versions to `#[deprecated]` attributes [datafusion]
via GitHub
2026/08/20
Re: [PR] chore: add missing `since` versions to `#[deprecated]` attributes [datafusion]
via GitHub
2026/08/20
Re: [PR] Derive total_byte_size for join statistics [datafusion]
via GitHub
2026/08/20
Re: [PR] Derive total_byte_size for join statistics [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
Re: [PR] refactor: Simplify and optimize Parquet projection planning for nested casts [datafusion]
via GitHub
2026/08/20
Re: [I] Error publishing datafusion-spark in datafusion 55.0.0 release "cannot find module or crate `datafusion` in this scope" [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
Re: [PR] chore: add missing `since` versions to `#[deprecated]` attributes [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: cache dictionary arc pointer [datafusion]
via GitHub
2026/08/20
Re: [I] Make filter pushdown API more precise for their purpose [datafusion]
via GitHub
2026/08/20
[PR] Add aggregate-specific metrics to legacy grouped hash and TopK [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: tree-style explain for memory table shows wrong row count [datafusion]
via GitHub
2026/08/20
Re: [PR] IN LIST: reuse primitive filters for FixedSizeBinary [datafusion]
via GitHub
2026/08/20
Re: [PR] Revise example usage section headings [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: cost-based join order enumeration [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: report native shuffle write metrics accurately [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] IN LIST: reuse primitive filters for FixedSizeBinary [datafusion]
via GitHub
2026/08/20
Re: [PR] ci: Check datafusion-spark feature combinations to catch publish errors [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: support filtered batches in `LimitedBatchCoalescer` [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
Re: [I] Bare -0.0 literals in SQL file tests are coerced through decimal, so signed-zero coverage is vacuous [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] test: fix vacuous signed-zero coverage in SQL file tests [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
Re: [PR] doc: more comments to `evaluate_selection` function [datafusion]
via GitHub
2026/08/20
[I] Join should report total_byte_size [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: reject inconsistent parameterized ScalarValues [datafusion]
via GitHub
2026/08/20
Re: [I] `ScalarValue::iter_to_array` accepts mismatched type parameters [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: support filtered batches in `LimitedBatchCoalescer` [datafusion]
via GitHub
2026/08/20
[PR] fix: Validate filter selectivity at `SET` time [datafusion]
via GitHub
2026/08/20
Re: [PR] [branch-55] fix: make UnnestExec respect datafusion.execution.batch_size (#24384) [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: adapt input batches with stricter nested nullability to planned schema in aggregation [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: parallel prefix scan for UNBOUNDED PRECEDING window aggregates [datafusion-ballista]
via GitHub
2026/08/20
Re: [PR] feat: derive a distinct count from primary key and unique constraints [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: parallel prefix scan for UNBOUNDED PRECEDING window aggregates [datafusion-ballista]
via GitHub
2026/08/20
Re: [PR] fix: prevent libhdfs thread destructor use-after-free [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] perf: skip eval of standard window functions for unchanged partitions [datafusion]
via GitHub
2026/08/20
[PR] chore: add missing `since` versions to `#[deprecated]` attributes [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: skip eval of standard window functions for unchanged partitions [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: support filtered batches in `LimitedBatchCoalescer` [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: support filtered batches in `LimitedBatchCoalescer` [datafusion]
via GitHub
2026/08/20
[PR] perf: skip evaluating unchanged partitions for standard window functions [datafusion]
via GitHub
2026/08/20
Re: [PR] bench(functions): group the 63 bench targets into 9 [datafusion]
via GitHub
2026/08/20
Re: [PR] feat(python): integrate Ballista through DataFusion FFI [datafusion-ballista]
via GitHub
2026/08/20
Re: [PR] refactor(parquet): strip empty row groups so PreparedAccessPlan stays well-formed [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: parallel prefix scan for UNBOUNDED PRECEDING window aggregates [datafusion-ballista]
via GitHub
2026/08/20
Re: [PR] chore: add missing `since` versions to `#[deprecated]` attributes [datafusion]
via GitHub
2026/08/20
Re: [PR] feat(python): integrate Ballista through DataFusion FFI [datafusion-ballista]
via GitHub
2026/08/20
Re: [PR] [branch-55] fix: apply struct field filters when the file schema needs adaptation (#24125) [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: skip hash shuffle for date_bin/date_trunc on Range([timestamp]) [datafusion]
via GitHub
2026/08/20
[I] Remove deprecated Parquet metadata / statistics APIs that are past the API health policy [datafusion]
via GitHub
2026/08/20
[I] Remove deprecated `Expr::Wildcard` variant [datafusion]
via GitHub
2026/08/20
[I] Remove assorted deprecated APIs that are past the API health policy [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
[PR] fix: reject inconsistent parameterized ScalarValues [datafusion]
via GitHub
2026/08/20
[I] `ScalarValue::iter_to_array` accepts mismatched type parameters [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: account for empty scalar subqueries in nullability [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: support filtered batches in `LimitedBatchCoalescer` [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: support filtered batches in `LimitedBatchCoalescer` [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: skip eval of standard window functions for unchanged partitions [datafusion]
via GitHub
2026/08/20
Re: [PR] [branch-55] fix: apply struct field filters when the file schema needs adaptation (#24125) [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: preserve nullability for non-empty scalar subqueries [datafusion]
via GitHub
2026/08/20
Re: [PR] ci: Check datafusion-spark feature combinations to catch publish errors [datafusion]
via GitHub
2026/08/20
[PR] fix: a join reports the size of the rows it emits [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: support filtered batches in `LimitedBatchCoalescer` [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: flush FilterExec output for unbounded inputs [datafusion]
via GitHub
2026/08/20
Re: [D] Policy on uptick of LLM PRs from new contributors [datafusion]
via GitHub
2026/08/20
[I] Remove deprecated `ScalarUDF` / `ScalarUDFImpl` methods that are past the API health policy [datafusion]
via GitHub
2026/08/20
Re: [PR] [branch-55] fix: apply struct field filters when the file schema needs adaptation (#24125) [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: preserve approximate percentile arguments with inline ORDER BY [datafusion]
via GitHub
2026/08/20
Re: [PR] test: add range-partitioned sorted time-bin aggregation coverage [datafusion]
via GitHub
2026/08/20
[I] Explore cargo matrix to verify feature combinations in CI [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: skip eval of standard window functions for unchanged partitions [datafusion]
via GitHub
2026/08/20
Re: [I] Discussion: API for Join Access Path and Join Order Selection [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: derive a distinct count from primary key and unique constraints [datafusion]
via GitHub
2026/08/20
Re: [PR] Revise example usage section headings [datafusion]
via GitHub
2026/08/20
Re: [PR] bench(functions): group the 63 bench targets into 9 [datafusion]
via GitHub
2026/08/20
Re: [I] UnnestExec `output_batches` metric does not match the number of emitted batches [datafusion]
via GitHub
2026/08/20
Re: [PR] [branch-55] fix: make UnnestExec respect datafusion.execution.batch_size (#24384) [datafusion]
via GitHub
2026/08/20
[PR] fix: format NativeMemoryConsumer id in toString [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] perf: optimizing take_n for DictionaryGroupValuesColumn [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: cost-based join order enumeration [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: reject duplicate field names during CSV and Parquet schema inference [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: count UnnestExec output batches after splitting [datafusion]
via GitHub
2026/08/20
Re: [PR] feat(parquet): add `bytes_processed` scan-completion metric [datafusion]
via GitHub
2026/08/20
Re: [PR] [DRAFT] update PushedDown to have 3 states [datafusion]
via GitHub
2026/08/20
[PR] [branch-55] fix: make UnnestExec respect datafusion.execution.batch_size (#24384) [datafusion]
via GitHub
2026/08/20
[PR] [branch-55] fix: apply struct field filters when the file schema needs adaptation (#24125) [datafusion]
via GitHub
2026/08/20
Re: [I] Make filter pushdown API more precise for their purpose [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: adapt input batches with stricter nested nullability to planned schema in aggregation [datafusion]
via GitHub
2026/08/20
Re: [I] Grouped floating-point `MIN` and `MAX` return order-dependent results for NaNs and signed zeros [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: expand float fuzz coverage and correct discovered inconsistencies [datafusion]
via GitHub
2026/08/20
Re: [I] `ScalarValue::eq_array` is inconsistent with `ScalarValue` equality for floating-point values [datafusion]
via GitHub
2026/08/20
Re: [PR] [DRAFT] update PushedDown to have 3 states [datafusion]
via GitHub
2026/08/20
Re: [I] Discussion: API for Join Access Path and Join Order Selection [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: apply struct field filters when the file schema needs adaptation [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: reuse the projected equivalence group when only child orderings change [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: reuse the projected equivalence group when only child orderings change [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: adapt input batches with stricter nested nullability to planned schema in aggregation [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: reuse the projected equivalence group when only child orderings change [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: honor Parquet byte-array statistics ordering [datafusion]
via GitHub
2026/08/20
Re: [I] [Follow-up #23696] Extract generic empty-row-group stripping from strip_empty_row_groups [datafusion]
via GitHub
2026/08/20
Re: [PR] refactor(asof_join): enhance match value handling and comparator caching [datafusion]
via GitHub
2026/08/20
[PR] add 3rd filter pushdown state [datafusion]
via GitHub
2026/08/20
Re: [I] Make filter pushdown API more precise for their purpose [datafusion]
via GitHub
2026/08/20
Re: [PR] refactor: Simplify and optimize Parquet projection planning for nested casts [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: adapt input batches with stricter nested nullability to planned schema in aggregation [datafusion]
via GitHub
2026/08/20
Re: [I] Improve performance for shuffle writes for nested schemas [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] feat(parquet): add `bytes_processed` scan-completion metric [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: reuse the projected equivalence group when only child orderings change [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: reuse the projected equivalence group when only child orderings change [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: reuse the projected equivalence group when only child orderings change [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: Native shuffle fails with a 2GB task serialization OOM on jobs with many partitions [datafusion-comet]
via GitHub
2026/08/20
Re: [I] Native shuffle fails with a 2GB task serialization OOM on jobs with very many partitions [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] fix: report native shuffle write metrics accurately [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] feat: add projection support to SortMergeJoinExec [datafusion]
via GitHub
2026/08/20
Re: [I] Use the offset buffer for Map in spark_size [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] perf: vectorize Map in spark_size via offset buffer [datafusion-comet]
via GitHub
2026/08/20
Re: [PR] perf: vectorize Map in spark_size via offset buffer [datafusion-comet]
via GitHub
2026/08/20
[PR] fix: honor Parquet byte-array statistics ordering [datafusion]
via GitHub
2026/08/20
[PR] perf: use compact pruning for large string IN lists [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: optimizing take_n for DictionaryGroupValuesColumn [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: add projection support to SortMergeJoinExec [datafusion]
via GitHub
2026/08/20
Re: [PR] refactor: Simplify and optimize Parquet projection planning for nested casts [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: optimizing take_n for DictionaryGroupValuesColumn [datafusion]
via GitHub
2026/08/20
Re: [I] Optimize take_n on DictionaryGroupValuesColumn<K> [datafusion]
via GitHub
2026/08/20
Re: [PR] change: fully deprecated the acceptance of value field in VirtualTables [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: optimizing take_n for DictionaryGroupValuesColumn (DRAFT) [datafusion]
via GitHub
2026/08/20
Re: [PR] test: add range-partitioned sorted time-bin aggregation coverage [datafusion]
via GitHub
2026/08/20
Re: [PR] Add aggregate-specific metrics to legacy grouped hash and TopK [datafusion]
via GitHub
2026/08/20
Re: [PR] change: fully deprecated the acceptance of value field in VirtualTables [datafusion]
via GitHub
2026/08/20
Re: [PR] fix: expand float fuzz coverage and correct discovered inconsistencies [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: reuse the projected equivalence group when only child orderings change [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: reuse the projected equivalence group when only child orderings change [datafusion]
via GitHub
2026/08/20
Re: [PR] docs: Add London DataFusion meetup to events page [datafusion]
via GitHub
2026/08/20
Re: [PR] chore(deps): bump the all-other-cargo-deps group across 1 directory with 2 updates [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: reuse the projected equivalence group when only child orderings change [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: derive a distinct count from primary key and unique constraints [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: derive a distinct count from primary key and unique constraints [datafusion]
via GitHub
2026/08/20
Re: [PR] test: add range-partitioned sorted time-bin aggregation coverage [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: derive a distinct count from primary key and unique constraints [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: cache dictionary arc pointer [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: add projection support to SortMergeJoinExec [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: derive a distinct count from primary key and unique constraints [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: add ASOF join physical operator [datafusion]
via GitHub
2026/08/20
Re: [PR] refactor(parquet): strip empty row groups so PreparedAccessPlan stays well-formed [datafusion]
via GitHub
2026/08/20
Re: [PR] refactor(parquet): strip empty row groups so PreparedAccessPlan stays well-formed [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: derive a distinct count from primary key and unique constraints [datafusion]
via GitHub
2026/08/20
[I] PostgreSQL CREATE TRIGGER parses execution arguments as data types [datafusion-sqlparser-rs]
via GitHub
2026/08/20
Re: [PR] feat: derive a distinct count from primary key and unique constraints [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: derive a distinct count from primary key and unique constraints [datafusion]
via GitHub
2026/08/20
Re: [PR] fix(parquet): strip empty row groups in PreparedAccessPlan::prepare [datafusion]
via GitHub
2026/08/20
Re: [PR] Split and deprecate `and_or` [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: cache dictionary arc pointer [datafusion]
via GitHub
2026/08/20
[PR] refactor: Simplify and optimize Parquet projection planning for nested casts [datafusion]
via GitHub
2026/08/20
Re: [PR] perf: cache dictionary arc pointer [datafusion]
via GitHub
2026/08/20
Re: [I] push_down_leaf_projections fails for self joins in some scenarios [datafusion]
via GitHub
2026/08/20
Re: [PR] feat: add ASOF join physical operator [datafusion]
via GitHub
2026/08/20
[PR] docs: Add London DataFusion meetup to events page [datafusion]
via GitHub
2026/08/20
Re: [PR] feat(python): integrate Ballista through DataFusion FFI [datafusion-ballista]
via GitHub
Earlier messages
Later messages