github
Thread
Date
Earlier messages
Messages by Thread
[PR] Document decimal AVG wrapping arithmetic [datafusion]
via GitHub
Re: [I] DataFusion drops grouped MIN/MAX rows with NULL sort keys under ORDER BY + LIMIT [datafusion]
via GitHub
[PR] fix: TopK aggregation drops groups whose MIN/MAX value is NULL [datafusion]
via GitHub
[PR] Add DataSource/FileSource proto hooks and FileScanConfig serde [datafusion]
via GitHub
Re: [PR] Add DataSource/FileSource proto hooks and FileScanConfig serde [datafusion]
via GitHub
Re: [PR] Add any_value aggregate function [datafusion]
via GitHub
Re: [PR] Add any_value aggregate function [datafusion]
via GitHub
Re: [PR] Support lower and upper scalar udf on dict arrays [datafusion]
via GitHub
Re: [PR] Support lower and upper scalar udf on dict arrays [datafusion]
via GitHub
[PR] test: promote `try_to_date`/`try_to_timestamp` SQL tests to native coverage [datafusion-comet]
via GitHub
Re: [PR] fix: multi-insert with native writer in Spark 4.x (#3430) [datafusion-comet]
via GitHub
Re: [PR] Query graph for Join reordering [datafusion]
via GitHub
Re: [PR] feat: Add `FFI_QueryPlanner` to support foreign query planners across shared-library boundaries [datafusion]
via GitHub
Re: [PR] feat: Add `FFI_QueryPlanner` to support foreign query planners across shared-library boundaries [datafusion]
via GitHub
Re: [PR] [Experiment] Adaptive filter pushdown [datafusion]
via GitHub
[PR] perf: vectorize `spark_unscaled_value` (9x faster) [datafusion-comet]
via GitHub
[PR] fix: `get_json_object` returns first value for duplicate keys to match Spark [datafusion-comet]
via GitHub
Re: [I] Support Substrait exchange output for range repartitioning [datafusion]
via GitHub
[PR] feat: add BALLISTA_PROTOCOL_VERSION + k8s health probes [datafusion-ballista]
via GitHub
Re: [PR] feat: add BALLISTA_PROTOCOL_VERSION + k8s health probes [datafusion-ballista]
via GitHub
Re: [PR] feat: add BALLISTA_PROTOCOL_VERSION + k8s health probes [datafusion-ballista]
via GitHub
[PR] feat(optimizer): coalesce peer first_value / last_value into a single struct aggregate [datafusion]
via GitHub
Re: [PR] feat(optimizer): coalesce peer first_value / last_value into a single struct aggregate [datafusion]
via GitHub
[PR] feat(optimizer): coalesce peer first_value / last_value into a single struct aggregate [datafusion]
via GitHub
[PR] Add visitors for ORDER BY and GROUP BY [datafusion-sqlparser-rs]
via GitHub
Re: [PR] Align metadata propagation through Physical and Logical casts [datafusion]
via GitHub
[PR] chore(deps): bump the codeql-actions group with 2 updates [datafusion-comet]
via GitHub
Re: [I] Track Spark 4.2 test failures [datafusion-comet]
via GitHub
Re: [I] Track Spark 4.2 test failures [datafusion-comet]
via GitHub
[I] Spark 4.2: native Iceberg REST catalog scan test fails under Comet [datafusion-comet]
via GitHub
[PR] [WIP] allow range to satisfy key distribution generally [datafusion]
via GitHub
[I] Spark 4.2: BloomFilter tests fail under Comet [datafusion-comet]
via GitHub
[I] Spark 4.2: ANSI arithmetic overflow tests fail under Comet [datafusion-comet]
via GitHub
[I] Spark 4.2: SQL Last Attempt Metric (SLAM) not propagated through Comet operators [datafusion-comet]
via GitHub
[I] Spark 4.2: UnionCodegenSuite partitioning-aware test inspects UnionExec that Comet replaces [datafusion-comet]
via GitHub
[I] Spark 4.2: segment-tree window metrics unavailable under CometWindowExec [datafusion-comet]
via GitHub
[I] Spark 4.2: Comet native collect_set does not normalize NaN / -0.0 (SPARK-57298) [datafusion-comet]
via GitHub
[PR] chore: codeql dependabot fix [datafusion-comet]
via GitHub
Re: [PR] chore: codeql dependabot fix [datafusion-comet]
via GitHub
[PR] Add Comet 1.0.0 release announcement blog post [datafusion-site]
via GitHub
Re: [PR] chore: Test update object store to 0.14.0 [datafusion]
via GitHub
Re: [PR] chore: Test update object store to 0.14.0 [datafusion]
via GitHub
[PR] chore: add 0.17.1 changelog [datafusion-comet]
via GitHub
Re: [PR] docs: add 0.17.1 changelog [datafusion-comet]
via GitHub
[PR] ci: gate expensive workflows on lint by consolidating into rust.yml [datafusion-ballista]
via GitHub
Re: [PR] ci: gate expensive workflows on lint by consolidating into rust.yml [datafusion-ballista]
via GitHub
Re: [I] Create a pipeline/morsel scheduler [datafusion]
via GitHub
[PR] chore: Enable `unused_async` lint [datafusion]
via GitHub
Re: [PR] chore: Enable `unused_async` lint [datafusion]
via GitHub
Re: [PR] chore: Enable `unused_async` lint [datafusion]
via GitHub
[I] Expand Session trait to parity with SessionState [datafusion]
via GitHub
Re: [I] Expand Session trait to parity with SessionState [datafusion]
via GitHub
Re: [PR] fix: Capture global ORDER BY requirement under ScalarSubqueryExec root [datafusion]
via GitHub
Re: [PR] fix: Capture global ORDER BY requirement under ScalarSubqueryExec root [datafusion]
via GitHub
[PR] fix: Capture global ORDER BY requirement under ScalarSubqueryExec root [datafusion]
via GitHub
Re: [PR] fix: Capture global ORDER BY requirement under ScalarSubqueryExec root [datafusion]
via GitHub
Re: [PR] fix: Capture global ORDER BY requirement under ScalarSubqueryExec root [datafusion]
via GitHub
Re: [I] Move static support decisions from serde convert into getSupportLevel [datafusion-comet]
via GitHub
Re: [I] [DISCUSSION] Future of Dynamic Filters Sync [datafusion]
via GitHub
Re: [I] [DISCUSSION] Future of Dynamic Filters Sync [datafusion]
via GitHub
Re: [I] [DISCUSSION] Future of Dynamic Filters Sync [datafusion]
via GitHub
Re: [I] [DISCUSSION] Future of Dynamic Filters Sync [datafusion]
via GitHub
Re: [I] [DISCUSSION] Future of Dynamic Filters Sync [datafusion]
via GitHub
Re: [I] [DISCUSSION] Future of Dynamic Filters Sync [datafusion]
via GitHub
Re: [PR] feat(spark): port Spark-compatible Parquet schema adapter from Comet [datafusion]
via GitHub
Re: [PR] feat(spark): port Spark-compatible Parquet schema adapter from Comet [datafusion]
via GitHub
[PR] fix: preserve precision in log() with mixed-width float arguments [datafusion]
via GitHub
Re: [PR] fix: preserve precision in log() with mixed-width float arguments [datafusion]
via GitHub
Re: [PR] fix: preserve precision in log() with mixed-width float arguments [datafusion]
via GitHub
[I] Extract common regex compilation cache for reuse across regexp functions [datafusion]
via GitHub
[PR] chore: bump spark-4.2 profile to the released 4.2.0 [datafusion-comet]
via GitHub
Re: [PR] chore: bump spark-4.2 profile to the released 4.2.0 [datafusion-comet]
via GitHub
Re: [PR] chore: bump spark-4.2 profile to the released 4.2.0 [datafusion-comet]
via GitHub
Re: [I] Implement TimeType support: Infrastructure - shuffle [datafusion-comet]
via GitHub
[PR] feat: make AQE respect broadcast_join_threshold_bytes [datafusion-ballista]
via GitHub
Re: [PR] feat: make broadcast_join_threshold_bytes/rows authoritative under AQE and the static planner [datafusion-ballista]
via GitHub
[I] `ballista.optimizer.broadcast_join_threshold_bytes` has no effect when adaptive query planning is enabled [datafusion-ballista]
via GitHub
[I] Further optimize Spark hex byte encoding: reuse input NullBuffer and special-case the no-nulls path [datafusion]
via GitHub
Re: [I] Further optimize Spark hex byte encoding: reuse input NullBuffer and special-case the no-nulls path [datafusion]
via GitHub
[PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
Re: [PR] feat: re-enable COUNT for mixed Spark partial / Comet final aggregates [datafusion-comet]
via GitHub
Re: [PR] feat: add comet_version() SQL function [datafusion-comet]
via GitHub
Re: [PR] feat: add comet_version() SQL function [datafusion-comet]
via GitHub
Re: [PR] feat: custom Rust UDFs via arrow-ffi (alternative to #4283) [experimental] [datafusion-comet]
via GitHub
Re: [PR] feat: custom Rust UDFs via arrow-ffi (alternative to #4283) [experimental] [datafusion-comet]
via GitHub
[PR] feat: removed all instances of deprecated virtualtable values field [datafusion]
via GitHub
Re: [PR] feat: removed all instances of deprecated virtualtable values field [datafusion]
via GitHub
Re: [I] [Feature] support size() for MapType inputs [datafusion-comet]
via GitHub
Re: [I] Unable to use Ballista at scale (e.g. TPC-H @ 1TB) [datafusion-ballista]
via GitHub
Re: [I] Some benchmark queries fail or produce incorrect results [datafusion-ballista]
via GitHub
Re: [I] Some benchmark queries fail or produce incorrect results [datafusion-ballista]
via GitHub
Re: [I] Document how to run TPC-H benchmarks in Kubernetes [datafusion-ballista]
via GitHub
Re: [I] Document how to run TPC-H benchmarks in Kubernetes [datafusion-ballista]
via GitHub
Re: [I] Improve benchmark performance [datafusion-ballista]
via GitHub
Re: [I] Improve benchmark performance [datafusion-ballista]
via GitHub
[I] cast string to boolean: trim ISO control bytes to match Spark's UTF8String.trimAll [datafusion-comet]
via GitHub
[I] Thread `PhysicalOptimizerContext` through `join_selection` stats helpers (CBO extension pattern) [datafusion]
via GitHub
Re: [I] Thread `PhysicalOptimizerContext` through `join_selection` stats helpers (CBO extension pattern) [datafusion]
via GitHub
Re: [PR] fix: avoid full listings for cached pruned partitions [datafusion]
via GitHub
[PR] fix(datasource): avoid over-conservative transformation of num_rows statistics in file scan config [datafusion]
via GitHub
Re: [PR] fix(datasource): avoid over-conservative transformation of num_rows statistics in file scan config [datafusion]
via GitHub
[PR] fix: handle NULL string and format arguments in to_date, to_timestamp, and to_unixtime [datafusion]
via GitHub
Re: [PR] fix: handle NULL string and format arguments in to_date, to_timestamp, and to_unixtime [datafusion]
via GitHub
Re: [PR] fix: handle NULL string and format arguments in to_date, to_timestamp, and to_unixtime [datafusion]
via GitHub
Re: [PR] fix: handle NULL string and format arguments in to_date, to_timestamp, and to_unixtime [datafusion]
via GitHub
Re: [PR] fix: handle NULL string and format arguments in to_date, to_timestamp, and to_unixtime [datafusion]
via GitHub
Re: [I] PostgreSQL compatibility: `time + interval` should wrap within the 24-hour time domain [datafusion]
via GitHub
Re: [I] PostgreSQL compatibility: `time - interval` should wrap within the 24-hour time domain [datafusion]
via GitHub
[I] Centralize aggregate-scope expression rendering in the SQL unparser [datafusion]
via GitHub
[I] Centralize higher-order list lambda evaluation helpers [datafusion]
via GitHub
[I] Refactor: Add an optimizer-local helper for schema-aware child rewrites [datafusion]
via GitHub
[I] Document decimal AVG wrapping arithmetic behind explicit helpers [datafusion]
via GitHub
Re: [I] Bug in lambda variable resolution [datafusion]
via GitHub
[PR] test: Fix data_pagesize_limit extraction in parquet writer props roundtrip test [datafusion]
via GitHub
Re: [PR] test: Fix data_pagesize_limit extraction in parquet writer props roundtrip test [datafusion]
via GitHub
[PR] fix: size the AQE broadcast decision by bytes, not row count [datafusion-ballista]
via GitHub
Re: [PR] fix: size the AQE broadcast decision by bytes, not row count [datafusion-ballista]
via GitHub
Re: [PR] fix: size the AQE broadcast decision by bytes, not row count [datafusion-ballista]
via GitHub
[PR] chore(deps): bump lz4_flex from 0.13.1 to 0.14.0 in /native [datafusion-comet]
via GitHub
Re: [PR] chore(deps): bump lz4_flex from 0.13.1 to 0.14.0 in /native [datafusion-comet]
via GitHub
[PR] chore(deps): bump object_store from 0.13.2 to 0.14.1 in /native [datafusion-comet]
via GitHub
Re: [PR] chore(deps): bump object_store from 0.13.2 to 0.14.1 in /native [datafusion-comet]
via GitHub
Re: [PR] chore(deps): bump object_store from 0.13.2 to 0.14.1 in /native [datafusion-comet]
via GitHub
Re: [PR] chore(deps): bump object_store from 0.13.2 to 0.14.1 in /native [datafusion-comet]
via GitHub
[PR] chore(deps): bump the all-other-cargo-deps group in /native with 6 updates [datafusion-comet]
via GitHub
Re: [PR] chore(deps): bump the all-other-cargo-deps group across 1 directory with 6 updates [datafusion-comet]
via GitHub
[PR] feat: Add Struct type to approx_distinct [datafusion]
via GitHub
Re: [PR] feat: Add Struct type to approx_distinct [datafusion]
via GitHub
Re: [PR] feat: Support Struct type in approx_distinct [datafusion]
via GitHub
Re: [PR] feat: Support Struct type in approx_distinct [datafusion]
via GitHub
Re: [PR] feat: Support Struct type in approx_distinct [datafusion]
via GitHub
[PR] chore(deps): bump actions/setup-node from 6 to 7 [datafusion-comet]
via GitHub
Re: [PR] chore(deps): bump actions/setup-node from 6 to 7 [datafusion-comet]
via GitHub
[PR] chore(deps): bump github/codeql-action/analyze from 4.36.2 to 4.37.1 [datafusion-comet]
via GitHub
Re: [PR] chore(deps): bump github/codeql-action/analyze from 4.36.2 to 4.37.1 [datafusion-comet]
via GitHub
Re: [PR] chore(deps): bump github/codeql-action/analyze from 4.36.2 to 4.37.1 [datafusion-comet]
via GitHub
Re: [PR] chore(deps): bump github/codeql-action/analyze from 4.36.2 to 4.37.1 [datafusion-comet]
via GitHub
[PR] chore(deps): bump github/codeql-action/init from 4.36.2 to 4.37.1 [datafusion-comet]
via GitHub
Re: [PR] chore(deps): bump github/codeql-action/init from 4.36.2 to 4.37.1 [datafusion-comet]
via GitHub
Re: [PR] chore(deps): bump github/codeql-action/init from 4.36.2 to 4.37.1 [datafusion-comet]
via GitHub
[PR] chore: Fix duplicated word typos in comments [datafusion]
via GitHub
Re: [PR] chore: Fix duplicated word typos in comments [datafusion]
via GitHub
Re: [PR] chore: Fix duplicated word typos in comments [datafusion]
via GitHub
Re: [PR] chore: Fix duplicated word typos in comments [datafusion]
via GitHub
[PR] chore(deps): bump tokio from 1.52.4 to 1.53.0 [datafusion-ballista]
via GitHub
Re: [PR] chore(deps): bump tokio from 1.52.4 to 1.53.0 [datafusion-ballista]
via GitHub
[PR] chore(deps): bump tokio from 1.52.4 to 1.53.0 in /python [datafusion-ballista]
via GitHub
Re: [PR] chore(deps): bump tokio from 1.52.4 to 1.53.0 in /python [datafusion-ballista]
via GitHub
[I] AQE broadcast decision falls back to a size-blind row threshold when total_byte_size is unknown [datafusion-ballista]
via GitHub
[PR] minor(CI): Use `install-action` to speed up ci [datafusion]
via GitHub
Re: [PR] minor(CI): Use `install-action` to speed up ci [datafusion]
via GitHub
Re: [PR] minor(CI): Use `install-action` to speed up ci [datafusion]
via GitHub
Re: [PR] minor(CI): Use `install-action` to speed up ci [datafusion]
via GitHub
[PR] [branch-54] Fix evaluation of lambda with multiple parameters when some are unused (backport of #22853, adapted) [datafusion]
via GitHub
Re: [PR] [branch-54] Fix evaluation of lambda with multiple parameters when some are unused (backport of #22853, adapted) [datafusion]
via GitHub
Re: [PR] [branch-54] Fix evaluation of lambda with multiple parameters when some are unused (backport of #22853, adapted) [datafusion]
via GitHub
Re: [PR] [branch-54] Fix evaluation of lambda with multiple parameters when some are unused (backport of #22853, adapted) [datafusion]
via GitHub
Re: [PR] [branch-54] Fix evaluation of lambda with multiple parameters when some are unused (backport of #22853, adapted) [datafusion]
via GitHub
Re: [PR] [branch-54] Fix evaluation of lambda with multiple parameters when some are unused (backport of #22853, adapted) [datafusion]
via GitHub
[PR] chore: downsize `sql_planner_extended` `logical_plan_optimize` sample size to 10 [datafusion]
via GitHub
Re: [PR] chore: downsize `sql_planner_extended` `logical_plan_optimize` sample size to 10 [datafusion]
via GitHub
Re: [PR] chore: downsize `sql_planner_extended` `logical_plan_optimize` sample size to 10 [datafusion]
via GitHub
Re: [PR] chore: downsize `sql_planner_extended` `logical_plan_optimize` sample size to 5 [datafusion]
via GitHub
[I] Extend aggregation fuzz testing with memory-limit tests [datafusion]
via GitHub
[PR] refactor(hash-aggr): Support spilling for ordered aggregation [datafusion]
via GitHub
Re: [PR] refactor(hash-aggr): Support spilling for ordered aggregation [datafusion]
via GitHub
[PR] chore(deps): bump tokio from 1.52.3 to 1.52.4 [datafusion-ballista]
via GitHub
Re: [PR] chore(deps): bump tokio from 1.52.3 to 1.52.4 [datafusion-ballista]
via GitHub
[PR] chore(deps): bump tokio from 1.52.3 to 1.52.4 in /python [datafusion-ballista]
via GitHub
Re: [PR] chore(deps): bump tokio from 1.52.3 to 1.52.4 in /python [datafusion-ballista]
via GitHub
[PR] chore(deps): bump taiki-e/install-action from 2.83.2 to 2.83.3 [datafusion-ballista]
via GitHub
Re: [PR] chore(deps): bump taiki-e/install-action from 2.83.2 to 2.83.3 [datafusion-ballista]
via GitHub
[PR] chore(deps): bump github/codeql-action/init from 4.37.0 to 4.37.1 [datafusion-ballista]
via GitHub
Re: [PR] chore(deps): bump github/codeql-action/init from 4.37.0 to 4.37.1 [datafusion-ballista]
via GitHub
[PR] chore(deps): bump github/codeql-action/analyze from 4.37.0 to 4.37.1 [datafusion-ballista]
via GitHub
Re: [PR] chore(deps): bump github/codeql-action/analyze from 4.37.0 to 4.37.1 [datafusion-ballista]
via GitHub
Re: [PR] chore(deps): bump github/codeql-action/analyze from 4.37.0 to 4.37.1 [datafusion-ballista]
via GitHub
Re: [PR] Make clickhouse tuples work [datafusion-sqlparser-rs]
via GitHub
Earlier messages