github
Thread
Date
Earlier messages
Messages by Thread
Re: [I] Drop the per-batch Comet→Spark buffer copy in CometColumnarPythonInput [datafusion-comet]
via GitHub
[PR] feat: support large Arrow inputs for accelerated Python UDFs [datafusion-comet]
via GitHub
[PR] fix: accept UTC timezone aliases in Python Arrow input [datafusion-comet]
via GitHub
[I] datafusion-proto: logical plan decode re-normalizes already-normalized plans, superlinear on wide plans [datafusion]
via GitHub
[I] datafusion-proto: column qualifiers containing `.` are silently corrupted on round-trip [datafusion]
via GitHub
[PR] refactor(proto): destructure lambda expression serde hooks [datafusion]
via GitHub
Re: [PR] refactor(proto): destructure lambda expression serde hooks [datafusion]
via GitHub
[I] Support useLargeVarTypes in accelerated mapInArrow/mapInPandas [datafusion-comet]
via GitHub
[PR] fix: report native shuffle read metrics [datafusion-comet]
via GitHub
[PR] build(deps): bump log from 0.4.32 to 0.4.34 [datafusion-python]
via GitHub
Re: [PR] build(deps): bump log from 0.4.32 to 0.4.33 [datafusion-python]
via GitHub
Re: [PR] build(deps): bump log from 0.4.32 to 0.4.33 [datafusion-python]
via GitHub
[PR] build(deps): bump uuid from 1.23.3 to 1.25.0 [datafusion-python]
via GitHub
Re: [PR] fix(substrait): roundtrip scalar subqueries in projections [datafusion]
via GitHub
Re: [PR] fix(substrait): roundtrip scalar subqueries in projections [datafusion]
via GitHub
Re: [PR] fix(substrait): preserve grouping set output order [datafusion]
via GitHub
Re: [PR] fix(substrait): preserve window function semantics [datafusion]
via GitHub
[PR] fix: Show unique valid field names when an invalid one is provided [datafusion]
via GitHub
Re: [PR] fix: Show unique valid field names when an invalid one is provided [datafusion]
via GitHub
[I] Checked TIMESTAMP_MILLIS overflow for nested fields and nested-predicate scans is blocked on DataFusion nested-field pruning [datafusion-comet]
via GitHub
Re: [I] Checked TIMESTAMP_MILLIS overflow for nested fields and nested-predicate scans is blocked on DataFusion nested-field pruning [datafusion-comet]
via GitHub
[I] Duplicate valid fields in error message with nested queries [datafusion]
via GitHub
[I] first_value/last_value GroupsAccumulator ignores beneficial input ordering (is_input_pre_ordered) [datafusion]
via GitHub
[I] [FEATURE] Enable direct top-level Variant projection in ordinary native Parquet scans [datafusion-comet]
via GitHub
Re: [I] [FEATURE] Enable direct top-level Variant projection in ordinary native Parquet scans [datafusion-comet]
via GitHub
[I] [FEATURE] Export complete Arrow Fields through the native FFI boundary [datafusion-comet]
via GitHub
Re: [I] [FEATURE] Export complete Arrow Fields through the native FFI boundary [datafusion-comet]
via GitHub
[I] [FEATURE] Normalize marked Variant arrays at the native Parquet boundary [datafusion-comet]
via GitHub
Re: [I] [FEATURE] Normalize marked Variant arrays at the native Parquet boundary [datafusion-comet]
via GitHub
[PR] fix: preserve Arrow Field metadata across C Data exports [datafusion-comet]
via GitHub
Re: [PR] fix: preserve Arrow Field metadata across C Data exports [datafusion-comet]
via GitHub
Re: [PR] fix: preserve Arrow Field metadata across C Data exports [datafusion-comet]
via GitHub
Re: [PR] fix: preserve Arrow Field metadata across C Data exports [datafusion-comet]
via GitHub
Re: [PR] fix: preserve Arrow Field metadata across C Data exports [datafusion-comet]
via GitHub
[I] [FEATURE] Native top-level Variant projection from ordinary Parquet [datafusion-comet]
via GitHub
Re: [I] [FEATURE] Native top-level Variant projection from ordinary Parquet [datafusion-comet]
via GitHub
[I] [FEATURE] Match Spark physical Parquet semantics for projected Variant columns [datafusion-comet]
via GitHub
Re: [I] [FEATURE] Match Spark physical Parquet semantics for projected Variant columns [datafusion-comet]
via GitHub
[I] [FEATURE] Carry Spark VariantType identity through Comet schema serialization [datafusion-comet]
via GitHub
Re: [I] [FEATURE] Carry Spark VariantType identity through Comet schema serialization [datafusion-comet]
via GitHub
[PR] fix: preserve nested collection expression semantics [datafusion-comet]
via GitHub
Re: [PR] fix: preserve nested collection expression semantics [datafusion-comet]
via GitHub
Re: [PR] feat(physical-plan): Make `HashTableLookupExpr` serializable [datafusion]
via GitHub
[PR] test: enable `DurationSecond` fuzzing [datafusion]
via GitHub
Re: [PR] test: enable `DurationSecond` fuzzing [datafusion]
via GitHub
Re: [PR] test: enable `DurationSecond` fuzzing [datafusion]
via GitHub
[I] Fix remaining reported issues for arrays of map [datafusion-comet]
via GitHub
Re: [I] Fix remaining reported issues for arrays of map [datafusion-comet]
via GitHub
Re: [I] Fix remaining reported issues for arrays of map [datafusion-comet]
via GitHub
Re: [I] [Incompatibility] Document array_join null handling differences [datafusion-comet]
via GitHub
[PR] Preserve single quote literal display [datafusion-sqlparser-rs]
via GitHub
[PR] perf: project cached batches by buffer selection, prune on collated strings [datafusion-comet]
via GitHub
[PR] Preserve numeric compound field access display [datafusion-sqlparser-rs]
via GitHub
Re: [PR] Preserve numeric compound field access display [datafusion-sqlparser-rs]
via GitHub
Re: [I] PostgreSQL compatibility: `ln(-1.0::float8)` should error, not return NaN [datafusion]
via GitHub
Re: [I] PostgreSQL compatibility: `log(0.0::float8)` should error, not return `-inf` [datafusion]
via GitHub
Re: [I] Add spilling support for HashJoin [datafusion]
via GitHub
Re: [I] Add spilling support for HashJoin [datafusion]
via GitHub
[I] Memory Limited Joins (Externalized / Spill) [datafusion]
via GitHub
Re: [I] Memory Limited Joins (Externalized / Spill) [datafusion]
via GitHub
Re: [I] Memory Limited Joins (Externalized / Spill) [datafusion]
via GitHub
Re: [I] Memory Limited Joins (Externalized / Spill) [datafusion]
via GitHub
Re: [I] Memory Limited Joins (Externalized / Spill) [datafusion]
via GitHub
Re: [PR] fix: log(0.0::float8) should error, not return -inf [datafusion]
via GitHub
Re: [I] Supporting analytics over large amounts of pre‑partitioned data [datafusion]
via GitHub
Re: [I] Supporting analytics over large amounts of pre‑partitioned data [datafusion]
via GitHub
Re: [PR] fix sqrt(-1.0::float8) should error, not return NaN [datafusion]
via GitHub
Re: [PR] fixing negative power to zero [datafusion]
via GitHub
[PR] fix: prune row groups when file statistics collapse the predicate to a constant [datafusion]
via GitHub
[I] Native Azure store lets ambient AZURE_* environment variables override or corrupt explicit Hadoop auth config [datafusion-comet]
via GitHub
Re: [I] Native Azure store lets ambient AZURE_* environment variables override or corrupt explicit Hadoop auth config [datafusion-comet]
via GitHub
[I] Iceberg native scan fails queries on tables whose column names are case-distinct to Java but not to Rust [datafusion-comet]
via GitHub
[I] Iceberg native scan claims schemes it cannot execute; three scheme lists disagree [datafusion-comet]
via GitHub
Re: [I] Iceberg native scan claims schemes it cannot execute; three scheme lists disagree [datafusion-comet]
via GitHub
[I] Regression: DataFusion 55 no longer prunes row groups for `col = <literal>` when statistics show the column is entirely NULL [datafusion]
via GitHub
Re: [I] Regression: DataFusion 55 no longer prunes row groups for `col = <literal>` when statistics show the column is entirely NULL [datafusion]
via GitHub
Re: [I] `avg(decimal)` might lose precision and cause an overflow over return type [datafusion]
via GitHub
[I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
[PR] feat: use object store for history server persistence [datafusion-ballista]
via GitHub
Re: [I] `ScalarValue::iter_to_array` accepts mismatched type parameters [datafusion]
via GitHub
Re: [I] warning: linker stderr: ld: __eh_frame section too large [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Enable Adaptive Query Execution (AQE) by default [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Enable Adaptive Query Execution (AQE) by default [datafusion-ballista]
via GitHub
Re: [I] Ballista 53.0.0 — Coordinator OOM Crash on TPCH SF100 [datafusion-ballista]
via GitHub
Re: [I] Ballista 53.0.0 — Coordinator OOM Crash on TPCH SF100 [datafusion-ballista]
via GitHub
Re: [I] Update benchmark results in README [datafusion-ballista]
via GitHub
Re: [I] Update benchmark results in README [datafusion-ballista]
via GitHub
Re: [I] Unable to use Ballista at scale (e.g. TPC-H @ 1TB) [datafusion-ballista]
via GitHub
Re: [I] Unable to use Ballista at scale (e.g. TPC-H @ 1TB) [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Adaptive Query Execution (AQE) [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Adaptive Query Execution (AQE) [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Adaptive Query Execution (AQE) [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Shuffle file execs improvement [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Shuffle file execs improvement [datafusion-ballista]
via GitHub
[PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
Re: [PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
Re: [PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
Re: [PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
Re: [PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
[PR] fix(core): stop forwarding BallistaConfig defaults to the scheduler [datafusion-ballista]
via GitHub
Re: [PR] fix(core): stop forwarding BallistaConfig defaults to the scheduler [datafusion-ballista]
via GitHub
Re: [I] perf: bypass Arrow FFI for broadcast exchange reads [datafusion-comet]
via GitHub
[PR] perf: add direct native reads for broadcast exchange [datafusion-comet]
via GitHub
Re: [PR] perf: add direct native reads for broadcast exchange [datafusion-comet]
via GitHub
[PR] fix: align Spark collect aggregate element nullability [datafusion]
via GitHub
Re: [PR] fix: align Spark collect aggregate element nullability [datafusion]
via GitHub
Re: [PR] fix: align Spark collect aggregate element nullability [datafusion]
via GitHub
[PR] feat: allow scaling RangePartitioning [datafusion]
via GitHub
Re: [PR] feat: allow scaling RangePartitioning [datafusion]
via GitHub
Re: [PR] feat: allow scaling RangePartitioning [datafusion]
via GitHub
[I] `octet_length` should accept binary types [datafusion]
via GitHub
Re: [I] Memory should not blow up after Arrow IPC write-read round trip during spilling [datafusion]
via GitHub
Re: [PR] Support reading files with a boolean SBBF written by Parquet Java [datafusion]
via GitHub
[I] NestedLoopJoin memory-limited fallback lacks cross-partition left-bitmap coordination, so LEFT/FULL joins over a partitioned right side cannot spill [datafusion]
via GitHub
[PR] feat: enable native-only Celeborn shuffle planning (8/n) [datafusion-comet]
via GitHub
Re: [PR] feat: enable native-only Celeborn shuffle planning (8/n) [datafusion-comet]
via GitHub
Re: [PR] feat: enable native-only Celeborn shuffle planning (8/n) [datafusion-comet]
via GitHub
Re: [PR] feat: enable native-only Celeborn shuffle planning (8/n) [datafusion-comet]
via GitHub
[I] Native Celeborn shuffle: the installed Celeborn bootstrap hook can break client creation for the whole executor [datafusion-comet]
via GitHub
[I] Native Celeborn shuffle: default maxFrameBytes of 64 MiB is unreachable, and a large row fails the whole job [datafusion-comet]
via GitHub
[I] Native Celeborn shuffle: the remote read path costs up to 4.5x local decode and is unbenchmarked [datafusion-comet]
via GitHub
[I] Native Celeborn shuffle: validate_remote_schema rejects dictionary shapes the shuffle writer can emit [datafusion-comet]
via GitHub
[I] NativeUtil.getNextBatch leaks Arrow structs when importVector fails [datafusion-comet]
via GitHub
[PR] feat: add raw Celeborn native shuffle reader (7/n) [datafusion-comet]
via GitHub
Re: [PR] feat: add raw Celeborn native shuffle reader (7/n) [datafusion-comet]
via GitHub
Re: [PR] feat: add raw Celeborn native shuffle reader (7/n) [datafusion-comet]
via GitHub
Re: [PR] feat: add raw Celeborn native shuffle reader (7/n) [datafusion-comet]
via GitHub
Re: [PR] feat: add raw Celeborn native shuffle reader (7/n) [datafusion-comet]
via GitHub
Re: [PR] feat: add raw Celeborn native shuffle reader (7/n) [datafusion-comet]
via GitHub
Re: [PR] feat: add raw Celeborn native shuffle reader (7/n) [datafusion-comet]
via GitHub
Re: [I] collect_list/collect_set can fail with "column types must match schema types" on nested-field nullability drift [datafusion-comet]
via GitHub
Re: [I] Support config matrix for slt tests [datafusion]
via GitHub
Re: [I] ANSI `abs` integer overflow errors use Arrow-style type names instead of Spark's [datafusion-comet]
via GitHub
Re: [I] Parallel merge in SortPreservingMergeExec after sort elimination [datafusion]
via GitHub
Re: [I] Explore options for accelerating InMemoryTableScanExec [datafusion-comet]
via GitHub
[I] Enable `enable_row_number_to_aggregate` by default [datafusion]
via GitHub
Re: [I] Enable `enable_row_number_to_aggregate` by default [datafusion]
via GitHub
Re: [I] `FLOOR` decimal returns unexpected error [datafusion]
via GitHub
[I] Native Celeborn shuffle: reflectively replacing Celeborn's final fields can release push admission while payloads are in flight [datafusion-comet]
via GitHub
[PR] fix: literal-on-left equality no longer collapses the filter to false [datafusion]
via GitHub
[I] FFI_QueryPlanner captures its codecs by value, so a nested foreign planner keeps stale codecs [datafusion]
via GitHub
[PR] fix: preserve skipped unbase64 rows [datafusion-comet]
via GitHub
Re: [PR] fix: preserve skipped unbase64 rows [datafusion-comet]
via GitHub
Re: [PR] fix: preserve skipped unbase64 rows [datafusion-comet]
via GitHub
Re: [PR] perf: serialize Python input directly from Comet Arrow vectors [datafusion-comet]
via GitHub
Re: [PR] perf: serialize Python input directly from Comet Arrow vectors [datafusion-comet]
via GitHub
Re: [PR] perf: serialize Python input directly from Comet Arrow vectors [datafusion-comet]
via GitHub
Re: [PR] perf: serialize Python input directly from Comet Arrow vectors [datafusion-comet]
via GitHub
Re: [PR] perf: serialize Python input directly from Comet Arrow vectors [datafusion-comet]
via GitHub
Re: [PR] perf: serialize Python input directly from Comet Arrow vectors [datafusion-comet]
via GitHub
Re: [PR] perf: serialize Python input directly from Comet Arrow vectors [datafusion-comet]
via GitHub
Re: [PR] perf: serialize Python input directly from Comet Arrow vectors [datafusion-comet]
via GitHub
Re: [PR] perf: serialize Python input directly from Comet Arrow vectors [datafusion-comet]
via GitHub
[I] unbase64 can fail on rows skipped by LIMIT and semi/anti joins [datafusion-comet]
via GitHub
[I] Native Celeborn shuffle: add a Celeborn test dependency so the reflection against its internals is verified [datafusion-comet]
via GitHub
Re: [I] Native Celeborn shuffle: add a Celeborn test dependency so the reflection against its internals is verified [datafusion-comet]
via GitHub
[PR] chore: require an approving review before merging [datafusion-ballista]
via GitHub
Re: [PR] chore: require an approving review before merging [datafusion-ballista]
via GitHub
Re: [PR] chore: require an approving review before merging [datafusion-ballista]
via GitHub
Re: [PR] chore: require an approving review before merging [datafusion-ballista]
via GitHub
Re: [PR] chore: require an approving review before merging [datafusion-ballista]
via GitHub
Re: [PR] chore: require an approving review before merging [datafusion-ballista]
via GitHub
Re: [I] Implement equivalent of Spark History Server [datafusion-ballista]
via GitHub
[I] update data type equality in code base to use semantic_equality in `arrow-rs/arrow-schema` instead [datafusion]
via GitHub
Re: [I] update data type equality in code base to use semantic_equality in `arrow-rs/arrow-schema` instead [datafusion]
via GitHub
Re: [I] update data type equality in code base to use semantic_equality in `arrow-rs/arrow-schema` instead [datafusion]
via GitHub
[PR] Fix panic on RightMark hash joins when propagating ordering (#24718) [datafusion]
via GitHub
Re: [PR] [branch-55] Fix panic on RightMark hash joins when propagating ordering (#24718) [datafusion]
via GitHub
Re: [PR] [branch-55] Fix panic on RightMark hash joins when propagating ordering (#24718) [datafusion]
via GitHub
Re: [PR] [branch-55] Fix panic on RightMark hash joins when propagating ordering (#24718) [datafusion]
via GitHub
[PR] fix(sql): reject unsupported relation modifiers [datafusion]
via GitHub
Re: [PR] fix(sql): reject unsupported relation modifiers [datafusion]
via GitHub
[PR] feat(sql): expose CTE scope to relation planners [datafusion]
via GitHub
Re: [PR] feat(sql): expose CTE scope to relation planners [datafusion]
via GitHub
[PR] Refine and document AggregateExec metrics [datafusion]
via GitHub
Re: [PR] Refine and document AggregateExec metrics [datafusion]
via GitHub
[PR] fix(examples): apply relation aliases once [datafusion]
via GitHub
Re: [PR] fix(examples): apply relation aliases once [datafusion]
via GitHub
[I] Relation planning silently ignores unsupported table modifiers [datafusion]
via GitHub
[I] RelationPlanner TABLESAMPLE example applies relation aliases twice [datafusion]
via GitHub
[PR] [branch-55] fix: preserve provided arguments during FFI object construction (#24723) [datafusion]
via GitHub
Re: [PR] [branch-55] fix: preserve provided arguments during FFI object construction (#24723) [datafusion]
via GitHub
Re: [PR] [branch-55] fix: preserve provided arguments during FFI object construction (#24723) [datafusion]
via GitHub
[PR] test: reject hyphenated UDF argument names [datafusion]
via GitHub
Re: [PR] test: reject hyphenated UDF argument names [datafusion]
via GitHub
Re: [PR] test: reject hyphenated UDF argument names [datafusion]
via GitHub
[PR] fix: prevent CSE from extracting window functions [datafusion]
via GitHub
Re: [I] CSE may extract Window functions into a Project node [datafusion]
via GitHub
[PR] docs: Upate governance page [datafusion]
via GitHub
Re: [PR] docs: Upate governance page [datafusion]
via GitHub
Re: [PR] docs: Upate governance page [datafusion]
via GitHub
Earlier messages