Messages by Thread
-
-
Re: [PR] feat: stream aggregates over grouped input [datafusion]
via GitHub
-
Re: [PR] feat: add Grouped equivalence properties [datafusion]
via GitHub
-
Re: [PR] feat: bind task-owned RSS callbacks to native shuffle plans (4/n) [datafusion-comet]
via GitHub
-
Re: [PR] feat: add RSS partition writer and task-owned JNI callback (1/n) [datafusion-comet]
via GitHub
-
Re: [PR] feat: support Apache Celeborn remote shuffle service [datafusion-comet]
via GitHub
-
Re: [PR] feat: complete Celeborn map-side shuffle push lifecycle (6/n) [datafusion-comet]
via GitHub
-
Re: [PR] feat: add Celeborn shuffle manager and partition pusher (5/n) [datafusion-comet]
via GitHub
-
Re: [PR] feat: support `WindowGroupLimitExec` [datafusion-comet]
via GitHub
-
Re: [PR] fix: revert unsafe partial aggregates after final fallback [datafusion-comet]
via GitHub
-
[I] enable_url_table returns a handle on a different session, unlike every other with_* derivation [datafusion-python]
via GitHub
-
[I] Add an agent skill for datafusion-python extension authors [datafusion-python]
via GitHub
-
[I] Push native join runtime filters into scans to reduce I/O and decoding [datafusion-comet]
via GitHub
-
[I] Native Iceberg write panics generating the partition path for a timestamptz partition column [datafusion-comet]
via GitHub
-
[I] Native Iceberg write panics in construct_partition_summaries after partition spec evolution [datafusion-comet]
via GitHub
-
[I] Native Iceberg write fails with "No column with source column id" after an identity partition field is dropped [datafusion-comet]
via GitHub
-
[PR] feat: route unrecognized StaticInvoke and Invoke through the codegen dispatcher [datafusion-comet]
via GitHub
-
[I] Native Iceberg writer does not honour write.target-file-size-bytes the same way as iceberg-java [datafusion-comet]
via GitHub
-
[I] Native Iceberg write drops a ColumnarToRow transition when AQE is disabled [datafusion-comet]
via GitHub
-
[PR] Arrays zip codegen [datafusion-comet]
via GitHub
-
Re: [PR] Add atomic SessionContext.with_extensions API [datafusion-python]
via GitHub
-
Re: [I] [DISCUSS] Is Comet ready to move to top-level Apache Comet project? [datafusion-comet]
via GitHub
-
Re: [PR] Add optional native Lance scan support [datafusion-comet]
via GitHub
-
[I] feat: add native concat_ws support for array<string> arguments [datafusion-comet]
via GitHub
-
[I] Expose Python UDF inlining as a public, reusable extension codec [datafusion-python]
via GitHub
-
[I] Report which extension codec handled each node of a serialized plan [datafusion-python]
via GitHub
-
[I] Decode Python UDFs opaquely so a scheduler needs no Python interpreter [datafusion-python]
via GitHub
-
[I] Gate pyo3/extension-module so the crate can be linked as a Rust dependency and tested [datafusion-python]
via GitHub
-
Re: [PR] feat: full native make_interval with 2.6x faster than spark and 1.1x faster than codegen dispatch [datafusion-comet]
via GitHub
-
[I] perf: coalesce small shuffle-read batches before native sort [datafusion-comet]
via GitHub
-
[I] Comet's explode is slower than Spark when the element is a struct, worst on nested rows [datafusion-comet]
via GitHub
-
[I] concat_ws with array<string> arguments fails natively instead of flattening like Spark [datafusion-comet]
via GitHub
-
[PR] Add docs section for debugging for contributors [datafusion]
via GitHub
-
[PR] fix: apply Spark's Parquet conversion rules to nested struct/list/map fields [datafusion-comet]
via GitHub
-
[PR] fix: match Spark's ANSI bound check for float/double to integral casts [datafusion-comet]
via GitHub
-
Re: [PR] fix: GROUP BY returns two rows for the NULL group with a nullable UNIQUE constraint [datafusion]
via GitHub
-
[PR] fix: correctly rounded decimal to double/float cast matching BigDecimal.doubleValue/floatValue [datafusion-comet]
via GitHub
-
[PR] fix: align string to timestamp parsing with Spark's segment rules [datafusion-comet]
via GitHub
-
[PR] fix: return NULL from rpad/lpad when the length column is NULL instead of panicking [datafusion-comet]
via GitHub
-
[I] Add Ability to Eagerly Prune Parquet Files for Better Statistics [datafusion]
via GitHub
-
[PR] fix: fall back for concat_ws with array arguments instead of failing natively [datafusion-comet]
via GitHub
-
[PR] test: enable the Iceberg split-operator and native write by default to surface test failures [datafusion-comet]
via GitHub
-
Re: [PR] feat: support pivot and unpivot [datafusion]
via GitHub
-
Re: [I] Current shuffle format has too much overhead with default batch size [datafusion-comet]
via GitHub
-
[I] Investigate: why Comet shuffle files can be larger than Spark's, and whether byte-based block sizing would fix it [datafusion-comet]
via GitHub
-
Re: [I] Natively support regr_sxx, regr_syy, regr_sxy, regr_slope, regr_intercept, regr_r2 aggregates [datafusion-comet]
via GitHub
-
Re: [I] Iceberg write split-operator plan: CI failures when enabled by default [datafusion-comet]
via GitHub
-
[I] Plain `posexplode` evaluates its array argument twice per batch [datafusion-comet]
via GitHub
-
[I] String-to-timestamp cast diverges from Spark's parseTimestampString: rejects 1-digit segments and empty fractions, accepts zone suffixes on date-only strings and 7-digit years [datafusion-comet]
via GitHub
-
[I] Decimal to double/float cast is not correctly rounded: last-digit-wrong results for ordinary DECIMAL(38,18) values [datafusion-comet]
via GitHub
-
[I] ANSI cast of double/float to int/long falsely reports CAST_OVERFLOW for exactly-representable boundary values (2147483647.0, -2147483648.0, ±2^63) [datafusion-comet]
via GitHub
-
[I] rpad/lpad panic (Option::unwrap on None) when the length column contains NULL [datafusion-comet]
via GitHub
-
[I] Nested (struct/list/map) Parquet schema-evolution conversions bypass Spark's type-conversion rules: silent NULLs, string parsing, and a native panic [datafusion-comet]
via GitHub
-
[PR] chore(deps): bump the codeql-actions group with 2 updates [datafusion-comet]
via GitHub
-
[PR] fix(proto): destructure JSON source and sink serde hooks [datafusion]
via GitHub
-
Re: [PR] feat: add native distinct-combined collect_list aggregate support [datafusion-comet]
via GitHub
-
[PR] chore(deps): bump tower-http from 0.7.0 to 0.7.1 [datafusion-ballista]
via GitHub
-
[PR] chore(ci): bump taiki-e/install-action from 2.87.2 to 2.87.3 [datafusion-ballista]
via GitHub
-
Re: [I] Destructure proto hooks for lambda physical expressions [datafusion]
via GitHub
-
Re: [I] Unify granularity / field-name parsing across temporal functions [datafusion]
via GitHub
-
Re: [PR] feat: support ASOF JOIN SQL [datafusion]
via GitHub
-
Re: [D] Policy on uptick of LLM PRs from new contributors [datafusion]
via GitHub
-
Re: [PR] Add support for dictionary for approx_distinct [datafusion]
via GitHub
-
[I] Join planning inserts IS NOT NULL filters that provably pass 100% of rows when input statistics report zero nulls [datafusion]
via GitHub
-
[PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [PR] fix(spark): accept every integer width in `factorial`, matching Spark's implicit cast [datafusion]
via GitHub
-
Re: [I] Proto decode silently truncates limits and sizes to `usize` on 32-bit targets [datafusion]
via GitHub
-
[I] [Bug] spark factorial rejects STRING, DECIMAL and floating-point inputs that Spark implicitly casts to INT [datafusion]
via GitHub
-
[I] [Bug] spark factorial rejects BIGINT and untyped integer literals that Spark accepts [datafusion]
via GitHub
-
[PR] [Comet] Recover native Celeborn shuffle from oversized rows [datafusion-comet]
via GitHub
-
[PR] fix: preserve Arrow field metadata on scalar subquery expressions [datafusion]
via GitHub
-
Re: [PR] deps: bump DataFusion 55.0 and Arrow/Parquet 59.2 [datafusion-comet]
via GitHub