Messages by Thread
-
-
Re: [I] Comet throws RuntimeException instead of SparkException for invalid row index column type [datafusion-comet]
via GitHub
-
Re: [PR] docs: document DELETE and UPDATE for SQL users and table provider authors [datafusion]
via GitHub
-
Re: [PR] perf(date_trunc): significantly optimize date_trunc for fixed-offset timezones and coarse granularities binning [datafusion]
via GitHub
-
[I] Nothing guards page skipping in the native Iceberg scan [datafusion-comet]
via GitHub
-
[PR] test: guard page skipping in the native Iceberg scan [datafusion-comet]
via GitHub
-
[PR] feat: recognize more lossless casts for statistics and ordering [datafusion]
via GitHub
-
Re: [PR] Refresh statistics parser settings between query files [datafusion]
via GitHub
-
Re: [I] [DISCUSSION] Clarify public ExecutionPlan transformation contracts for optimizer-added state [datafusion]
via GitHub
-
[PR] chore: add a native Iceberg write benchmark [datafusion-comet]
via GitHub
-
[I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
-
Re: [I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
-
Re: [I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
-
Re: [I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
-
Re: [I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
-
Re: [I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
-
Re: [I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
-
Re: [I] datafusion-cli: expose bloom filter, page index and sorting-column metadata in parquet_metadata, plus file-level metadata [datafusion]
via GitHub
-
Re: [I] Ordered ARRAY_AGG accumulator retains one Arrow array per update_batch call, inflating per-row memory for grouped aggregation [datafusion]
via GitHub
-
[PR] perf(functions-aggregate): coalesce small ordered ARRAY_AGG batches [datafusion]
via GitHub
-
Re: [I] CAST statistics can produce incorrect MIN/MAX results [datafusion]
via GitHub
-
[PR] Fuzz: Add curated seed corpus [datafusion-sqlparser-rs]
via GitHub
-
[PR] fix: reserve the concatenated build batch and computed join keys in HashJoinExec [datafusion]
via GitHub
-
Re: [I] width_bucket bypasses CometExpressionSerde framework [datafusion-comet]
via GitHub
-
[PR] docs: Document the convention for internal public APIs [datafusion]
via GitHub
-
Re: [I] Support `length` function with non-string input [datafusion-comet]
via GitHub
-
Re: [PR] chore: drop the redundant width_bucket shim registrations and guard serde uniqueness [datafusion-comet]
via GitHub
-
Re: [I] Add User Guide section on using object stores such as S3 [datafusion]
via GitHub
-
[PR] perf: copy bitmaps a word at a time in `pre_selection_scatter` [datafusion]
via GitHub
-
[PR] Fuzz: Display roundtrip [datafusion-sqlparser-rs]
via GitHub
-
Re: [PR] feat(spark): support the scale argument in Spark ceil [datafusion]
via GitHub
-
[PR] Remove deprecated Parquet metadata / statistics APIs that are past the API [datafusion]
via GitHub
-
[PR] fix: shrink NLJ load outcome to satisfy Clippy [datafusion]
via GitHub
-
Re: [PR] perf: preserve left functional dependencies for ASOF joins [datafusion]
via GitHub
-
Re: [PR] fix: preserve current AQE logical-stage links on Comet operators [datafusion-comet]
via GitHub
-
[PR] perf: reuse prepared broadcast builds across executor tasks [datafusion-comet]
via GitHub
-
[PR] feat: support reusable prepared hash-join builds [datafusion]
via GitHub
-
[PR] feat: admit string maps in Spark-to-Comet conversion [datafusion-comet]
via GitHub
-
[PR] fix: defer throwing literal casts to Spark at runtime [datafusion-comet]
via GitHub
-
[I] Audit Comet logical-link repair across AQE replanning [datafusion-comet]
via GitHub
-
Re: [PR] fix: validate map constructor row lengths and null short-circuiting [datafusion-comet]
via GitHub
-
[PR] refactor: factor SortMergeJoinExec::execute into a reusable sort_merge_join_stream [datafusion]
via GitHub
-
[PR] fix: sort-merge join filter columns follow the filter's own column order [datafusion]
via GitHub
-
Re: [PR] feat: drop provably-true IS NOT NULL conjuncts from FilterExec predicates via input null_count statistics [datafusion]
via GitHub
-
Re: [PR] perf: Avoid copying when materializing output in OrderedPartialAggregateStream [datafusion]
via GitHub
-
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
-
[I] UDF: consider returning an enum for `return_type` [datafusion]
via GitHub
-
Re: [I] Support ARRAY<STRING> in CometSparkToColumnarExec [datafusion-comet]
via GitHub
-
Re: [PR] feat: support string arrays in Spark-to-Comet conversion [datafusion-comet]
via GitHub
-
Re: [I] Native Iceberg writes drop Hadoop GCS configuration for HadoopFileIO + gs:// [datafusion-comet]
via GitHub
-
Re: [PR] fix: fall back to Spark for native Iceberg writes to gs:// through HadoopFileIO [datafusion-comet]
via GitHub
-
[PR] docs: explain that Comet's memory comes out of the executor container [datafusion-comet]
via GitHub
-
[I] Tuning guide does not explain that Comet's memory comes out of the executor container [datafusion-comet]
via GitHub
-
[PR] feat: scope-aware object_store cache for the S3 credential SPI [datafusion-comet]
via GitHub
-
[PR] docs: document the 24-hour review window for non-trivial pull requests [datafusion-comet]
via GitHub
-
[PR] docs: show which config value sizes each region in the memory cgroup diagram [datafusion-comet]
via GitHub
-
[I] Memory management cgroup diagram does not show which config value sizes each region [datafusion-comet]
via GitHub
-
[PR] playground [datafusion]
via GitHub