Messages by Thread
-
[PR] ci: run the Rust workflow for fork pull requests on the fork [datafusion]
via GitHub
-
[I] Support filter pushdown through UNNEST operator [datafusion]
via GitHub
-
Re: [PR] feat: align multi-key equi-join keys with Range partitioning order [datafusion]
via GitHub
-
Re: [I] Extract common aggregation spill logic [datafusion]
via GitHub
-
[PR] dev: include breaking API checks in the local lint suite [datafusion]
via GitHub
-
[PR] dev: add local CodeQL analysis for GitHub Actions [datafusion]
via GitHub
-
[PR] dev: include the HTML documentation build in the local lint suite [datafusion]
via GitHub
-
[PR] POC: rule-declared determinism and idempotence for the physical optimizer (#25572) [datafusion]
via GitHub
-
[PR] fix: rebuild the shuffle writer per iteration in end-to-end benches [datafusion-comet]
via GitHub
-
Re: [PR] feat(aggregate): cost-aware partial-aggregation skip (opt-in) [datafusion]
via GitHub
-
Re: [I] ci: next set of jobs to move from the PR tier to the merge queue tier [datafusion-comet]
via GitHub
-
[I] ci: key the TPC dataset caches on pinned generators [datafusion-comet]
via GitHub
-
[I] ci: shard the Iceberg extensions test task [datafusion-comet]
via GitHub
-
[PR] ci: drop non-existent suites from the Linux and macOS test matrices [datafusion-comet]
via GitHub
-
[PR] feat: summarize residual semi/anti sort-merge joins [datafusion]
via GitHub
-
[PR] feat: add indexed partition metrics access to execution plans [datafusion]
via GitHub
-
[I] Add efficient partition-specific metrics access to ExecutionPlan [datafusion]
via GitHub
-
[I] Summarize residual existence predicates in semi/anti sort-merge joins [datafusion]
via GitHub
-
[PR] fix: bound shuffle schema cache retention and preserve eviction order [datafusion-comet]
via GitHub
-
[I] Shuffle schema cache can evict recent entries and retain oversized schemas [datafusion-comet]
via GitHub
-
[I] native: `JVMClasses::with_env: JAVA_VM not initialized` aborts a multi-suite JVM [datafusion-comet]
via GitHub
-
[PR] feat: positional round robin shuffle keyed on a row ordinal [datafusion-comet]
via GitHub
-
[PR] deps: bump the iceberg-rust pin to bb1e4a4 and document why it is pinned [datafusion-comet]
via GitHub
-
[PR] Generic: Disallow quoted identifiers in colon and at-sign placeholders [datafusion-sqlparser-rs]
via GitHub
-
[PR] feat: support `WITH ... AS [NOT] MATERIALIZED` CTEs [datafusion]
via GitHub
-
Re: [PR] Update parquet_index hyperlink [datafusion-site]
via GitHub
-
[I] Support Spark's `AtLeastNNonNulls` natively [datafusion-comet]
via GitHub
-
Re: [I] Make datafusion support materializing option for CTE [datafusion]
via GitHub
-
[PR] PostgreSQL: Fix spacing between adjacent postfix factorial operators [datafusion-sqlparser-rs]
via GitHub
-
[PR] datafusion-physical-plan: handles nulls correctly in aggregate dynamic filters [datafusion]
via GitHub
-
[PR] fix: park the native scan loop instead of busy-polling while waiting on native I/O [datafusion-comet]
via GitHub
-
Re: [PR] fix: delegate the remaining codec methods in ComposedPhysicalExtensionCodec [datafusion]
via GitHub
-
[I] Native executePlan busy-polls at 100% CPU while a plan with a JVM-fed input waits on native I/O [datafusion-comet]
via GitHub
-
Re: [PR] feat: support listagg / string_agg aggregate (Spark 4.0+) [datafusion-comet]
via GitHub
-
Re: [PR] Preserve single quote literal display [datafusion-sqlparser-rs]
via GitHub
-
[PR] Generic: Fix quote escaping when displaying byte and raw string literals [datafusion-sqlparser-rs]
via GitHub
-
[PR] Snowflake: Fix stage delimiter handling and gate stage table factor on dialect [datafusion-sqlparser-rs]
via GitHub
-
[PR] Fix `EliminateLimit` not eliminating limits under `LogicalPlan::Extension` nodes. [datafusion]
via GitHub
-
[I] `datafusion-example` should only use the `datafusion` crate [datafusion]
via GitHub
-
Re: [PR] feat[functions]: use `placement` to pushdown `bit/octet/''_length` [datafusion]
via GitHub
-
[PR] fix: write cached batches to the schema width, not the batch width [datafusion-comet]
via GitHub
-
[PR] docs: exempt testing-category configs from the versioning policy [datafusion-comet]
via GitHub
-
[I] Exempt testing-category configs from the versioning policy [datafusion-comet]
via GitHub
-
Re: [PR] perf: keep the key in the hash entry of GroupValuesPrimitive [datafusion]
via GitHub
-
[I] Caching a relation over an Iceberg merge-on-read scan fails with ArrayIndexOutOfBoundsException [datafusion-comet]
via GitHub
-
Re: [I] Replace the logical codec's object registry with durable metadata [datafusion-python]
via GitHub
-
[I] array_append: ANSI item error is swallowed when the array is NULL [datafusion-comet]
via GitHub
-
[PR] ClickHouse: Support FIRST | AFTER column position in ALTER TABLE [datafusion-sqlparser-rs]
via GitHub
-
[I] ClickHouse: `ALTER TABLE ... ADD COLUMN ... FIRST | AFTER col` fails to parse [datafusion-sqlparser-rs]
via GitHub
-
Re: [PR] Clickhouse: Clickhouse assume table constraint [datafusion-sqlparser-rs]
via GitHub
-
Re: [PR] feat: add spark.comet.explain.planOnly.enabled, reported per query [datafusion-comet]
via GitHub
-
[PR] fix(iceberg): guard native Iceberg scan driver-metric double-post, add metrics docs and tests [datafusion-comet]
via GitHub
-
Re: [I] `unix_timestamp` on string input falls back to Spark, while `to_unix_timestamp` already uses the codegen dispatcher [datafusion-comet]
via GitHub
-
Re: [I] Native unix_timestamp returns incorrect results for negative fractional timestamps [datafusion-comet]
via GitHub
-
Re: [PR] feat: unix_timestamp codegen dispatch for strings, and fix pre-epoch fractional rounding [datafusion-comet]
via GitHub
-
Re: [D] DISCUSSION: Sep 2026 DataFusion Meetup in London [datafusion]
via GitHub
-
[PR] Feat(parquet) : Introduce roundtrip number Distinct Valeus [datafusion]
via GitHub
-
[PR] perf: add typed bounds for date_bin and from_unixtime [datafusion]
via GitHub
-
Re: [PR] feat(datafusion): make IcebergTableProvider::try_new public [datafusion-iceberg]
via GitHub
-
[PR] chore: remove JaCoCo from the build [datafusion-comet]
via GitHub
-
[I] Remove JaCoCo from the build [datafusion-comet]
via GitHub
-
[PR] refactor: compose CometScanRule and CometExecRule into a single CometRule [datafusion-comet]
via GitHub
-
[I] Compose CometScanRule and CometExecRule into a single conversion rule [datafusion-comet]
via GitHub
-
Re: [PR] feat: add spark.comet.explain.planOnly.enabled [datafusion-comet]
via GitHub
-
[PR] perf: mirror ASOF equality-key filters to right [datafusion]
via GitHub
-
Re: [PR] feat: RR partition with vectorized distribution [datafusion-comet]
via GitHub
-
[I] `satisfy_greater` panics at composite interval component boundaries [datafusion]
via GitHub
-
[I] Split physical optimizer rules into enforcement and optimization phases, with a convergence loop for the optimizers [datafusion]
via GitHub
-
Re: [PR] Fix GroupValues retained memory accounting [datafusion]
via GitHub
-
[I] to_unix_timestamp and make_timestamp advertise an allowIncompatible native opt-in that does not exist [datafusion-comet]
via GitHub
-
[I] Consolidate built-in statistics estimation in one place [datafusion]
via GitHub
-
[PR] fix: use session statistics registry in dfbench reports [datafusion]
via GitHub
-
[PR] refactor: use DataFusion errors in integration [datafusion-iceberg]
via GitHub
-
[PR] ci: retry the Spark test pre-compile step on resolution failures [datafusion-comet]
via GitHub
-
[I] ci: retry the Spark test pre-compile step when sbt fails to resolve dependencies [datafusion-comet]
via GitHub
-
Re: [I] Add Java-generated Rust parity fixtures for regex crate upgrades [datafusion-comet]
via GitHub
-
[I] Add Domain Bounds for Range Partitioning [datafusion]
via GitHub
-
[I] Bug triage results: 2026-09-21 [datafusion-comet]
via GitHub
-
Re: [PR] chore: fix stale docs and CI checks that were not running [datafusion-ballista]
via GitHub
-
[PR] chore(deps): bump object_store from 0.13.2 to 0.14.2 [datafusion-ballista]
via GitHub
-
[PR] fix: preserve sorts for wrapping integer negation [datafusion]
via GitHub
-
Re: [PR] ClickHouse: Support scalar expressions in WITH clause [datafusion-sqlparser-rs]
via GitHub
-
Re: [I] Implement cache-efficient partial aggregation by Leis et al [datafusion]
via GitHub
-
[PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
Re: [PR] feat: aggregate large hash tables as hash buckets (experimental, off by default) [datafusion]
via GitHub
-
[PR] Limit sort merge output batches by byte target [datafusion]
via GitHub
-
[PR] fix: match Spark variance updates for large nearby values [datafusion-comet]
via GitHub
-
[PR] bench: add `array_compact` benchmarks [datafusion]
via GitHub
-
Re: [PR] feat: route date and timestamp interval arithmetic through codegen dispatch [datafusion-comet]
via GitHub
-
[I] Parquet writer tests can capture a previous write's plan [datafusion-comet]
via GitHub
-
[PR] Add CI [datafusion-iceberg]
via GitHub
-
Re: [I] doc: create macros to hide logo/icon [datafusion]
via GitHub
-
[PR] test: add seeded fuzz coverage for PyArrow UDFs [datafusion-comet]
via GitHub
-
Re: [I] Try and discourage use of `git push --force` [datafusion-comet]
via GitHub
-
Re: [I] Substrait consumer: DuplicateUnqualifiedField when chaining two Window relations with a carried window column [datafusion]
via GitHub
-
Re: [I] Add support for map inputs to `explode` [datafusion-comet]
via GitHub
-
Re: [I] Add randomised fuzz harness for pyarrow UDF vector-copy path [datafusion-comet]
via GitHub
-
Re: [I] Add metrics and logging to JVM-scalar-UDF dispatch path [datafusion-comet]
via GitHub
-
Re: [PR] bench: improve Iceberg TPC workflow and plan capture [datafusion-comet]
via GitHub
-
[PR] ci: focus Miri on unsafe row and hash tests [datafusion-comet]
via GitHub