Messages by Thread
-
[PR] fix: [branch-1.0] backport four bug fixes for 1.0.1 [datafusion-comet]
via GitHub
-
[PR] Add Ballista 54.1.0 release announcement blog post [datafusion-site]
via GitHub
-
Re: [I] Propagation of ordered `SortProperties` should consider `nulls_first` [datafusion]
via GitHub
-
[PR] feat(scheduler): add the history server [datafusion-ballista]
via GitHub
-
Re: [PR] Reduce per-file metadata overhead for wide-schema parquet scans [datafusion]
via GitHub
-
Re: [I] [EPIC] Merge EnforceDistribution + EnforceSorting into a single EnsureRequirements rule for correctness and idempotency [datafusion]
via GitHub
-
[PR] feat(scheduler): record a per-job event log behind --event-log-dir [datafusion-ballista]
via GitHub
-
[I] Add wrapper classes for Expression types [datafusion-python]
via GitHub
-
[PR] fix: reject max_buffered_batches_per_output_file values below 2 [datafusion]
via GitHub
-
[I] Inconsistent Explain units [datafusion]
via GitHub
-
[I] `AggregateExec` physical-plan serde rebuilds the output schema, losing optimizer-preserved field names (and `is_reversed`) [datafusion]
via GitHub
-
Re: [I] Select with order by from empty table triggers SanityCheckPlan error [datafusion]
via GitHub
-
Re: [PR] fix: preserve input ordering required by limits [datafusion]
via GitHub
-
Re: [I] Fail to merge schema field for partitioned table with dict [datafusion]
via GitHub
-
[PR] feat: add literal constraints to type signatures [datafusion]
via GitHub
-
Re: [I] [Bug] next_day returns NULL for far-future start dates where Spark returns a value [datafusion]
via GitHub
-
[PR] fix: scope information schema to catalog [datafusion]
via GitHub
-
Re: [PR] IN LIST: add keyed frozen set for large primitive lists [datafusion]
via GitHub
-
Re: [PR] IN LIST: optimize Utf8View and BinaryView filters [datafusion]
via GitHub
-
Re: [I] information_schema.tables contains all tables from all catalogs instead of current catalog [datafusion]
via GitHub
-
[PR] test: add UnionArray hashing SQL coverage. [datafusion]
via GitHub
-
Re: [I] Add `UnionArray` tests exercising hashing, group-by, distinct, and aggregates [datafusion]
via GitHub
-
[PR] fix: return error instead of panic when decoding ParquetScan/AvroScan without features [datafusion]
via GitHub
-
[I] Decoding a ParquetScan/AvroScan physical plan panics when the feature is disabled, instead of returning an error [datafusion]
via GitHub
-
[I] Arrow IPC stream format is silently lost when a scan is serialized to protobuf [datafusion]
via GitHub
-
Re: [PR] feat(lambda): support map non empty nulls cleanup for `HigherOrderFunctionExpr` [datafusion]
via GitHub
-
Re: [PR] Optimize existence-only right semi and anti joins [datafusion]
via GitHub
-
[PR] feat: add basic MemTable MERGE INTO support [datafusion]
via GitHub
-
[PR] Brent/query shape viz [datafusion-ballista]
via GitHub
-
[PR] feat: recognize SparkCopyOnWriteScan as a native Iceberg scan [datafusion-comet]
via GitHub
-
[I] Support Iceberg `SparkCopyOnWriteScan` in `IcebergReflection.ICEBERG_SCAN_CLASSES` [datafusion-comet]
via GitHub
-
[PR] feat: add native support for MergeRowsExec (row-level MERGE INTO) [datafusion-comet]
via GitHub
-
[PR] fix: prevent next_day panic on far-future start dates [datafusion]
via GitHub
-
[PR] feat(core): RangeFilterExec — sorted-input per-partition range filter (purely additive) [datafusion-ballista]
via GitHub
-
Re: [PR] perf: resolve parquet leaf columns in O(1) during statistics collection [datafusion]
via GitHub
-
[PR] fix: avoid buffering unbounded repartition output indefinitely [datafusion]
via GitHub
-
[PR] minor(test): strengthen bitwise sort-merge join spill coverage [datafusion]
via GitHub
-
[PR] chore: moving WindowTopN before EnsureRequirements [datafusion]
via GitHub
-
[I] refactor: centralize Spark-to-Arrow batch encoding in ArrowWriter [datafusion-comet]
via GitHub
-
[PR] docs: correct Spark 4.2 version and CI test status in installation guide (branch-1.0) [datafusion-comet]
via GitHub
-
[PR] docs: correct Spark 4.2 version and CI test status in installation guide [datafusion-comet]
via GitHub
-
[PR] feat: support S3 compliant filesystems [datafusion-comet]
via GitHub
-
[I] Support S3-compliant object stores [datafusion-comet]
via GitHub
-
[PR] refactor(proto): migrate ArrowSource serde [datafusion]
via GitHub
-
[PR] refactor(proto): migrate AvroSource serde [datafusion]
via GitHub
-
[I] Agree and document cross-version compatibility guarantees for Ballista's three versioned surfaces [datafusion-ballista]
via GitHub
-
[PR] feat(history): add the event-log schema, writer, and reader [datafusion-ballista]
via GitHub
-
[PR] feat: add aggregate observability counters to the cache layer [datafusion]
via GitHub
-
[I] Normalize signed zero in collect_set on Spark 3.4 through 4.1 [datafusion-comet]
via GitHub
-
[PR] fix(tui): use the shared API wire types instead of local copies [datafusion-ballista]
via GitHub
-
[I] TUI's duplicated API response types have drifted from the scheduler, breaking the stages popup [datafusion-ballista]
via GitHub
-
[PR] Proto: migrate MemorySourceConfig to per-source try_to_proto / try_from_proto hooks [datafusion]
via GitHub
-
[PR] refactor(scheduler): extract REST DTOs into ballista-history and factor out dto_build [datafusion-ballista]
via GitHub
-
[PR] feat: preserve bitmap-backed RowSelection through ParquetAccessPlan [datafusion]
via GitHub
-
Re: [PR] feat(core): scaffold PrefixMergeExec for cross-partition windowed-aggregate state merge [datafusion-ballista]
via GitHub
-
[PR] feat(core): RangeShuffleReaderExec — ordering-preserving shuffle reader (purely additive) [datafusion-ballista]
via GitHub
-
[PR] fix: clear stale sliding aggregate state for empty RANGE frames [datafusion]
via GitHub
-
[I] Sliding RANGE aggregates retain stale state after an empty frame [datafusion]
via GitHub
-
[PR] fix(proto): serialize Global/LocalLimitExec required_ordering [datafusion]
via GitHub
-
[PR] fix(core): unbreak main — set partition: None on OperatorMetric literals [datafusion-ballista]
via GitHub
-
Re: [PR] feat(physical-plan): `GroupColumn` support for `List` / `LargeList` [datafusion]
via GitHub
-
[PR] Resolve page pruning `StatisticsConverter` once per file instead of once per row group [datafusion]
via GitHub
-
Re: [PR] docs(upgrading): document RecursiveQuery schema field in upgrade guide [datafusion]
via GitHub
-
Re: [I] Numeric SQL literals with underscores are not correctly parsed [datafusion]
via GitHub
-
[PR] IN LIST: optimize large integer filters [datafusion]
via GitHub
-
Re: [PR] feat: add DistributedQueryExec::explain_executed_plan and show logical plan in display [datafusion-ballista]
via GitHub
-
[I] Physical plan proto silently drops CSV/JSON scan options (newline_delimited, terminator, compression) [datafusion]
via GitHub
-
[PR] feat(cli): add opt-in Spark function registration [datafusion]
via GitHub
-
[PR] refactor(proto): migrate JsonSource serde [datafusion]
via GitHub
-
[PR] refactor(proto): migrate CsvSource serde [datafusion]
via GitHub
-
[I] Native spill and memory-wait are invisible to Spark task metrics [datafusion-comet]
via GitHub
-
[PR] Fix duplicated words in documentation [datafusion]
via GitHub
-
Re: [PR] [do-not-merge] Wide-schema parquet read perf — visibility for #21968 [datafusion]
via GitHub
-
Re: [PR] Refactor post-aggregate clause rebasing and validation with shared helpers [datafusion]
via GitHub
-
Re: [PR] parquet: cache per-file ArrowReaderMetadata for wide-schema scans [datafusion]
via GitHub
-
[PR] fix: box aws-config loading future avoid clippy warning [datafusion]
via GitHub
-
Re: [I] Shuffle-fetch failures lose their type, so the map-stage resubmit never fires and the job fails [datafusion-ballista]
via GitHub
-
[PR] feat(core): PartitionedBoundedWindowAggExec — parallel BWAG wrapper [datafusion-ballista]
via GitHub
-
Re: [I] EPIC: complete GroupValuesColumn type coverage (nested types + remaining primitives) [datafusion]
via GitHub
-
[I] WideDecimalBinaryExpr: write nulls directly for overflow [datafusion-comet]
via GitHub
-
[PR] tests: add SLT test coverage for `MERGE INTO` [datafusion]
via GitHub
-
[PR] Fix `IS [NOT] DISTINCT FROM` right-operand precedence [datafusion-sqlparser-rs]
via GitHub
-
[I] feat: Write Iceberg Parquet data files natively via iceberg-rust (part 3 of 3) [datafusion-comet]
via GitHub
-
[PR] feat(python): integrate Ballista through DataFusion FFI [datafusion-ballista]
via GitHub
-
[PR] Add atomic SessionContext.with_extensions API [datafusion-python]
via GitHub
-
[PR] Make extension codecs composable [datafusion-python]
via GitHub
-
[PR] Add FFI query planner support [datafusion-python]
via GitHub
-
[I] Extend SessionContext.with_extensions to cover additional extension points (functions, catalogs, object stores) [datafusion-python]
via GitHub
-
[PR] chore(docker): ca-certificates + h2o binary in benchmarks image [datafusion-ballista]
via GitHub
-
[PR] fix: support pycapsule methods with arguments [datafusion-python]
via GitHub
-
[I] Global/LocalLimitExec::required_ordering is not serialized, losing order-sensitivity of a pushed-down LIMIT [datafusion]
via GitHub
-
[PR] test(proto): add missing physical plan round-trip coverage [datafusion]
via GitHub
-
[I] Improve physical plan proto round-trip test coverage (missing SortPreservingMergeExec; Debug-string assertions miss dropped fields) [datafusion]
via GitHub
-
[I] Proto decode silently truncates limits and sizes to `usize` on 32-bit targets [datafusion]
via GitHub
-
Re: [PR] feat: Add SQL planner, physical planner, and TableProvider hook for MERGE INTO [datafusion]
via GitHub