Messages by Thread
-
[I] Physical plan proto silently drops CSV/JSON scan options (newline_delimited, terminator, compression) [datafusion]
via GitHub
-
Re: [PR] feat: add GroupColumn support for Decimal256 in multi-column GROUP BY [datafusion]
via GitHub
-
[PR] feat(cli): add opt-in Spark function registration [datafusion]
via GitHub
-
[PR] refactor(proto): migrate JsonSource serde [datafusion]
via GitHub
-
[PR] refactor(proto): migrate CsvSource serde [datafusion]
via GitHub
-
Re: [I] Avoid duplicate CheckOverflow evaluation for decimal division [datafusion-comet]
via GitHub
-
[I] Native spill and memory-wait are invisible to Spark task metrics [datafusion-comet]
via GitHub
-
Re: [PR] Enable more lints [datafusion]
via GitHub
-
[PR] fix: decode invalid UTF-8 at the JVM to native FFI import boundary [datafusion-comet]
via GitHub
-
[PR] Fix duplicated words in documentation [datafusion]
via GitHub
-
Re: [PR] [do-not-merge] Wide-schema parquet read perf — visibility for #21968 [datafusion]
via GitHub
-
Re: [PR] Refactor post-aggregate clause rebasing and validation with shared helpers [datafusion]
via GitHub
-
Re: [PR] parquet: cache per-file ArrowReaderMetadata for wide-schema scans [datafusion]
via GitHub
-
[PR] fix: box aws-config loading future avoid clippy warning [datafusion]
via GitHub
-
Re: [I] [EPIC] Memory pool and accounting audit sweep [datafusion-comet]
via GitHub
-
Re: [PR] docs: Document `WindowFn` and add comments [datafusion]
via GitHub
-
Re: [I] Shuffle-fetch failures lose their type, so the map-stage resubmit never fires and the job fails [datafusion-ballista]
via GitHub
-
Re: [I] ScalaUDF in a user jar fails with ClassCastException on SerializedLambda when dispatched from a Tokio worker [datafusion-comet]
via GitHub
-
Re: [PR] fix: propagate the Spark task ClassLoader to JVM UDF calls [datafusion-comet]
via GitHub
-
[PR] feat(core): PartitionedBoundedWindowAggExec — parallel BWAG wrapper [datafusion-ballista]
via GitHub
-
Re: [I] EPIC: complete GroupValuesColumn type coverage (nested types + remaining primitives) [datafusion]
via GitHub
-
[I] WideDecimalBinaryExpr: write nulls directly for overflow [datafusion-comet]
via GitHub
-
[PR] tests: add SLT test coverage for `MERGE INTO` [datafusion]
via GitHub
-
[PR] Fix `IS [NOT] DISTINCT FROM` right-operand precedence [datafusion-sqlparser-rs]
via GitHub
-
[I] feat: Write Iceberg Parquet data files natively via iceberg-rust (part 3 of 3) [datafusion-comet]
via GitHub
-
[PR] feat(python): integrate Ballista through DataFusion FFI [datafusion-ballista]
via GitHub
-
Re: [PR] docs: add 1.0.0 changelog to main [datafusion-comet]
via GitHub
-
Re: [PR] chore: fix some scalar function docs [datafusion]
via GitHub
-
[PR] Add atomic SessionContext.with_extensions API [datafusion-python]
via GitHub
-
[PR] Make extension codecs composable [datafusion-python]
via GitHub
-
[PR] Add FFI query planner support [datafusion-python]
via GitHub
-
Re: [PR] fix: avoid duplicate CheckOverflow evaluation for decimal division [datafusion-comet]
via GitHub
-
[I] Extend SessionContext.with_extensions to cover additional extension points (functions, catalogs, object stores) [datafusion-python]
via GitHub
-
[PR] chore(docker): ca-certificates + h2o binary in benchmarks image [datafusion-ballista]
via GitHub
-
[PR] fix: support pycapsule methods with arguments [datafusion-python]
via GitHub
-
Re: [I] Accelerate row-level MERGE / UPDATE / DELETE plans (MergeRowsExec, ReplaceDataExec, WriteDeltaExec) [datafusion-comet]
via GitHub
-
[I] Global/LocalLimitExec::required_ordering is not serialized, losing order-sensitivity of a pushed-down LIMIT [datafusion]
via GitHub
-
[PR] test(proto): add missing physical plan round-trip coverage [datafusion]
via GitHub
-
[I] Improve physical plan proto round-trip test coverage (missing SortPreservingMergeExec; Debug-string assertions miss dropped fields) [datafusion]
via GitHub
-
[I] Proto decode silently truncates limits and sizes to `usize` on 32-bit targets [datafusion]
via GitHub
-
Re: [PR] feat: Add SQL planner, physical planner, and TableProvider hook for MERGE INTO [datafusion]
via GitHub
-
[PR] feat(core): metrics() for OrderedRangeRepartitionExec and RuntimeStatsExec [datafusion-ballista]
via GitHub
-
Re: [PR] fix: classify wrapped FetchFailed as fetch partition error [datafusion-ballista]
via GitHub
-
[PR] refactor(proto): migrate ParquetSource serde [datafusion]
via GitHub
-
Re: [I] [EPIC] first class support for struct field / Variant access in Parquet [datafusion]
via GitHub
-
Re: [PR] Iceberg-Ballista Crate [datafusion-ballista]
via GitHub
-
Re: [PR] chore: move CometCollationSuite to spark-4.1+ test shim [datafusion-comet]
via GitHub
-
[I] Native Parquet writes report row counts but not row contents to WriteTaskStatsTrackers [datafusion-comet]
via GitHub
-
[I] Reconcile the two config namespaces for native writes [datafusion-comet]
via GitHub
-
[I] Native Parquet writer derives schema nullability and field IDs from Arrow rather than Catalyst [datafusion-comet]
via GitHub
-
[I] Native Parquet write of a zero-partition RDD produces no output file [datafusion-comet]
via GitHub
-
[I] Native Parquet writer ignores Spark's Parquet writer properties (block size, page size, dictionary, writer version, statistics) [datafusion-comet]
via GitHub
-
[PR] test: pin down CometCast fallback for non-default collated strings [datafusion-comet]
via GitHub
-
[I] Add a C++ UDF example and a published C header for the Comet UDF ABI [datafusion-comet]
via GitHub
-
Re: [I] [EPIC] Port ExecutionPlan serialization to try_to_proto / try_from_proto hooks [datafusion]
via GitHub
-
[PR] perf: build spark_size LargeList lengths from i64 offsets [datafusion-comet]
via GitHub
-
[PR] chore(proto): deprecate accessors that only existed for proto serialization [datafusion]
via GitHub
-
[I] perf: explore bulk copies for no-null fixed-width Arrow writes [datafusion-comet]
via GitHub
-
[PR] [PyLimit] adding skip and fetch with datafusion expr support [datafusion-python]
via GitHub
-
[PR] refactor(proto): destructure plan and proto structs in core plan serde hooks [datafusion]
via GitHub
-
[PR] refactor(proto): destructure plan and proto structs in aggregate and window serde hooks [datafusion]
via GitHub