Messages by Thread
-
-
[I] Sliding RANGE aggregates retain stale state after an empty frame [datafusion]
via GitHub
-
[PR] fix(proto): serialize Global/LocalLimitExec required_ordering [datafusion]
via GitHub
-
[PR] fix(core): unbreak main — set partition: None on OperatorMetric literals [datafusion-ballista]
via GitHub
-
Re: [PR] feat(physical-plan): `GroupColumn` support for `List` / `LargeList` [datafusion]
via GitHub
-
[PR] Resolve page pruning `StatisticsConverter` once per file instead of once per row group [datafusion]
via GitHub
-
Re: [PR] docs(upgrading): document RecursiveQuery schema field in upgrade guide [datafusion]
via GitHub
-
Re: [I] Numeric SQL literals with underscores are not correctly parsed [datafusion]
via GitHub
-
[PR] IN LIST: optimize large integer filters [datafusion]
via GitHub
-
Re: [PR] feat: add DistributedQueryExec::explain_executed_plan and show logical plan in display [datafusion-ballista]
via GitHub
-
[I] Physical plan proto silently drops CSV/JSON scan options (newline_delimited, terminator, compression) [datafusion]
via GitHub
-
[PR] feat(cli): add opt-in Spark function registration [datafusion]
via GitHub
-
[PR] refactor(proto): migrate JsonSource serde [datafusion]
via GitHub
-
[PR] refactor(proto): migrate CsvSource serde [datafusion]
via GitHub
-
[I] Native spill and memory-wait are invisible to Spark task metrics [datafusion-comet]
via GitHub
-
[PR] Fix duplicated words in documentation [datafusion]
via GitHub
-
Re: [PR] [do-not-merge] Wide-schema parquet read perf — visibility for #21968 [datafusion]
via GitHub
-
Re: [PR] Refactor post-aggregate clause rebasing and validation with shared helpers [datafusion]
via GitHub
-
Re: [PR] parquet: cache per-file ArrowReaderMetadata for wide-schema scans [datafusion]
via GitHub
-
[PR] fix: box aws-config loading future avoid clippy warning [datafusion]
via GitHub
-
Re: [I] Shuffle-fetch failures lose their type, so the map-stage resubmit never fires and the job fails [datafusion-ballista]
via GitHub
-
[PR] feat(core): PartitionedBoundedWindowAggExec — parallel BWAG wrapper [datafusion-ballista]
via GitHub
-
Re: [I] EPIC: complete GroupValuesColumn type coverage (nested types + remaining primitives) [datafusion]
via GitHub
-
[I] WideDecimalBinaryExpr: write nulls directly for overflow [datafusion-comet]
via GitHub
-
[PR] tests: add SLT test coverage for `MERGE INTO` [datafusion]
via GitHub
-
[PR] Fix `IS [NOT] DISTINCT FROM` right-operand precedence [datafusion-sqlparser-rs]
via GitHub
-
[I] feat: Write Iceberg Parquet data files natively via iceberg-rust (part 3 of 3) [datafusion-comet]
via GitHub
-
[PR] feat(python): integrate Ballista through DataFusion FFI [datafusion-ballista]
via GitHub
-
[PR] Add atomic SessionContext.with_extensions API [datafusion-python]
via GitHub
-
[PR] Make extension codecs composable [datafusion-python]
via GitHub
-
[PR] Add FFI query planner support [datafusion-python]
via GitHub
-
[I] Extend SessionContext.with_extensions to cover additional extension points (functions, catalogs, object stores) [datafusion-python]
via GitHub
-
[PR] chore(docker): ca-certificates + h2o binary in benchmarks image [datafusion-ballista]
via GitHub
-
[PR] fix: support pycapsule methods with arguments [datafusion-python]
via GitHub
-
Re: [I] Accelerate row-level MERGE / UPDATE / DELETE plans (MergeRowsExec, ReplaceDataExec, WriteDeltaExec) [datafusion-comet]
via GitHub
-
[I] Global/LocalLimitExec::required_ordering is not serialized, losing order-sensitivity of a pushed-down LIMIT [datafusion]
via GitHub
-
[PR] test(proto): add missing physical plan round-trip coverage [datafusion]
via GitHub
-
[I] Improve physical plan proto round-trip test coverage (missing SortPreservingMergeExec; Debug-string assertions miss dropped fields) [datafusion]
via GitHub
-
[I] Proto decode silently truncates limits and sizes to `usize` on 32-bit targets [datafusion]
via GitHub
-
Re: [PR] feat: Add SQL planner, physical planner, and TableProvider hook for MERGE INTO [datafusion]
via GitHub
-
[PR] feat(core): metrics() for OrderedRangeRepartitionExec and RuntimeStatsExec [datafusion-ballista]
via GitHub
-
Re: [PR] fix: classify wrapped FetchFailed as fetch partition error [datafusion-ballista]
via GitHub
-
[PR] refactor(proto): migrate ParquetSource serde [datafusion]
via GitHub
-
Re: [PR] chore: move CometCollationSuite to spark-4.1+ test shim [datafusion-comet]
via GitHub
-
[I] Native Parquet writes report row counts but not row contents to WriteTaskStatsTrackers [datafusion-comet]
via GitHub
-
[I] Reconcile the two config namespaces for native writes [datafusion-comet]
via GitHub
-
[I] Native Parquet writer derives schema nullability and field IDs from Arrow rather than Catalyst [datafusion-comet]
via GitHub
-
[I] Native Parquet write of a zero-partition RDD produces no output file [datafusion-comet]
via GitHub
-
[I] Native Parquet writer ignores Spark's Parquet writer properties (block size, page size, dictionary, writer version, statistics) [datafusion-comet]
via GitHub
-
[PR] test: pin down CometCast fallback for non-default collated strings [datafusion-comet]
via GitHub
-
[I] Add a C++ UDF example and a published C header for the Comet UDF ABI [datafusion-comet]
via GitHub
-
Re: [I] [EPIC] Port ExecutionPlan serialization to try_to_proto / try_from_proto hooks [datafusion]
via GitHub
-
[PR] perf: build spark_size LargeList lengths from i64 offsets [datafusion-comet]
via GitHub
-
[PR] chore(proto): deprecate accessors that only existed for proto serialization [datafusion]
via GitHub
-
[I] perf: explore bulk copies for no-null fixed-width Arrow writes [datafusion-comet]
via GitHub
-
[PR] [PyLimit] adding skip and fetch with datafusion expr support [datafusion-python]
via GitHub
-
[PR] refactor(proto): destructure plan and proto structs in core plan serde hooks [datafusion]
via GitHub
-
[PR] refactor(proto): destructure plan and proto structs in aggregate and window serde hooks [datafusion]
via GitHub
-
[PR] refactor(proto): destructure plan and proto structs in join serde hooks [datafusion]
via GitHub
-
[PR] fix(proto): preserve HashJoinExec fetch across serialization [datafusion]
via GitHub
-
[I] PyLimit (LogicalPlan Limit node) has no way to read skip/fetch — regressed in #905 [datafusion-python]
via GitHub
-
[PR] feat: detect Iceberg V2 writes and emit fall-back reasons [datafusion-comet]
via GitHub
-
[I] Rust UDF library cache holds its write lock across dlopen [datafusion-comet]
via GitHub
-
[I] Rust UDF adapter rebuilds the kernel impl and re-resolves the return type on every batch [datafusion-comet]
via GitHub
-
[I] A Rust UDF silently answers calls to an ordinary Scala UDF registered under the same name [datafusion-comet]
via GitHub
-
[I] Scope the Rust UDF registry to the session that registered the UDF [datafusion-comet]
via GitHub
-
[PR] refactor: hook native Parquet writes into Spark's WriteFilesExec seam [datafusion-comet]
via GitHub
-
Re: [I] Proto: migrate MemorySourceConfig [datafusion]
via GitHub