github
Thread
Date
Earlier messages
Later messages
Messages by Thread
[PR] fix: prune row groups when file statistics collapse the predicate to a constant [datafusion]
via GitHub
Re: [PR] fix: prune row groups when file statistics collapse the predicate to a constant [datafusion]
via GitHub
Re: [PR] fix: prune row groups when file statistics collapse the predicate to a constant [datafusion]
via GitHub
Re: [PR] fix: prune row groups when file statistics collapse the predicate to a constant [datafusion]
via GitHub
Re: [PR] fix: prune row groups when file statistics collapse the predicate to a constant [datafusion]
via GitHub
Re: [PR] fix: prune row groups when file statistics collapse the predicate to a constant [datafusion]
via GitHub
Re: [PR] IN LIST: use runtime dispatch for `FixedSizeBinary` filter (reduce binary size) [datafusion]
via GitHub
Re: [PR] IN LIST: use runtime dispatch for `FixedSizeBinary` filter (reduce binary size) [datafusion]
via GitHub
Re: [PR] IN LIST: use runtime dispatch for `FixedSizeBinary` filter (reduce binary size) [datafusion]
via GitHub
[I] Native Azure store lets ambient AZURE_* environment variables override or corrupt explicit Hadoop auth config [datafusion-comet]
via GitHub
Re: [I] Native Azure store lets ambient AZURE_* environment variables override or corrupt explicit Hadoop auth config [datafusion-comet]
via GitHub
[I] Iceberg native scan fails queries on tables whose column names are case-distinct to Java but not to Rust [datafusion-comet]
via GitHub
Re: [I] Iceberg native scan fails queries on tables whose column names are case-distinct to Java but not to Rust [datafusion-comet]
via GitHub
[I] Iceberg native scan claims schemes it cannot execute; three scheme lists disagree [datafusion-comet]
via GitHub
Re: [I] Iceberg native scan claims schemes it cannot execute; three scheme lists disagree [datafusion-comet]
via GitHub
[I] Regression: DataFusion 55 no longer prunes row groups for `col = <literal>` when statistics show the column is entirely NULL [datafusion]
via GitHub
Re: [I] Regression: DataFusion 55 no longer prunes row groups for `col = <literal>` when statistics show the column is entirely NULL [datafusion]
via GitHub
Re: [I] `avg(decimal)` might lose precision and cause an overflow over return type [datafusion]
via GitHub
Re: [I] Avoid unnecessary repartitioning when joining against pre-partitioned relations [datafusion]
via GitHub
Re: [I] Destructure proto hooks for CASE and IN-list physical expressions [datafusion]
via GitHub
Re: [I] PROPOSAL Hash Join Spilling Proposal [datafusion]
via GitHub
Re: [I] PROPOSAL Hash Join Spilling Proposal [datafusion]
via GitHub
Re: [I] PROPOSAL Hash Join Spilling Proposal [datafusion]
via GitHub
[I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [I] [EPIC] Spilling Hash Join — run any join in a bounded memory budget [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
Re: [PR] Share per-chunk JoinLeftData across right partitions in NLJ memory-limited fallback [datafusion]
via GitHub
[PR] feat: use object store for history server persistence [datafusion-ballista]
via GitHub
Re: [PR] feat: use object store for history server persistence [datafusion-ballista]
via GitHub
Re: [PR] feat: use object store for history server persistence [datafusion-ballista]
via GitHub
Re: [I] Destructure proto hooks for the Arrow and Avro sources [datafusion]
via GitHub
Re: [I] percentile_cont is wrong for `Decimal32` with lower interpolation precision [datafusion]
via GitHub
Re: [I] `ScalarValue::iter_to_array` accepts mismatched type parameters [datafusion]
via GitHub
Re: [I] Ungrouped aggregation never charges accumulators' construction-time state to the memory pool [datafusion]
via GitHub
Re: [I] warning: linker stderr: ld: __eh_frame section too large [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Enable Adaptive Query Execution (AQE) by default [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Enable Adaptive Query Execution (AQE) by default [datafusion-ballista]
via GitHub
Re: [I] Ballista 53.0.0 — Coordinator OOM Crash on TPCH SF100 [datafusion-ballista]
via GitHub
Re: [I] Ballista 53.0.0 — Coordinator OOM Crash on TPCH SF100 [datafusion-ballista]
via GitHub
Re: [I] Update benchmark results in README [datafusion-ballista]
via GitHub
Re: [I] Update benchmark results in README [datafusion-ballista]
via GitHub
Re: [I] Unable to use Ballista at scale (e.g. TPC-H @ 1TB) [datafusion-ballista]
via GitHub
Re: [I] Unable to use Ballista at scale (e.g. TPC-H @ 1TB) [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Adaptive Query Execution (AQE) [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Adaptive Query Execution (AQE) [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Adaptive Query Execution (AQE) [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Shuffle file execs improvement [datafusion-ballista]
via GitHub
Re: [I] [EPIC] Shuffle file execs improvement [datafusion-ballista]
via GitHub
Re: [PR] Fix CASE evaluation for custom column expressions [datafusion]
via GitHub
Re: [PR] Fix CASE evaluation for custom column expressions [datafusion]
via GitHub
Re: [PR] Fix CASE evaluation for custom column expressions [datafusion]
via GitHub
Re: [PR] Fix CASE evaluation for custom column expressions [datafusion]
via GitHub
Re: [PR] Fix CASE evaluation for custom column expressions [datafusion]
via GitHub
Re: [PR] Fix CASE evaluation for custom column expressions [datafusion]
via GitHub
Re: [PR] Fix CASE evaluation for custom column expressions [datafusion]
via GitHub
Re: [PR] Fix CASE evaluation for custom column expressions [datafusion]
via GitHub
Re: [PR] fix(executor): wake graceful shutdown after tasks drain [datafusion-ballista]
via GitHub
Re: [PR] fix(executor): wake graceful shutdown after tasks drain [datafusion-ballista]
via GitHub
Re: [PR] fix(executor): wake graceful shutdown after tasks drain [datafusion-ballista]
via GitHub
Re: [PR] fix(executor): wake graceful shutdown after tasks drain [datafusion-ballista]
via GitHub
Re: [PR] fix: validate parquet statistics config [datafusion]
via GitHub
Re: [PR] fix: validate parquet statistics config [datafusion]
via GitHub
Re: [PR] fix: validate parquet statistics config [datafusion]
via GitHub
Re: [PR] fix: validate parquet statistics config [datafusion]
via GitHub
Re: [PR] fix: validate parquet statistics config [datafusion]
via GitHub
Re: [PR] fix: validate parquet statistics config [datafusion]
via GitHub
Re: [PR] fix: validate parquet statistics config [datafusion]
via GitHub
Re: [PR] fix: validate parquet statistics config [datafusion]
via GitHub
Re: [PR] fix: validate parquet statistics config [datafusion]
via GitHub
Re: [PR] refactor: thread PhysicalOptimizerContext through join_selection stats helpers [datafusion]
via GitHub
Re: [PR] refactor: thread PhysicalOptimizerContext through join_selection stats helpers [datafusion]
via GitHub
Re: [PR] refactor: thread PhysicalOptimizerContext through join_selection stats helpers [datafusion]
via GitHub
Re: [PR] refactor: thread PhysicalOptimizerContext through join_selection stats helpers [datafusion]
via GitHub
Re: [I] Avoid casting unreachable child values in nested List casts [datafusion]
via GitHub
Re: [PR] fix: Address avg return type overflow for decimals [datafusion]
via GitHub
Re: [PR] fix: Address avg return type overflow for decimals [datafusion]
via GitHub
Re: [PR] fix: Address avg return type overflow for decimals [datafusion]
via GitHub
Re: [PR] fix: Address avg return type overflow for decimals [datafusion]
via GitHub
Re: [I] Validate BALLISTA_PROTOCOL_VERSION for clients, not just executors [datafusion-ballista]
via GitHub
Re: [PR] feat: scheduler REST & GRPC returns ballista version headers [datafusion-ballista]
via GitHub
Re: [PR] feat: scheduler REST & GRPC returns ballista version headers [datafusion-ballista]
via GitHub
Re: [PR] fix: Avoid casting unreachable nested List values [datafusion]
via GitHub
Re: [PR] fix: Avoid casting unreachable nested List values [datafusion]
via GitHub
Re: [PR] fix(ffi): prevent recursive session physical planning [datafusion]
via GitHub
Re: [PR] fix(ffi): prevent recursive session physical planning [datafusion]
via GitHub
Re: [PR] fix(ffi): prevent recursive session physical planning [datafusion]
via GitHub
Re: [PR] fix(ffi): prevent recursive session physical planning [datafusion]
via GitHub
Re: [PR] fix(ffi): prevent recursive session physical planning [datafusion]
via GitHub
Re: [PR] fix: exclude child compute from NestedLoopJoinExec metrics [datafusion]
via GitHub
Re: [PR] fix: exclude child compute from NestedLoopJoinExec metrics [datafusion]
via GitHub
Re: [PR] fix: exclude child compute from NestedLoopJoinExec metrics [datafusion]
via GitHub
Re: [PR] fix: exclude child compute from NestedLoopJoinExec metrics [datafusion]
via GitHub
[PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
Re: [PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
Re: [PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
Re: [PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
Re: [PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
Re: [PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
Re: [PR] fix: prevent memory leak after failed Arrow vector import [datafusion-comet]
via GitHub
Re: [I] Vendored datafusion.proto sync check silently passes without checking datafusion.proto [datafusion-ballista]
via GitHub
Re: [I] Python client silently forces the static planner (pinned to ballista 54.0.0 defaults) [datafusion-ballista]
via GitHub
Re: [I] Python client silently forces the static planner (pinned to ballista 54.0.0 defaults) [datafusion-ballista]
via GitHub
Re: [I] Python client silently forces the static planner (pinned to ballista 54.0.0 defaults) [datafusion-ballista]
via GitHub
[PR] fix(core): stop forwarding BallistaConfig defaults to the scheduler [datafusion-ballista]
via GitHub
Re: [PR] fix(core): stop forwarding BallistaConfig defaults to the scheduler [datafusion-ballista]
via GitHub
Re: [PR] feat: Implement map-to-string casting [datafusion-comet]
via GitHub
Re: [PR] feat: Implement map-to-string casting [datafusion-comet]
via GitHub
Re: [PR] feat: Implement map-to-string casting [datafusion-comet]
via GitHub
Re: [PR] feat: Implement map-to-string casting [datafusion-comet]
via GitHub
Re: [PR] feat: support S3 compliant filesystems [datafusion-comet]
via GitHub
Re: [PR] feat: support S3 compliant filesystems [datafusion-comet]
via GitHub
Re: [PR] feat: support S3 compliant filesystems [datafusion-comet]
via GitHub
Re: [PR] feat: support S3 compliant filesystems [datafusion-comet]
via GitHub
Re: [PR] feat: support S3 compliant filesystems [datafusion-comet]
via GitHub
Re: [I] perf: bypass Arrow FFI for broadcast exchange reads [datafusion-comet]
via GitHub
[PR] perf: add direct native reads for broadcast exchange [datafusion-comet]
via GitHub
Re: [PR] perf: add direct native reads for broadcast exchange [datafusion-comet]
via GitHub
Re: [I] bug: `SparkCollectList`/`SparkCollectSet` declare nullable list elements, diverging from Spark's `containsNull = false` [datafusion]
via GitHub
[PR] fix: align Spark collect aggregate element nullability [datafusion]
via GitHub
Re: [PR] fix: align Spark collect aggregate element nullability [datafusion]
via GitHub
Re: [PR] fix: align Spark collect aggregate element nullability [datafusion]
via GitHub
Re: [PR] fix: align Spark collect aggregate element nullability [datafusion]
via GitHub
Re: [PR] fix: align Spark collect aggregate element nullability [datafusion]
via GitHub
Re: [PR] Fix OneSideHashJoiner memory size accounting [datafusion]
via GitHub
Re: [I] Allow for scaling RangePartitioning [datafusion]
via GitHub
Re: [I] Allow for scaling RangePartitioning [datafusion]
via GitHub
Re: [I] Allow for scaling RangePartitioning [datafusion]
via GitHub
[PR] feat: allow scaling RangePartitioning [datafusion]
via GitHub
Re: [PR] feat: allow scaling RangePartitioning [datafusion]
via GitHub
Re: [PR] feat: allow scaling RangePartitioning [datafusion]
via GitHub
Re: [PR] feat: allow scaling RangePartitioning [datafusion]
via GitHub
Re: [PR] feat: allow scaling RangePartitioning [datafusion]
via GitHub
Re: [PR] feat: allow scaling RangePartitioning [datafusion]
via GitHub
Re: [PR] perf: replace PiecewiseMergeJoin's visited bitmap with a suffix watermark (~1.8x faster Left join) [datafusion]
via GitHub
Re: [PR] perf: replace PiecewiseMergeJoin's visited bitmap with a suffix watermark (~1.8x faster Left join) [datafusion]
via GitHub
[I] `octet_length` should accept binary types [datafusion]
via GitHub
Re: [I] `octet_length` should accept binary types [datafusion]
via GitHub
Re: [I] Memory should not blow up after Arrow IPC write-read round trip during spilling [datafusion]
via GitHub
Re: [PR] fix: frame IPC messages when reading spill files so batches pin only their own bytes [datafusion]
via GitHub
Re: [PR] fix: preserve external sort workspace across spilling [datafusion]
via GitHub
Re: [PR] fix: preserve external sort workspace across spilling [datafusion]
via GitHub
Re: [PR] fix: preserve external sort workspace across spilling [datafusion]
via GitHub
Re: [PR] fix: preserve external sort workspace across spilling [datafusion]
via GitHub
Re: [PR] fix: preserve external sort workspace across spilling [datafusion]
via GitHub
Re: [PR] refactor(asof_join): enhance match value handling and comparator caching [datafusion]
via GitHub
Re: [PR] refactor(asof_join): enhance match value handling and comparator caching [datafusion]
via GitHub
Re: [PR] Support reading files with a boolean SBBF written by Parquet Java [datafusion]
via GitHub
Re: [PR] Support reading files with a boolean SBBF written by Parquet Java [datafusion]
via GitHub
[I] NestedLoopJoin memory-limited fallback lacks cross-partition left-bitmap coordination, so LEFT/FULL joins over a partitioned right side cannot spill [datafusion]
via GitHub
Re: [I] NestedLoopJoin memory-limited fallback lacks cross-partition left-bitmap coordination, so LEFT/FULL joins over a partitioned right side cannot spill [datafusion]
via GitHub
[PR] feat: enable native-only Celeborn shuffle planning (8/n) [datafusion-comet]
via GitHub
Re: [PR] feat: enable native-only Celeborn shuffle planning (8/n) [datafusion-comet]
via GitHub
Re: [PR] feat: enable native-only Celeborn shuffle planning (8/n) [datafusion-comet]
via GitHub
Re: [PR] feat: enable native-only Celeborn shuffle planning (8/n) [datafusion-comet]
via GitHub
Re: [PR] feat: enable native-only Celeborn shuffle planning (8/n) [datafusion-comet]
via GitHub
Re: [PR] feat: enable native-only Celeborn shuffle planning (8/n) [datafusion-comet]
via GitHub
Re: [PR] feat: enable native-only Celeborn shuffle planning (8/n) [datafusion-comet]
via GitHub
[I] Native Celeborn shuffle: the installed Celeborn bootstrap hook can break client creation for the whole executor [datafusion-comet]
via GitHub
Re: [I] Native Celeborn shuffle: the installed Celeborn bootstrap hook can break client creation for the whole executor [datafusion-comet]
via GitHub
[I] Native Celeborn shuffle: default maxFrameBytes of 64 MiB is unreachable, and a large row fails the whole job [datafusion-comet]
via GitHub
Re: [I] Native Celeborn shuffle: default maxFrameBytes of 64 MiB is unreachable, and a large row fails the whole job [datafusion-comet]
via GitHub
[I] Native Celeborn shuffle: the remote read path costs up to 4.5x local decode and is unbenchmarked [datafusion-comet]
via GitHub
Re: [I] Native Celeborn shuffle: the remote read path costs up to 4.5x local decode and is unbenchmarked [datafusion-comet]
via GitHub
Earlier messages
Later messages