github
Thread
Date
Earlier messages
Messages by Thread
[PR] fix: check nested TIMESTAMP_MILLIS overflow in unfiltered scans [datafusion-comet]
via GitHub
Re: [PR] fix: check nested TIMESTAMP_MILLIS overflow in unfiltered scans [datafusion-comet]
via GitHub
[I] Track nested-field statistics pruning and TIMESTAMP_MILLIS overflow parity in filtered scans [datafusion-comet]
via GitHub
Re: [I] Track nested-field statistics pruning and TIMESTAMP_MILLIS overflow parity in filtered scans [datafusion-comet]
via GitHub
[I] Full workspace clippy fails in PostgreSQL decimal formatting [datafusion]
via GitHub
[PR] Fix Postgres decimal formatter clippy [datafusion]
via GitHub
Re: [PR] Fix Postgres decimal formatter clippy [datafusion]
via GitHub
Re: [I] Add `pivot` & `unpivot` (melt) to DataFrame [datafusion]
via GitHub
[PR] fix: delegate the remaining codec methods in ComposedPhysicalExtensio… [datafusion]
via GitHub
Re: [PR] fix: fall back to Spark for negative-scale decimal casts and arithmetic [datafusion-comet]
via GitHub
[PR] Support predicate subqueries in projections [datafusion]
via GitHub
Re: [PR] Support predicate subqueries in projections [datafusion]
via GitHub
[PR] fix: preserve target extension metadata in INSERT [datafusion]
via GitHub
Re: [PR] fix: preserve target extension metadata in INSERT [datafusion]
via GitHub
[I] INSERT can drop target Arrow extension metadata [datafusion]
via GitHub
Re: [I] Consider defining more github views of common filters (like PRs waiting to review) [datafusion]
via GitHub
[PR] Support INSERT OVERWRITE for MemTable [datafusion]
via GitHub
Re: [PR] Support INSERT OVERWRITE for MemTable [datafusion]
via GitHub
[I] `LeftSemi` hash and nested loop joins report `EmissionType::Incremental` but emit only after the probe side is exhausted [datafusion]
via GitHub
Re: [I] `LeftSemi` hash and nested loop joins report `EmissionType::Incremental` but emit only after the probe side is exhausted [datafusion]
via GitHub
[I] Logical schema of an aggregate over GROUPING SETS is more nullable than the physical schema [datafusion]
via GitHub
[I] Substrait consumer ignores AggregateFunction.phase, so an intermediate aggregate runs as a complete one [datafusion]
via GitHub
[PR] Reduce binary size of `ScalarUDFImpl` default impls [datafusion]
via GitHub
Re: [PR] Reduce binary size of `ScalarUDFImpl` default impls [datafusion]
via GitHub
Re: [I] Improve the performance of range re-partitioning [datafusion]
via GitHub
[PR] refactor: share join input unparsing [datafusion]
via GitHub
Re: [PR] refactor: share join input unparsing [datafusion]
via GitHub
Re: [PR] refactor: share join input unparsing [datafusion]
via GitHub
[PR] test: consolidate ASOF SQL coverage [datafusion]
via GitHub
Re: [PR] test: consolidate ASOF SQL coverage [datafusion]
via GitHub
Re: [PR] test: consolidate ASOF SQL coverage [datafusion]
via GitHub
[PR] fix: defer `InterleaveExec` partitioning check to `InvariantLevel::Executable` [datafusion]
via GitHub
Re: [PR] fix: defer `InterleaveExec` partitioning check to `InvariantLevel::Executable` [datafusion]
via GitHub
Re: [PR] fix: defer `InterleaveExec` partitioning check to `InvariantLevel::Executable` [datafusion]
via GitHub
[PR] fix: align time parsing and native second extraction with Spark [datafusion-comet]
via GitHub
[PR] perf: evaluate posexplode array expressions once per batch [datafusion-comet]
via GitHub
[PR] perf: avoid repeated decimal promotion in expression serialization [datafusion-comet]
via GitHub
[PR] refactor: use Arrow cast for date to timestamp NTZ [datafusion-comet]
via GitHub
[PR] perf: specialize native cache statistics collection [datafusion-comet]
via GitHub
[PR] refactor(hash-aggr): Small fixes and finish hash aggregation refactor [datafusion]
via GitHub
Re: [PR] refactor(hash-aggr): Small fixes and finish hash aggregation refactor [datafusion]
via GitHub
Re: [PR] refactor(hash-aggr): Small fixes and finish hash aggregation refactor [datafusion]
via GitHub
[PR] fix: support AQE table-cache stages for Comet in-memory scans [datafusion-comet]
via GitHub
Re: [PR] Adaptive (runtime, stats-based) conjunct reordering for FilterExec [datafusion]
via GitHub
[I] Correlated `EXISTS`/`IN` subqueries with groupless aggregates hit the count bug [datafusion]
via GitHub
[PR] fix: normalize `InterleaveExec` to `UnionExec` before enforcing distribution [datafusion]
via GitHub
Re: [PR] fix: normalize `InterleaveExec` to `UnionExec` before enforcing distribution [datafusion]
via GitHub
Re: [PR] fix: normalize `InterleaveExec` to `UnionExec` before enforcing distribution [datafusion]
via GitHub
Re: [PR] fix: normalize `InterleaveExec` to `UnionExec` before enforcing distribution [datafusion]
via GitHub
Re: [PR] fix: normalize `InterleaveExec` to `UnionExec` before enforcing distribution [datafusion]
via GitHub
[PR] fix: sort pushed below `GlobalLimitExec` ignores `skip`, returning too few rows [datafusion]
via GitHub
Re: [PR] fix: sort pushed below `GlobalLimitExec` ignores `skip`, returning too few rows [datafusion]
via GitHub
Re: [PR] Extract dynamic filter expression composition from `SharedBuildAccumulator::build_filter` [datafusion]
via GitHub
Re: [PR] perf(hash-join): eliminate intermediate array allocations in probe-side collision filter [datafusion]
via GitHub
[PR] refactor: simplify null-aware and join-type branching in hash join [datafusion]
via GitHub
Re: [PR] refactor: simplify null-aware and join-type branching in hash join [datafusion]
via GitHub
Re: [PR] refactor: simplify null-aware and join-type branching in hash join [datafusion]
via GitHub
Re: [PR] refactor: simplify null-aware and join-type branching in hash join [datafusion]
via GitHub
Re: [PR] refactor: simplify null-aware and join-type branching in hash join [datafusion]
via GitHub
[PR] fix: narrow Iceberg complex-null scan fallback to struct columns [datafusion-comet]
via GitHub
Re: [PR] fix: narrow Iceberg complex-null scan fallback to struct columns [datafusion-comet]
via GitHub
[I] Iceberg scan falls back to Spark on IS NULL/IS NOT NULL over list/map columns (stale complex-type check) [datafusion-comet]
via GitHub
[PR] chore: add_benches_hash_agg [datafusion-comet]
via GitHub
[PR] fix: native Iceberg write panics on an evolved partition spec and on a timestamptz partition path [datafusion-comet]
via GitHub
Re: [PR] fix: native Iceberg write panics on an evolved partition spec and on a timestamptz partition path [datafusion-comet]
via GitHub
[PR] Add Lance contrib build gate [datafusion-comet]
via GitHub
[PR] perf: validate shuffle IPC context reuse savings [datafusion-comet]
via GitHub
[PR] fix: distinguish "nothing spilled" from a spill backend with no local path [datafusion-comet]
via GitHub
Re: [PR] feat: Lambda function support from DataFusion, illustrated with array_filter [datafusion-comet]
via GitHub
[PR] feat: execute concat_ws with array arguments natively [datafusion-comet]
via GitHub
Re: [PR] feat: execute concat_ws with array arguments natively [datafusion-comet]
via GitHub
[PR] feat: support bloom filters in native Iceberg writes [datafusion-comet]
via GitHub
[PR] feat: Enable adaptive partial aggregation for eligible native shuffle plans [datafusion-comet]
via GitHub
Re: [I] Support FIRST/LAST with `PartialMerge` [datafusion-comet]
via GitHub
[PR] perf: cache remote shuffle schemas and benchmark decoding [datafusion-comet]
via GitHub
Re: [PR] perf: cache expected schemas for remote shuffle decoding [datafusion-comet]
via GitHub
Re: [PR] perf: cache expected schemas for remote shuffle decoding [datafusion-comet]
via GitHub
[PR] build(deps): bump arrow-select from 59.2.0 to 59.3.0 [datafusion-python]
via GitHub
[PR] build(deps): bump uuid from 1.23.3 to 1.26.0 [datafusion-python]
via GitHub
[PR] build(deps): bump futures from 0.3.32 to 0.3.34 [datafusion-python]
via GitHub
Re: [PR] build(deps): bump arrow from 58.3.0 to 59.0.0 [datafusion-python]
via GitHub
Re: [PR] build(deps): bump arrow from 58.3.0 to 59.0.0 [datafusion-python]
via GitHub
[PR] build(deps): bump arrow-schema from 59.2.0 to 59.3.0 [datafusion-python]
via GitHub
[PR] build(deps): bump arrow from 59.2.0 to 59.3.0 [datafusion-python]
via GitHub
[PR] build(deps): bump arrow-array from 59.2.0 to 59.3.0 [datafusion-python]
via GitHub
Re: [I] chore: DataFusion 55.0.0 [datafusion-comet]
via GitHub
Re: [PR] fix: prevent libhdfs thread destructor use-after-free [datafusion-comet]
via GitHub
Re: [I] [EPIC] Improve Comet metrics [datafusion-comet]
via GitHub
Re: [I] [EPIC] Improve Comet metrics [datafusion-comet]
via GitHub
Re: [I] [EPIC] Improve Comet metrics [datafusion-comet]
via GitHub
[PR] fix: disable conflicting IfBraceChecker [datafusion-comet]
via GitHub
Re: [PR] fix: disable conflicting IfBraceChecker [datafusion-comet]
via GitHub
Re: [PR] fix: disable conflicting IfBraceChecker [datafusion-comet]
via GitHub
[PR] feat: route next_day and levenshtein collated input through the codegen dispatcher [datafusion-comet]
via GitHub
[PR] test(chaos): run #2029 executor-loss scenarios on the k8s backend [datafusion-ballista]
via GitHub
Re: [PR] test(chaos): run #2029 executor-loss scenarios on the k8s backend [datafusion-ballista]
via GitHub
Re: [PR] test(chaos): run #2029 executor-loss scenarios on the k8s backend [datafusion-ballista]
via GitHub
Re: [PR] feat: add extension to support `DataFrame::checkpoint()` [datafusion-ballista]
via GitHub
Re: [PR] feat: add extension to support `DataFrame::checkpoint()` [datafusion-ballista]
via GitHub
Re: [I] Add support for `DataFrame.cache()` to Ballista [datafusion-ballista]
via GitHub
[PR] fix: make columnar-to-row benchmarks exercise Comet [datafusion-comet]
via GitHub
Re: [PR] fix: make columnar-to-row benchmarks exercise Comet [datafusion-comet]
via GitHub
Re: [PR] fix: make columnar-to-row benchmarks exercise Comet [datafusion-comet]
via GitHub
[I] revertToSpark erases CometIcebergWriteExec / CometNativeWriteExec because originalPlan is the node's own child [datafusion-comet]
via GitHub
[I] Re-enable adaptive skip-partial aggregation for supported high-cardinality aggregates [datafusion-comet]
via GitHub
Re: [I] Re-enable adaptive skip-partial aggregation for supported high-cardinality aggregates [datafusion-comet]
via GitHub
[I] String-to-timestamp cast rejects explicit positive years accepted by Spark [datafusion-comet]
via GitHub
Re: [I] String-to-timestamp cast rejects explicit positive years accepted by Spark [datafusion-comet]
via GitHub
[PR] feat: normalize marked Variant arrays at the native Parquet boundary [datafusion-comet]
via GitHub
Re: [PR] feat: normalize marked Variant arrays at the native Parquet boundary [datafusion-comet]
via GitHub
Re: [PR] feat: normalize marked Variant arrays at the native Parquet boundary [datafusion-comet]
via GitHub
[PR] feat: fuse the typed Dataset map sandwich into a Comet projection [datafusion-comet]
via GitHub
Re: [PR] feat: fuse the typed Dataset map sandwich into a Comet projection [datafusion-comet]
via GitHub
[PR] refactor: make Spark-to-Arrow batch row counts explicit [datafusion-comet]
via GitHub
[I] Follow up on post-merge review of the native sequence kernel: perf crossover, unbounded per-batch allocation, and missing ceiling coverage [datafusion-comet]
via GitHub
[I] `make format` output fails scalastyle IfBraceChecker (scalafmt wraps long brace-less if/else without adding braces) [datafusion-comet]
via GitHub
Re: [I] `make format` output fails scalastyle IfBraceChecker (scalafmt wraps long brace-less if/else without adding braces) [datafusion-comet]
via GitHub
Re: [I] `make format` output fails scalastyle IfBraceChecker (scalafmt wraps long brace-less if/else without adding braces) [datafusion-comet]
via GitHub
Re: [I] `make format` output fails scalastyle IfBraceChecker (scalafmt wraps long brace-less if/else without adding braces) [datafusion-comet]
via GitHub
Re: [I] `make format` output fails scalastyle IfBraceChecker (scalafmt wraps long brace-less if/else without adding braces) [datafusion-comet]
via GitHub
Re: [I] Implement sequence natively for integral types instead of JVM codegen dispatch [datafusion-comet]
via GitHub
[I] Fuse the SerializeFromObject / MapElements / DeserializeToObject sandwich into a Comet projection instead of falling back [datafusion-comet]
via GitHub
[I] Slice arrays before normalizing to avoid allocating over the whole backing buffer [datafusion-comet]
via GitHub
Re: [I] Slice arrays before normalizing to avoid allocating over the whole backing buffer [datafusion-comet]
via GitHub
Re: [I] Support to read S3-compliant object stores [datafusion-comet]
via GitHub
[I] Re-enable the two ignored CometAggregateSuite metric tests after the DataFusion 55 peak_mem_used change [datafusion-comet]
via GitHub
Re: [I] Re-enable the two ignored CometAggregateSuite metric tests after the DataFusion 55 peak_mem_used change [datafusion-comet]
via GitHub
[I] [EPIC] DataFusion 55 upgrade follow-ups [datafusion-comet]
via GitHub
Re: [I] [EPIC] DataFusion 55 upgrade follow-ups [datafusion-comet]
via GitHub
[I] Establish whether the DataFusion 55 TPC-H off-heap bump is real, and changelog it if so [datafusion-comet]
via GitHub
Re: [I] Establish whether the DataFusion 55 TPC-H off-heap bump is real, and changelog it if so [datafusion-comet]
via GitHub
[I] Nested Parquet cast retention accepts an ambiguous case-insensitive field match [datafusion-comet]
via GitHub
Re: [I] Nested Parquet cast retention accepts an ambiguous case-insensitive field match [datafusion-comet]
via GitHub
[I] SpillWriter::path() conflates "nothing spilled" with "backend has no local path" [datafusion-comet]
via GitHub
Re: [I] SpillWriter::path() conflates "nothing spilled" with "backend has no local path" [datafusion-comet]
via GitHub
[I] copy_array panics on offset overflow instead of returning an error [datafusion-comet]
via GitHub
Re: [I] copy_array panics on offset overflow instead of returning an error [datafusion-comet]
via GitHub
[I] Signed-zero array test fixtures claim the literal case agrees with Spark when it does not [datafusion-comet]
via GitHub
Re: [I] Signed-zero array test fixtures claim the literal case agrees with Spark when it does not [datafusion-comet]
via GitHub
[I] array_distinct and array_union diverge from Spark on -0.0 for Spark versions without SPARK-54918 [datafusion-comet]
via GitHub
Re: [I] array_distinct and array_union diverge from Spark on -0.0 for Spark versions without SPARK-54918 [datafusion-comet]
via GitHub
[PR] Pwmj metrics accounting [datafusion]
via GitHub
Re: [PR] Pwmj metrics accounting [datafusion]
via GitHub
Re: [PR] Pwmj metrics accounting [datafusion]
via GitHub
Re: [PR] Pwmj metrics accounting [datafusion]
via GitHub
Re: [PR] Pwmj metrics accounting [datafusion]
via GitHub
Re: [PR] Pwmj metrics accounting [datafusion]
via GitHub
Re: [PR] Pwmj metrics accounting [datafusion]
via GitHub
Re: [PR] Pwmj metrics accounting [datafusion]
via GitHub
Re: [I] Cleanup aggregation planning [datafusion]
via GitHub
Re: [I] Cleanup aggregation planning [datafusion]
via GitHub
[PR] Optimize NULL-containing string IN list pruning [datafusion]
via GitHub
Re: [PR] Optimize NULL-containing string IN list pruning [datafusion]
via GitHub
Re: [PR] Optimize NULL-containing string IN list pruning [datafusion]
via GitHub
Re: [PR] Optimize NULL-containing string IN list pruning [datafusion]
via GitHub
Re: [I] chore: Fix Scala code warnings [datafusion-comet]
via GitHub
Re: [I] chore: Fix Scala code warnings [datafusion-comet]
via GitHub
Re: [I] chore: Fix Scala code warnings [datafusion-comet]
via GitHub
Re: [PR] Add xmlnamespace support mssql [datafusion-sqlparser-rs]
via GitHub
Re: [PR] Add xmlnamespace support mssql [datafusion-sqlparser-rs]
via GitHub
Re: [PR] fix: flush FilterExec output on pending inut for unbounded inputs [datafusion]
via GitHub
Re: [PR] fix: flush FilterExec output on pending inut for unbounded inputs [datafusion]
via GitHub
[PR] bench: add PWMJ vs NestedLoopJoin criterion coverage for LeftMark/Rig… [datafusion]
via GitHub
Re: [PR] bench: add PWMJ vs NestedLoopJoin criterion coverage for LeftMark/Rig… [datafusion]
via GitHub
Re: [PR] bench: add PWMJ vs NestedLoopJoin criterion coverage for LeftMark/Rig… [datafusion]
via GitHub
Re: [PR] bench: add PWMJ vs NestedLoopJoin criterion coverage for LeftMark/Rig… [datafusion]
via GitHub
Re: [PR] bench: add PWMJ vs NestedLoopJoin criterion coverage for LeftMark/Rig… [datafusion]
via GitHub
Re: [I] Substrait consumer: DuplicateUnqualifiedField when chaining two Window relations with a carried window column [datafusion]
via GitHub
Re: [I] Consider an enclosing-range fallback for `IN` lists above `max_in_list_size` [datafusion]
via GitHub
[PR] fix: avoid unsafe set rewrites for compound IN lists [datafusion]
via GitHub
Re: [PR] fix: avoid unsafe set rewrites for compound IN lists [datafusion]
via GitHub
[PR] fix: stabilize grouped correlation with centered moments [datafusion]
via GitHub
Re: [PR] fix: stabilize grouped correlation with centered moments [datafusion]
via GitHub
[PR] fix: reject NULL partition keys during partitioned writes [datafusion]
via GitHub
Re: [I] Support zero copy hash repartitioning for Hash Join [datafusion]
via GitHub
Re: [I] Support zero copy hash repartitioning for Hash Join [datafusion]
via GitHub
Re: [I] [DISCUSSION] Maybe support planning scalar function in `ExprPlanner` as well? [datafusion]
via GitHub
[PR] add benches array [datafusion-comet]
via GitHub
Re: [PR] chore: add benches array functions [datafusion-comet]
via GitHub
Re: [PR] chore: add benches array functions [datafusion-comet]
via GitHub
Re: [PR] chore: add benches array functions [datafusion-comet]
via GitHub
Re: [PR] chore: add benches array functions [datafusion-comet]
via GitHub
Re: [I] Comet native Parquet scan reads full nested columns despite pruned Spark ReadSchema [datafusion-comet]
via GitHub
Re: [I] Comet native Parquet scan reads full nested columns despite pruned Spark ReadSchema [datafusion-comet]
via GitHub
Re: [I] Comet native Parquet scan reads full nested columns despite pruned Spark ReadSchema [datafusion-comet]
via GitHub
[I] [Bug] spark factorial: BIGINT overflow should wrap in non-ANSI mode and raise CAST_OVERFLOW in ANSI mode, as in Spark [datafusion]
via GitHub
[PR] fix: reject a zero `objectstore_writer_buffer_size` instead of hanging [datafusion]
via GitHub
Re: [I] [Discussion] Should hash join order be based on memory size? [datafusion]
via GitHub
Re: [I] [Discussion] Should hash join order be based on memory size? [datafusion]
via GitHub
[PR] fix: compare struct and map scalars with a dynamic comparator [datafusion]
via GitHub
[PR] [Comet] Push native join runtime filters into Parquet scans [datafusion-comet]
via GitHub
Re: [PR] feat: push native join runtime filters into Parquet scans [datafusion-comet]
via GitHub
Re: [PR] feat: push native join runtime filters into Parquet scans [datafusion-comet]
via GitHub
Re: [PR] feat: push native join runtime filters into Parquet scans [datafusion-comet]
via GitHub
Re: [PR] feat: native dynamic filter pushdown for hash join into Parquet scans [datafusion-comet]
via GitHub
Re: [PR] feat: native dynamic filter pushdown for hash join into Parquet scans [datafusion-comet]
via GitHub
Re: [PR] feat: native dynamic filter pushdown for hash join into Parquet scans [datafusion-comet]
via GitHub
Re: [PR] feat: native dynamic filter pushdown for hash join into Parquet scans [datafusion-comet]
via GitHub
Re: [PR] feat: native dynamic filter pushdown for hash join into Parquet scans [datafusion-comet]
via GitHub
[I] Native Iceberg writer raises a different exception than iceberg-java for unclustered input to a clustered writer [datafusion-comet]
via GitHub
Earlier messages