github
Thread
Date
Earlier messages
Later messages
Messages by Thread
[I] Upstream Spark-compatible approx_count_distinct (HyperLogLogPlusPlus) to the datafusion-spark crate [datafusion-comet]
via GitHub
[PR] feat: spilling hash join operator (opt-in, inner joins) [datafusion-ballista]
via GitHub
[PR] Unwrap Date32 <-> Date64 casts in comparison predicates [datafusion]
via GitHub
Re: [PR] Unwrap Date32 <-> Date64 casts in comparison predicates [datafusion]
via GitHub
Re: [PR] Unwrap widening Date32 -> Date64 casts in comparison predicates [datafusion]
via GitHub
Re: [PR] Unwrap widening Date32 -> Date64 casts in comparison predicates [datafusion]
via GitHub
Re: [PR] Unwrap widening Date32 -> Date64 casts in comparison predicates [datafusion]
via GitHub
Re: [PR] Unwrap widening Date32 -> Date64 casts in comparison predicates [datafusion]
via GitHub
Re: [PR] Unwrap widening Date32 -> Date64 casts in comparison predicates [datafusion]
via GitHub
Re: [PR] Unwrap widening Date32 -> Date64 casts in comparison predicates [datafusion]
via GitHub
Re: [PR] Unwrap widening Date32 -> Date64 casts in comparison predicates [datafusion]
via GitHub
Re: [PR] Unwrap widening Date32 -> Date64 casts in comparison predicates [datafusion]
via GitHub
[PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [PR] TEST: check performance with sparse masks [datafusion]
via GitHub
Re: [I] Register CometArrowAllocator as a Spark MemoryConsumer for JVM-UDF dispatch [datafusion-comet]
via GitHub
[PR] fix: unwrap identity Date cast in comparison unwrapping [datafusion]
via GitHub
Re: [PR] fix: unwrap identity Date cast in comparison unwrapping [datafusion]
via GitHub
Re: [PR] fix: unwrap identity Date cast in comparison unwrapping [datafusion]
via GitHub
Re: [PR] fix: unwrap identity Date cast in comparison unwrapping [datafusion]
via GitHub
Re: [PR] fix: unwrap identity Date cast in comparison unwrapping [datafusion]
via GitHub
Re: [PR] fix: unwrap identity Date cast in comparison unwrapping [datafusion]
via GitHub
Re: [PR] fix: unwrap identity Date cast in comparison unwrapping [datafusion]
via GitHub
Re: [I] Support dynamic filters for range co-partitioned joins [datafusion]
via GitHub
Re: [I] Support dynamic filters for range co-partitioned joins [datafusion]
via GitHub
Re: [I] Support dynamic filters for range co-partitioned joins [datafusion]
via GitHub
Re: [I] Support dynamic filters for range co-partitioned joins [datafusion]
via GitHub
Re: [I] Support dynamic filters for range co-partitioned joins [datafusion]
via GitHub
[PR] fix: executor hanging on ctrl+c [datafusion-ballista]
via GitHub
Re: [PR] fix: executor hanging on ctrl+c [datafusion-ballista]
via GitHub
[I] Implement TimeType support - Time extraction (from TimeType to Int/Decimal) [datafusion-comet]
via GitHub
Re: [I] Implement TimeType support - Time extraction (from TimeType to Int/Decimal) [datafusion-comet]
via GitHub
[PR] perf: dedupe Iceberg delete files by index in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg delete files by index in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg delete files by index in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg delete files by index in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg delete files by index in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg delete files by index in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg delete files by index in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg delete files by index in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
Re: [PR] perf: dedupe Iceberg residuals and delete files in native scan serde [datafusion-comet]
via GitHub
[PR] chore(join): refactor `BitwiseSortMergeJoinStream` to use generators instead of manual state [datafusion]
via GitHub
Re: [PR] chore(join): refactor `BitwiseSortMergeJoinStream` to use generators instead of manual state [datafusion]
via GitHub
[PR] chore: remove dead Parquet parallel-IO configs [datafusion-comet]
via GitHub
Re: [PR] chore: remove dead Parquet parallel-IO configs [datafusion-comet]
via GitHub
Re: [PR] chore: remove dead Parquet parallel-IO configs [datafusion-comet]
via GitHub
Re: [PR] chore: remove dead Parquet parallel-IO configs [datafusion-comet]
via GitHub
Re: [PR] fix: skip dynamic filter pushdown for null-aware anti joins with a nullable build key [datafusion]
via GitHub
Re: [PR] fix: skip dynamic filter pushdown for null-aware anti joins with a nullable build key [datafusion]
via GitHub
Re: [PR] fix: skip dynamic filter pushdown for null-aware anti joins with a nullable build key [datafusion]
via GitHub
Re: [PR] fix: skip dynamic filter pushdown for null-aware anti joins with a nullable build key [datafusion]
via GitHub
Re: [PR] fix: skip dynamic filter pushdown for null-aware anti joins with a nullable build key [datafusion]
via GitHub
Re: [PR] fix: skip dynamic filter pushdown for null-aware anti joins with a nullable build key [datafusion]
via GitHub
Re: [I] (Informational) AI driven performance analysis of scan implementation across plain Spark, Velox, and Comet [datafusion-comet]
via GitHub
Re: [I] (Informational) AI driven performance analysis of scan implementation across plain Spark, Velox, and Comet [datafusion-comet]
via GitHub
Re: [I] (Informational) AI driven performance analysis of scan implementation across plain Spark, Velox, and Comet [datafusion-comet]
via GitHub
Re: [PR] Add optional native Lance scan support [datafusion-comet]
via GitHub
Re: [PR] Add optional native Lance scan support [datafusion-comet]
via GitHub
[I] Bug triage results: 2026-07-20 [datafusion-comet]
via GitHub
Re: [PR] Added support for unpivot in Redshift with expression and bracketsless [datafusion-sqlparser-rs]
via GitHub
Re: [PR] Added support for unpivot in Redshift with expression and bracketsless [datafusion-sqlparser-rs]
via GitHub
Re: [PR] Added support for unpivot in Redshift with expression and bracketsless [datafusion-sqlparser-rs]
via GitHub
Re: [PR] feat: support approx_count_distinct aggregate expression [datafusion-comet]
via GitHub
Re: [PR] feat: support approx_count_distinct aggregate expression [datafusion-comet]
via GitHub
Re: [PR] feat: support approx_count_distinct aggregate expression [datafusion-comet]
via GitHub
Re: [PR] feat(parquet): implement file commit protocol for native Parquet writes [datafusion-comet]
via GitHub
[PR] Js/benchmark 4 dynamic filtering alternatives [datafusion]
via GitHub
Re: [PR] Js/benchmark 4 dynamic filtering alternatives [datafusion]
via GitHub
Re: [PR] Js/benchmark 4 dynamic filtering alternatives [datafusion]
via GitHub
Re: [PR] Js/benchmark 4 dynamic filtering alternatives [datafusion]
via GitHub
Re: [PR] feat: support listagg / string_agg aggregate (Spark 4.0+) [datafusion-comet]
via GitHub
Re: [PR] feat: support listagg / string_agg aggregate (Spark 4.0+) [datafusion-comet]
via GitHub
Re: [PR] feat: support listagg / string_agg aggregate (Spark 4.0+) [datafusion-comet]
via GitHub
[PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
Re: [PR] Remove the hash-partitioning shuffle writer [datafusion-ballista]
via GitHub
[PR] feat(substrait): add extension table consumer hook [datafusion]
via GitHub
Re: [PR] feat(substrait): add extension table consumer hook [datafusion]
via GitHub
Re: [PR] feat(substrait): add extension table consumer hook [datafusion]
via GitHub
[I] executor hangs on `ctrl+c` [datafusion-ballista]
via GitHub
Re: [I] executor hangs on `ctrl+c` [datafusion-ballista]
via GitHub
Re: [I] executor hangs on `ctrl+c` [datafusion-ballista]
via GitHub
[PR] feat: add withAlternative alias mechanism for CometConf [datafusion-comet]
via GitHub
Re: [PR] feat: add withAlternative alias mechanism for CometConf [datafusion-comet]
via GitHub
Re: [PR] feat: add withAlternative alias mechanism for CometConf [datafusion-comet]
via GitHub
Re: [PR] feat: add withAlternative alias mechanism for CometConf [datafusion-comet]
via GitHub
Re: [PR] feat: add withAlternative alias mechanism for CometConf [datafusion-comet]
via GitHub
[I] Config naming audit: rename inconsistent spark.comet.* keys before 1.0 [datafusion-comet]
via GitHub
[PR] chore(scheduler,executor): downgrade #2038 per-task traces to debug [datafusion-ballista]
via GitHub
Re: [PR] chore(scheduler,executor): downgrade #2038 per-task traces to debug [datafusion-ballista]
via GitHub
[I] scheduler logs quite noisy [datafusion-ballista]
via GitHub
Re: [I] scheduler logs quite noisy [datafusion-ballista]
via GitHub
Re: [I] scheduler logs quite noisy [datafusion-ballista]
via GitHub
Re: [I] scheduler logs quite noisy [datafusion-ballista]
via GitHub
Re: [I] scheduler logs quite noisy [datafusion-ballista]
via GitHub
[PR] docs: document Spark version adoption and support-lifetime policy [datafusion-comet]
via GitHub
Re: [PR] docs: document Spark version adoption and support-lifetime policy [datafusion-comet]
via GitHub
Re: [PR] docs: document Spark version adoption and support-lifetime policy [datafusion-comet]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
Re: [PR] IN LIST: add branchless filter for small primitive lists [datafusion]
via GitHub
[I] Benchmarks: persist partial/failed TPC-H results and add a compare tool [datafusion-ballista]
via GitHub
Re: [I] Benchmarks: persist partial/failed TPC-H results and add a compare tool [datafusion-ballista]
via GitHub
[PR] feat(benchmarks): persist TPC-H results resiliently and add a compare subcommand [datafusion-ballista]
via GitHub
Re: [PR] feat(benchmarks): persist TPC-H results resiliently and add a compare subcommand [datafusion-ballista]
via GitHub
Re: [PR] feat(benchmarks): persist TPC-H results resiliently and add a compare subcommand [datafusion-ballista]
via GitHub
Re: [I] try_to_date / try_to_timestamp fall back to Spark even though to_date / to_timestamp are accelerated [datafusion-comet]
via GitHub
Re: [PR] fix: reduce peak memory usage when round robin tiebreaker is disabled [datafusion]
via GitHub
[PR] fix: generate_series overflow panics at i64 boundary and out-of-range dates [datafusion]
via GitHub
Re: [PR] fix: generate_series overflow panics at i64 boundary and out-of-range dates [datafusion]
via GitHub
Re: [PR] fix: generate_series overflow panics at i64 boundary and out-of-range dates [datafusion]
via GitHub
Re: [I] panic: generate_series table function overflows when integer step passes i64::MAX [datafusion]
via GitHub
Re: [I] panic: generate_series table function overflows when integer step passes i64::MAX [datafusion]
via GitHub
[PR] feat: support interval codegen dispatch for nested values and native shuffle [datafusion-comet]
via GitHub
Re: [PR] feat: support interval codegen dispatch for nested values and native shuffle [datafusion-comet]
via GitHub
Re: [I] Comet writer should support 2PC and staging output [datafusion-comet]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
Re: [PR] POC hash aggregate repartition subpartitions [datafusion]
via GitHub
[PR] fix: support Dictionary arrays in regex_match_dyn (#23709) [datafusion]
via GitHub
Re: [PR] fix: support Dictionary arrays in regex_match_dyn (#23709) [datafusion]
via GitHub
Re: [PR] fix: support Dictionary arrays in regex_match_dyn (#23709) [datafusion]
via GitHub
Re: [PR] fix: support Dictionary arrays in regex_match_dyn (#23709) [datafusion]
via GitHub
Re: [PR] fix: support Dictionary arrays in regex_match_dyn (#23709) [datafusion]
via GitHub
Re: [PR] fix: support Dictionary arrays in regex_match_dyn (#23709) [datafusion]
via GitHub
Re: [PR] fix: support Dictionary arrays in regex_match_dyn (#23709) [datafusion]
via GitHub
Re: [PR] fix: support Dictionary arrays in regex_match_dyn (#23709) [datafusion]
via GitHub
Re: [PR] fix: support Dictionary arrays in regex_match_dyn (#23709) [datafusion]
via GitHub
Re: [PR] chore(deps): bump object_store from 0.13.2 to 0.14.0 in /python [datafusion-ballista]
via GitHub
Re: [PR] chore(deps): bump object_store from 0.13.2 to 0.14.0 in /python [datafusion-ballista]
via GitHub
Re: [I] Improve performance of high cardinality grouping by reusing hash values [datafusion]
via GitHub
Re: [I] Improve performance of high cardinality grouping by reusing hash values [datafusion]
via GitHub
Earlier messages
Later messages