github
Thread
Date
Earlier messages
Messages by Thread
Re: [PR] Separate the LAMBDA keyword syntax from the -> lambda syntax [datafusion-sqlparser-rs]
via GitHub
[PR] test: cover remaining IN list paths [datafusion]
via GitHub
Re: [PR] test: cover remaining IN list paths [datafusion]
via GitHub
[PR] feat(parquet): support page-level limit pruning [datafusion]
via GitHub
Re: [PR] feat(parquet): support page-level limit pruning [datafusion]
via GitHub
[I] BUG: DELETE with a LIMIT clause ignores the LIMIT and deletes every matching row [datafusion]
via GitHub
[PR] fix, perf: Use Arrow comparator for key comparison in `map_extract` [datafusion]
via GitHub
Re: [PR] fix, perf: Use Arrow comparator for key comparison in `map_extract` [datafusion]
via GitHub
[PR] Add TrinoDialect [datafusion-sqlparser-rs]
via GitHub
[PR] Parse FOR TIMESTAMP AS OF and FOR VERSION AS OF table versions [datafusion-sqlparser-rs]
via GitHub
[PR] fix: preserve ANSI errors for rejected TIMESTAMP_NTZ casts [datafusion-comet]
via GitHub
[PR] test: cover ambiguous exact nested Parquet field matches [datafusion-comet]
via GitHub
[PR] fix: gate array distinct and union signed-zero semantics by Spark version [datafusion-comet]
via GitHub
Re: [PR] fix: enable FIRST/LAST partial merge [datafusion-comet]
via GitHub
Re: [I] Any plan to implement datafusion go/c++ binding? [datafusion]
via GitHub
[I] CAST(string AS TIMESTAMP_NTZ) swallows ANSI errors when the year-range guard rejects [datafusion-comet]
via GitHub
[PR] fix: mark Count aggregate function as order-insensitive [datafusion]
via GitHub
Re: [PR] fix: prevent panic and incorrect results for COUNT with ORDER BY [datafusion]
via GitHub
[PR] feat: add early emit count metric to partial aggregates [datafusion]
via GitHub
[I] Show when partial aggregation flushes because of memory pressure [datafusion]
via GitHub
Re: [I] Show when partial aggregation flushes because of memory pressure [datafusion]
via GitHub
[I] `TrackConsumersPool` makes memory updates wait on one shared lock [datafusion]
via GitHub
Re: [I] `TrackConsumersPool` makes memory updates wait on one shared lock [datafusion]
via GitHub
[PR] perf: allow concurrent TrackConsumersPool updates [datafusion]
via GitHub
Re: [PR] fix(core): reject a DELETE or an UPDATE whose WHERE clause cannot reach the provider [datafusion]
via GitHub
Re: [PR] fix(core): reject a DELETE or an UPDATE whose WHERE clause cannot reach the provider [datafusion]
via GitHub
Re: [PR] fix(core): reject a DELETE or an UPDATE whose WHERE clause cannot reach the provider [datafusion]
via GitHub
[PR] fix: attach tokio runtime threads to the JVM as daemon threads [datafusion-comet]
via GitHub
[PR] fix: propagate Arrow array copy errors [datafusion-comet]
via GitHub
[PR] fix: explain ObjectHashAggregate fallback when Comet shuffle is disabled [datafusion-comet]
via GitHub
[PR] [branch-55] fix: preserve projection metadata during optimization (#24670) [datafusion]
via GitHub
Re: [PR] [branch-55] fix: preserve projection metadata during optimization (#24670) [datafusion]
via GitHub
Re: [PR] [branch-55] fix: preserve projection metadata during optimization (#24670) [datafusion]
via GitHub
Re: [PR] [branch-55] fix: preserve projection metadata during optimization (#24670) [datafusion]
via GitHub
[PR] fix: apply regexp_instr subexpr to the N-th match, not the first [datafusion]
via GitHub
[PR] test: restore Spark 4.1 Variant shredding suites [datafusion-comet]
via GitHub
[PR] Perf/partial sort [datafusion]
via GitHub
Re: [PR] perf: Optimize prefix-group processing in `PartialSortExec` [datafusion]
via GitHub
Re: [I] macOS aarch64 flake: SIGBUS in _pthread_tsd_cleanup after ParquetReadFromFakeHadoopFsSuite [datafusion-comet]
via GitHub
Re: [I] [Bug] pmod returns a wider decimal type than Spark [datafusion]
via GitHub
Re: [I] Use `Arc<Statistics>` rather than `Statistics` in `PartitionedFile` [datafusion]
via GitHub
[I] Parquet Variant annotation validation is bypassed when reading as an ordinary struct [datafusion-comet]
via GitHub
Re: [I] Projection field metadata is lost during physical plan optimization [datafusion]
via GitHub
[PR] feat: accelerate scalar Python UDFs with CometArrowEvalPythonExec [datafusion-comet]
via GitHub
Re: [D] Error highlighting in query strings [datafusion]
via GitHub
[PR] fix: correct the copy-pasted docs for covar_pop and bool_or [datafusion]
via GitHub
Re: [PR] fix: correct the copy-pasted docs for covar_pop and bool_or [datafusion]
via GitHub
[I] `map_extract` fails to match equal struct keys with differently encoded dictionary nulls [datafusion]
via GitHub
Re: [I] `map_extract` fails to match equal struct keys with differently encoded dictionary nulls [datafusion]
via GitHub
[I] bug: slice crashes on arrays with a non-nullable element field [datafusion-comet]
via GitHub
[PR] fix: reject groups accumulator for distinct bitwise aggregates [datafusion]
via GitHub
Re: [PR] fix: reject groups accumulator for distinct bitwise aggregates [datafusion]
via GitHub
[PR] Fix `Numeric` signature coercion to properly handle null types [datafusion]
via GitHub
Re: [PR] Fix `Numeric` signature coercion to properly handle null types [datafusion]
via GitHub
Re: [PR] Fix `Numeric` signature coercion to properly handle null types [datafusion]
via GitHub
[PR] fix: accept an empty flags string in regexp_replace [datafusion]
via GitHub
Re: [PR] fix: accept an empty flags string in regexp_replace [datafusion]
via GitHub
[PR] fix: enable URL tables on the shared session [datafusion-python]
via GitHub
[PR] fix: preserve nulls in array_has_any/all empty-needle path [datafusion]
via GitHub
Re: [PR] fix: preserve nulls in array_has_any/all empty-needle path [datafusion]
via GitHub
[PR] docs: add a pr-triage skill and document pull request triage [datafusion-comet]
via GitHub
[I] `array_has_any/array_has_all` results depend on other rows when needles are NULL [datafusion]
via GitHub
Re: [I] `array_has_any/array_has_all` results depend on other rows when needles are NULL [datafusion]
via GitHub
Re: [I] perf: verify shuffle IPC context-reuse allocation savings with Arrow 59.1+ [datafusion-comet]
via GitHub
[PR] feat: support filter pushdown through UNNEST operator [datafusion]
via GitHub
Re: [PR] feat: support filter pushdown through UNNEST operator [datafusion]
via GitHub
Re: [PR] feat: support filter pushdown through UNNEST operator [datafusion]
via GitHub
[PR] feat: implement support for INSERT ... ON CONFLICT (DO NOTHING / DO UPDATE) clauses [datafusion]
via GitHub
Re: [PR] feat: implement support for INSERT ... ON CONFLICT (DO NOTHING / DO UPDATE) clauses [datafusion]
via GitHub
Re: [D] Feedback on high memory usage when merging N parquet files [datafusion]
via GitHub
[I] `map_extract` returns `[NULL]` instead of `[]` for missing keys [datafusion]
via GitHub
Re: [I] `map_extract` returns `[NULL]` instead of `[]` for missing keys [datafusion]
via GitHub
Re: [D] Automating predicate pushdown via declared capabilities [datafusion]
via GitHub
Re: [D] DataFusion-Federation: Union Flattening Across Executors [datafusion]
via GitHub
[I] `SingleHashAggregateStream` ignores the distinct soft limit (`lim=[n]`) and reads all input [datafusion]
via GitHub
Re: [I] `SingleHashAggregateStream` ignores the distinct soft limit (`lim=[n]`) and reads all input [datafusion]
via GitHub
[I] array_has_any/all drop input NULLs in the empty-needle fast path [datafusion]
via GitHub
Re: [I] array_has_any/all drop input NULLs in the empty-needle fast path [datafusion]
via GitHub
[PR] perf(optimizer): avoid redundant aggregate planning work [datafusion]
via GitHub
Re: [PR] perf(optimizer): avoid redundant aggregate planning work [datafusion]
via GitHub
Re: [PR] perf(optimizer): avoid redundant aggregate planning work [datafusion]
via GitHub
Re: [PR] perf(optimizer): avoid redundant aggregate planning work [datafusion]
via GitHub
Re: [PR] perf(optimizer): avoid redundant aggregate planning work [datafusion]
via GitHub
[PR] fix(physical-plan): report Final emission for LeftSemi hash and neste… [datafusion]
via GitHub
Re: [PR] fix(physical-plan): report Final emission for LeftSemi hash and neste… [datafusion]
via GitHub
Re: [PR] fix(physical-plan): report Final emission for LeftSemi hash and neste… [datafusion]
via GitHub
[PR] fix: check nested TIMESTAMP_MILLIS overflow in unfiltered scans [datafusion-comet]
via GitHub
Re: [PR] fix: check nested TIMESTAMP_MILLIS overflow in unfiltered scans [datafusion-comet]
via GitHub
[I] Track nested-field statistics pruning and TIMESTAMP_MILLIS overflow parity in filtered scans [datafusion-comet]
via GitHub
Re: [I] Track nested-field statistics pruning and TIMESTAMP_MILLIS overflow parity in filtered scans [datafusion-comet]
via GitHub
[I] Full workspace clippy fails in PostgreSQL decimal formatting [datafusion]
via GitHub
[PR] Fix Postgres decimal formatter clippy [datafusion]
via GitHub
Re: [PR] Fix Postgres decimal formatter clippy [datafusion]
via GitHub
Re: [I] Add `pivot` & `unpivot` (melt) to DataFrame [datafusion]
via GitHub
[PR] fix: delegate the remaining codec methods in ComposedPhysicalExtensio… [datafusion]
via GitHub
Re: [PR] fix: delegate the remaining codec methods in ComposedPhysicalExtensionCodec [datafusion]
via GitHub
Re: [PR] fix: fall back to Spark for negative-scale decimal casts and arithmetic [datafusion-comet]
via GitHub
[PR] Support predicate subqueries in projections [datafusion]
via GitHub
Re: [PR] Support predicate subqueries in projections [datafusion]
via GitHub
[PR] fix: preserve target extension metadata in INSERT [datafusion]
via GitHub
Re: [PR] fix: preserve target extension metadata in INSERT [datafusion]
via GitHub
[I] INSERT can drop target Arrow extension metadata [datafusion]
via GitHub
Re: [I] Consider defining more github views of common filters (like PRs waiting to review) [datafusion]
via GitHub
[PR] Support INSERT OVERWRITE for MemTable [datafusion]
via GitHub
Re: [PR] Support INSERT OVERWRITE for MemTable [datafusion]
via GitHub
[I] `LeftSemi` hash and nested loop joins report `EmissionType::Incremental` but emit only after the probe side is exhausted [datafusion]
via GitHub
Re: [I] `LeftSemi` hash and nested loop joins report `EmissionType::Incremental` but emit only after the probe side is exhausted [datafusion]
via GitHub
Re: [I] `LeftSemi` hash and nested loop joins report `EmissionType::Incremental` but emit only after the probe side is exhausted [datafusion]
via GitHub
[I] Logical schema of an aggregate over GROUPING SETS is more nullable than the physical schema [datafusion]
via GitHub
[I] Substrait consumer ignores AggregateFunction.phase, so an intermediate aggregate runs as a complete one [datafusion]
via GitHub
[PR] Reduce binary size of `ScalarUDFImpl` default impls [datafusion]
via GitHub
Re: [PR] Reduce binary size of `ScalarUDFImpl` default impls [datafusion]
via GitHub
Re: [PR] Reduce binary size of `ScalarUDFImpl` default impls [datafusion]
via GitHub
Re: [I] Improve the performance of range re-partitioning [datafusion]
via GitHub
[PR] refactor: share join input unparsing [datafusion]
via GitHub
Re: [PR] refactor: share join input unparsing [datafusion]
via GitHub
Re: [PR] refactor: share join input unparsing [datafusion]
via GitHub
[PR] test: consolidate ASOF SQL coverage [datafusion]
via GitHub
Re: [PR] test: consolidate ASOF SQL coverage [datafusion]
via GitHub
Re: [PR] test: consolidate ASOF SQL coverage [datafusion]
via GitHub
[PR] fix: defer `InterleaveExec` partitioning check to `InvariantLevel::Executable` [datafusion]
via GitHub
Re: [PR] fix: defer `InterleaveExec` partitioning check to `InvariantLevel::Executable` [datafusion]
via GitHub
Re: [PR] fix: defer `InterleaveExec` partitioning check to `InvariantLevel::Executable` [datafusion]
via GitHub
Re: [PR] fix: defer `InterleaveExec` partitioning check to `InvariantLevel::Executable` [datafusion]
via GitHub
Re: [PR] fix: defer `InterleaveExec` partitioning check to `InvariantLevel::Executable` [datafusion]
via GitHub
[PR] fix: align time parsing and native second extraction with Spark [datafusion-comet]
via GitHub
[PR] perf: evaluate posexplode array expressions once per batch [datafusion-comet]
via GitHub
[PR] perf: avoid repeated decimal promotion in expression serialization [datafusion-comet]
via GitHub
Re: [PR] perf: avoid repeated decimal promotion in expression serialization [datafusion-comet]
via GitHub
Re: [PR] perf: avoid repeated decimal promotion in expression serialization [datafusion-comet]
via GitHub
[PR] refactor: use Arrow cast for date to timestamp NTZ [datafusion-comet]
via GitHub
[PR] perf: specialize native cache statistics collection [datafusion-comet]
via GitHub
[PR] refactor(hash-aggr): Small fixes and finish hash aggregation refactor [datafusion]
via GitHub
Re: [PR] refactor(hash-aggr): Small fixes and finish hash aggregation refactor [datafusion]
via GitHub
Re: [PR] refactor(hash-aggr): Small fixes and finish hash aggregation refactor [datafusion]
via GitHub
Re: [PR] refactor(hash-aggr): Small fixes and finish hash aggregation refactor [datafusion]
via GitHub
Re: [PR] refactor(hash-aggr): Small fixes and finish hash aggregation refactor [datafusion]
via GitHub
Re: [PR] refactor(hash-aggr): Small fixes and finish hash aggregation refactor [datafusion]
via GitHub
[PR] fix: support AQE table-cache stages for Comet in-memory scans [datafusion-comet]
via GitHub
Re: [PR] Adaptive (runtime, stats-based) conjunct reordering for FilterExec [datafusion]
via GitHub
[I] Correlated `EXISTS`/`IN` subqueries with groupless aggregates hit the count bug [datafusion]
via GitHub
[PR] fix: normalize `InterleaveExec` to `UnionExec` before enforcing distribution [datafusion]
via GitHub
Re: [PR] fix: normalize `InterleaveExec` to `UnionExec` before enforcing distribution [datafusion]
via GitHub
Re: [PR] fix: normalize `InterleaveExec` to `UnionExec` before enforcing distribution [datafusion]
via GitHub
Re: [PR] fix: normalize `InterleaveExec` to `UnionExec` before enforcing distribution [datafusion]
via GitHub
Re: [PR] fix: normalize `InterleaveExec` to `UnionExec` before enforcing distribution [datafusion]
via GitHub
[PR] fix: sort pushed below `GlobalLimitExec` ignores `skip`, returning too few rows [datafusion]
via GitHub
Re: [PR] fix: sort pushed below `GlobalLimitExec` ignores `skip`, returning too few rows [datafusion]
via GitHub
Re: [PR] fix: sort pushed below `GlobalLimitExec` ignores `skip`, returning too few rows [datafusion]
via GitHub
Re: [PR] Extract dynamic filter expression composition from `SharedBuildAccumulator::build_filter` [datafusion]
via GitHub
Re: [PR] perf(hash-join): eliminate intermediate array allocations in probe-side collision filter [datafusion]
via GitHub
[PR] refactor: simplify null-aware and join-type branching in hash join [datafusion]
via GitHub
Re: [PR] refactor: simplify null-aware and join-type branching in hash join [datafusion]
via GitHub
Re: [PR] refactor: simplify null-aware and join-type branching in hash join [datafusion]
via GitHub
Re: [PR] refactor: simplify null-aware and join-type branching in hash join [datafusion]
via GitHub
Re: [PR] refactor: simplify null-aware and join-type branching in hash join [datafusion]
via GitHub
[PR] fix: narrow Iceberg complex-null scan fallback to struct columns [datafusion-comet]
via GitHub
Re: [PR] fix: narrow Iceberg complex-null scan fallback to struct columns [datafusion-comet]
via GitHub
Re: [PR] fix: narrow Iceberg complex-null scan fallback to struct columns [datafusion-comet]
via GitHub
[I] Iceberg scan falls back to Spark on IS NULL/IS NOT NULL over list/map columns (stale complex-type check) [datafusion-comet]
via GitHub
[PR] chore: add_benches_hash_agg [datafusion-comet]
via GitHub
[PR] fix: native Iceberg write panics on an evolved partition spec and on a timestamptz partition path [datafusion-comet]
via GitHub
Re: [PR] fix: native Iceberg write panics on an evolved partition spec and on a timestamptz partition path [datafusion-comet]
via GitHub
Re: [PR] fix: native Iceberg write panics on an evolved partition spec and on a timestamptz partition path [datafusion-comet]
via GitHub
Re: [PR] fix: native Iceberg write panics on an evolved partition spec and on a timestamptz partition path [datafusion-comet]
via GitHub
[PR] Add Lance contrib build gate [datafusion-comet]
via GitHub
[PR] perf: validate shuffle IPC context reuse savings [datafusion-comet]
via GitHub
Re: [PR] perf: validate shuffle IPC context reuse savings [datafusion-comet]
via GitHub
[PR] fix: distinguish "nothing spilled" from a spill backend with no local path [datafusion-comet]
via GitHub
Re: [PR] fix: distinguish "nothing spilled" from a spill backend with no local path [datafusion-comet]
via GitHub
Re: [PR] feat: Lambda function support from DataFusion, illustrated with array_filter [datafusion-comet]
via GitHub
[PR] feat: execute concat_ws with array arguments natively [datafusion-comet]
via GitHub
Re: [PR] feat: execute concat_ws with array arguments natively [datafusion-comet]
via GitHub
[PR] feat: support bloom filters in native Iceberg writes [datafusion-comet]
via GitHub
[PR] feat: Enable adaptive partial aggregation for eligible native shuffle plans [datafusion-comet]
via GitHub
Re: [I] Support FIRST/LAST with `PartialMerge` [datafusion-comet]
via GitHub
[PR] perf: cache remote shuffle schemas and benchmark decoding [datafusion-comet]
via GitHub
Re: [PR] perf: cache expected schemas for remote shuffle decoding [datafusion-comet]
via GitHub
Re: [PR] perf: cache expected schemas for remote shuffle decoding [datafusion-comet]
via GitHub
Re: [PR] perf: cache expected schemas for remote shuffle decoding [datafusion-comet]
via GitHub
Re: [PR] perf: cache expected schemas for remote shuffle decoding [datafusion-comet]
via GitHub
[PR] build(deps): bump arrow-select from 59.2.0 to 59.3.0 [datafusion-python]
via GitHub
[PR] build(deps): bump uuid from 1.23.3 to 1.26.0 [datafusion-python]
via GitHub
[PR] build(deps): bump futures from 0.3.32 to 0.3.34 [datafusion-python]
via GitHub
Re: [PR] build(deps): bump arrow from 58.3.0 to 59.0.0 [datafusion-python]
via GitHub
Re: [PR] build(deps): bump arrow from 58.3.0 to 59.0.0 [datafusion-python]
via GitHub
[PR] build(deps): bump arrow-schema from 59.2.0 to 59.3.0 [datafusion-python]
via GitHub
[PR] build(deps): bump arrow from 59.2.0 to 59.3.0 [datafusion-python]
via GitHub
[PR] build(deps): bump arrow-array from 59.2.0 to 59.3.0 [datafusion-python]
via GitHub
Re: [I] chore: DataFusion 55.0.0 [datafusion-comet]
via GitHub
Re: [PR] fix: prevent libhdfs thread destructor use-after-free [datafusion-comet]
via GitHub
Re: [PR] fix: prevent libhdfs thread destructor use-after-free [datafusion-comet]
via GitHub
Re: [I] [EPIC] Improve Comet metrics [datafusion-comet]
via GitHub
Re: [I] [EPIC] Improve Comet metrics [datafusion-comet]
via GitHub
Re: [I] [EPIC] Improve Comet metrics [datafusion-comet]
via GitHub
[PR] fix: disable conflicting IfBraceChecker [datafusion-comet]
via GitHub
Re: [PR] fix: disable conflicting IfBraceChecker [datafusion-comet]
via GitHub
Re: [PR] fix: disable conflicting IfBraceChecker [datafusion-comet]
via GitHub
[PR] feat: route next_day and levenshtein collated input through the codegen dispatcher [datafusion-comet]
via GitHub
Re: [PR] feat: route next_day and levenshtein collated input through the codegen dispatcher [datafusion-comet]
via GitHub
Earlier messages