Messages by Thread
-
-
[I] Remove `enforce_batch_size_in_joins` in symmetric hash join, and deprecate the config [datafusion]
via GitHub
-
[PR] Doc: note `enforce_batch_size_in_joins` only applies to symmetric hash join [datafusion]
via GitHub
-
[PR] dep: update Cargo.lock file [datafusion]
via GitHub
-
[PR] chore(ci): bump taiki-e/install-action from 2.86.7 to 2.87.0 [datafusion-ballista]
via GitHub
-
[PR] chore(ci): bump the github-codeql group with 2 updates [datafusion-ballista]
via GitHub
-
[PR] chore(deps): bump uuid from 1.25.0 to 1.26.0 [datafusion-ballista]
via GitHub
-
[PR] chore(deps): bump lru from 0.18.2 to 0.18.3 [datafusion-ballista]
via GitHub
-
[PR] feat: support nested types as native shuffle hash partitioning keys [datafusion-comet]
via GitHub
-
[I] Native shuffle rejects nested types as hash partitioning keys although the native hasher supports them [datafusion-comet]
via GitHub
-
[PR] fix: preserve fetch across distribution reoptimization [datafusion]
via GitHub
-
[PR] perf: reuse zstd compression contexts across shuffle blocks [datafusion-comet]
via GitHub
-
[PR] fix: avoid invalid qualifiers in unparsed subqueries [datafusion]
via GitHub
-
[I] EnsureRequirements can silently drop fetch during distribution reoptimization [datafusion]
via GitHub
-
Re: [I] Table references in subqueries cause invalid references in top-level projection [datafusion]
via GitHub
-
Re: [PR] Hive: Support DISTRIBUTE BY and SORT BY in window specs [datafusion-sqlparser-rs]
via GitHub
-
Re: [PR] feat: Support Spark expression: make_dt_interval [datafusion-comet]
via GitHub
-
Re: [PR] feat: PartitionExtrema + SortExec observer + BoundedWindowAggExec passthrough [datafusion]
via GitHub
-
Re: [PR] [PoC/Proposal] AQE-lite: change plan properties at runtime based on stats from pipeline breakers [datafusion]
via GitHub
-
[PR] refactor(scheduler): share the constructor tail between SchedulerServer builders [datafusion-ballista]
via GitHub
-
[PR] Clickhouse: Clickhouse assume table constraint [datafusion-sqlparser-rs]
via GitHub
-
[I] Support Clickhouse ASSUME table constraints (and remove required parenthetical) [datafusion-sqlparser-rs]
via GitHub
-
[I] Native shuffle has no test coverage for struct data columns [datafusion-comet]
via GitHub
-
[PR] test: cover struct data columns in native shuffle [datafusion-comet]
via GitHub
-
[PR] feat(scheduler): document REST API with OpenAPI and serve /api/openapi.json [datafusion-ballista]
via GitHub
-
[PR] chore: remove redundant condition and stray println in shuffle code [datafusion-comet]
via GitHub
-
[PR] Prepare SQL runner for native benchmark migration [datafusion]
via GitHub
-
[I] [Discussion] Define python UDF using `CREATE FUNCTION` SQL statement [datafusion-python]
via GitHub
-
Re: [I] Investigate adopting DataFusion's allocator-level memory accounting to replace manual memory tuning [datafusion-comet]
via GitHub
-
Re: [PR] fix(scheduler): fix test job-completion polling [datafusion-ballista]
via GitHub
-
[PR] build(deps): bump github/codeql-action/init from 4.36.2 to 4.37.9 [datafusion-python]
via GitHub
-
Re: [PR] build(deps): bump github/codeql-action/init from 4.36.2 to 4.37.7 [datafusion-python]
via GitHub
-
Re: [PR] build(deps): bump github/codeql-action/analyze from 4.36.2 to 4.37.7 [datafusion-python]
via GitHub
-
[PR] build(deps): bump github/codeql-action/analyze from 4.36.2 to 4.37.9 [datafusion-python]
via GitHub
-
[PR] feat: add combined join tests hash vs PWMJ, hash vs SMJ [datafusion]
via GitHub
-
Re: [PR] feat: extend SLT tests for hash join vs PWMJ, hash join vs SMJ [datafusion]
via GitHub
-
Re: [PR] feat: extend SLT tests for hash join vs PWMJ, hash join vs SMJ [datafusion]
via GitHub
-
Re: [PR] feat: extend SLT tests for hash join vs PWMJ, hash join vs SMJ [datafusion]
via GitHub
-
Re: [PR] feat: extend SLT tests for hash join vs PWMJ, hash join vs SMJ [datafusion]
via GitHub
-
Re: [PR] feat: extend SLT tests for hash join vs PWMJ, hash join vs SMJ [datafusion]
via GitHub
-
Re: [PR] feat: extend SLT tests for hash join vs PWMJ, hash join vs SMJ [datafusion]
via GitHub
-
Re: [PR] feat: extend SLT tests for hash join vs PWMJ, hash join vs SMJ [datafusion]
via GitHub
-
Re: [PR] feat: extend SLT tests for hash join vs PWMJ, hash join vs SMJ [datafusion]
via GitHub
-
Re: [PR] feat: extend SLT tests for hash join vs PWMJ, hash join vs SMJ [datafusion]
via GitHub
-
Re: [PR] feat: extend SLT tests for hash join vs PWMJ, hash join vs SMJ [datafusion]
via GitHub
-
Re: [I] Avoid recompute CTEs (common table expressions) / share input plans [datafusion]
via GitHub
-
[PR] fix: bound native explode output batch size [datafusion-comet]
via GitHub
-
[PR] fix: align Spark 4.2 Python worker configuration [datafusion-comet]
via GitHub
-
Re: [I] Pruning predicates repeat the `null_count != row_count` guard once per comparison [datafusion]
via GitHub
-
[PR] fix: decode dictionary input for PyArrow UDFs [datafusion-comet]
via GitHub
-
[PR] fix: prevent incorrect Parquet pruning with NaNs [datafusion]
via GitHub
-
[PR] chore(deps): bump DataFusion to 55.0.0 [datafusion-java]
via GitHub
-
Re: [PR] [datafusion-spark] Support 2-argument ceil(value, scale) [datafusion]
via GitHub
-
[PR] Sql benchmark sync config parity 2 [datafusion]
via GitHub
-
Re: [PR] feat: RR partition with xxhash-rust [datafusion-comet]
via GitHub
-
Re: [PR] feat: Support null aware hash mark-joins [datafusion]
via GitHub
-
Re: [PR] build: enable Spark SQL tests for released Spark 4.2.0 [datafusion-comet]
via GitHub
-
[PR] perf: push left filters through ASOF joins [datafusion]
via GitHub
-
[PR] fix: find_in_set internal error with two LargeUtf8 scalar arguments [datafusion]
via GitHub
-
[PR] perf: Avoid cloning EquivalenceProperties in ordering satisfaction checks [datafusion]
via GitHub
-
[PR] perf: preserve left functional dependencies for ASOF joins [datafusion]
via GitHub
-
[PR] fix: return null from array_join when nullReplacement is null [datafusion-comet]
via GitHub
-
Re: [PR] fix: preserve null semantics in expression simplification [datafusion]
via GitHub
-
Re: [I] panic: 'StructArray::new' on zero-field (empty) structs in ScalarValue::compact and ScalarValue::new_default [datafusion]
via GitHub
-
[PR] docs: Clarify the testing section in GitHub PR Template [datafusion]
via GitHub
-
[I] Add a section on writing effective tests to the contributor guide [datafusion]
via GitHub
-
[PR] perf: factor common guards out of pruning predicates [datafusion]
via GitHub
-
[PR] bench: Add drain-phase benchmark for grouped aggregation [datafusion]
via GitHub
-
[PR] perf: Emit LeftSemi hash join rows while probing [datafusion]
via GitHub
-
[PR] perf: Eliminate a join a foreign key makes redundant [datafusion]
via GitHub
-
[PR] docs: add full-site version snapshots [datafusion]
via GitHub
-
[I] refactor: split regular and existence join in hash join [datafusion]
via GitHub
-
[PR] Apply recursion limit without std [datafusion-sqlparser-rs]
via GitHub
-
[PR] Preserve field metadata when coercing INT96 timestamps [datafusion]
via GitHub
-
[PR] perf: Remove an aggregate whose GROUP BY covers a unique key [datafusion]
via GitHub
-
[I] `character_length` should natively support binary types without UTF-8 coercion [datafusion]
via GitHub
-
[PR] fix: Unnest must not keep its input's uniqueness [datafusion]
via GitHub
-
[I] `Int96Coercer` drops the metadata of struct, list and map fields. [datafusion]
via GitHub
-
[PR] refactor(hash-aggr): Let partial-reduce mode aggregation early emit when OOM [datafusion]
via GitHub