Messages by Thread
-
[I] Extract common regex compilation cache for reuse across regexp functions [datafusion]
via GitHub
-
[PR] chore: bump spark-4.2 profile to the released 4.2.0 [datafusion-comet]
via GitHub
-
Re: [I] Implement TimeType support: Infrastructure - shuffle [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `find_in_set` (up to 24x faster) [datafusion]
via GitHub
-
Re: [PR] feat: Implement TimeType support - Infrastructure - shuffle [datafusion-comet]
via GitHub
-
[PR] feat: make AQE respect broadcast_join_threshold_bytes [datafusion-ballista]
via GitHub
-
[I] `ballista.optimizer.broadcast_join_threshold_bytes` has no effect when adaptive query planning is enabled [datafusion-ballista]
via GitHub
-
Re: [I] Native implementation of `get_json_object` returns last value for duplicate keys, Spark returns first [datafusion-comet]
via GitHub
-
Re: [PR] Add ExecutionPlan try_to_proto / try_from_proto hooks + ProjectionExec reference [datafusion]
via GitHub
-
Re: [PR] feat: support multiply_ym_interval with YearMonth interval codegen dispatch [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `get_field` [datafusion]
via GitHub
-
Re: [PR] perf: avoid per-row copy in Spark hex byte encoding [datafusion]
via GitHub
-
[I] Further optimize Spark hex byte encoding: reuse input NullBuffer and special-case the no-nulls path [datafusion]
via GitHub
-
Re: [PR] feat: hint at native pyarrow UDF path when the feature is disabled [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `regexp_match` for literal pattern usage (20% faster) [datafusion]
via GitHub
-
[PR] perf: bulk-append contiguous buffered runs in sort merge join [datafusion]
via GitHub
-
Re: [PR] feat: add CalendarIntervalType support [datafusion-comet]
via GitHub
-
Re: [PR] refactor: move AttributeReference and KnownFloatingPointNormalized expression support checks to getSupportLevel [datafusion-comet]
via GitHub
-
Re: [PR] feat: re-enable COUNT for mixed Spark partial / Comet final aggregates [datafusion-comet]
via GitHub
-
Re: [PR] feat: prototype allocator-level OOM protection (OomGuard breaker + cooperative real-usage accounting) [datafusion-comet]
via GitHub
-
Re: [PR] feat: add comet_version() SQL function [datafusion-comet]
via GitHub
-
Re: [PR] feat: custom Rust UDFs via arrow-ffi (alternative to #4283) [experimental] [datafusion-comet]
via GitHub
-
Re: [PR] feat: support Spark 4.1 TIME type and expressions via codegen dispatch [datafusion-comet]
via GitHub
-
Re: [PR] feat: native collect_list / array_agg aggregate [datafusion-comet]
via GitHub
-
[PR] feat: removed all instances of deprecated virtualtable values field [datafusion]
via GitHub
-
Re: [PR] perf: optimize spark_base64 in spark-expr [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `cast_binary_to_string` binary-format styles (up to 27x faster) [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `struct_to_json` (10% faster) [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `parse_string_to_decimal` (30-40% faster) [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `date_trunc` (>2x faster) [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `spark_cast_float64_to_utf8` (~40% faster) [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize cast_decimal128_to_utf8 in datafusion-comet-spark-expr [datafusion-comet]
via GitHub
-
Re: [PR] refactor: pass SubqueryContext explicitly through planner traits [datafusion]
via GitHub
-
Re: [I] [Feature] support size() for MapType inputs [datafusion-comet]
via GitHub
-
Re: [PR] feat: support size() for MapType input [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `spark_ceil` (3x faster) [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `spark_floor` (up to 4x faster) [datafusion-comet]
via GitHub
-
Re: [I] Unable to use Ballista at scale (e.g. TPC-H @ 1TB) [datafusion-ballista]
via GitHub
-
Re: [I] AQE regresses join-heavy TPC-H queries at SF1000 instead of promoting broadcasts [datafusion-ballista]
via GitHub
-
Re: [I] Some benchmark queries fail or produce incorrect results [datafusion-ballista]
via GitHub
-
Re: [I] Document how to run TPC-H benchmarks in Kubernetes [datafusion-ballista]
via GitHub
-
Re: [I] Improve benchmark performance [datafusion-ballista]
via GitHub
-
Re: [I] Performance snapshot: Ballista vs Comet @ SF100 on local disk — data source flips the result (hash joins) [datafusion-ballista]
via GitHub
-
Re: [PR] perf: optimize `spark_array_compact` (no-op fast path for null-free arrays) [datafusion-comet]
via GitHub
-
Re: [I] Ballista 54.1.0 Release [datafusion-ballista]
via GitHub
-
Re: [PR] perf: vectorize integer-to-decimal cast [datafusion-comet]
via GitHub
-
Re: [PR] perf: vectorize float/decimal to narrow-integer casts [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `date_parser` / cast string to date (up to 2x faster) [datafusion-comet]
via GitHub
-
Re: [PR] perf: optimize `spark_cast_utf8_to_boolean` (>2x faster) [datafusion-comet]
via GitHub
-
[I] cast string to boolean: trim ISO control bytes to match Spark's UTF8String.trimAll [datafusion-comet]
via GitHub
-
Re: [PR] WIP: Extension type casts using extension registry [datafusion]
via GitHub
-
Re: [I] Support gzip compression in native Parquet writes [datafusion-comet]
via GitHub
-
Re: [PR] feat: eliminate LEFT JOINs whose right side is unused [datafusion]
via GitHub
-
[I] Thread `PhysicalOptimizerContext` through `join_selection` stats helpers (CBO extension pattern) [datafusion]
via GitHub
-
Re: [PR] fix: avoid full listings for cached pruned partitions [datafusion]
via GitHub
-
[PR] fix(datasource): avoid over-conservative transformation of num_rows statistics in file scan config [datafusion]
via GitHub
-
[PR] fix: handle NULL string and format arguments in to_date, to_timestamp, and to_unixtime [datafusion]
via GitHub
-
Re: [PR] fix: handle NULL string and format arguments in to_date, to_timestamp, and to_unixtime [datafusion]
via GitHub
-
Re: [PR] fix: handle NULL string and format arguments in to_date, to_timestamp, and to_unixtime [datafusion]
via GitHub
-
Re: [PR] fix: handle NULL string and format arguments in to_date, to_timestamp, and to_unixtime [datafusion]
via GitHub
-
Re: [PR] fix: handle NULL string and format arguments in to_date, to_timestamp, and to_unixtime [datafusion]
via GitHub
-
Re: [PR] fix: handle NULL string and format arguments in to_date, to_timestamp, and to_unixtime [datafusion]
via GitHub
-
Re: [I] PostgreSQL compatibility: `time + interval` should wrap within the 24-hour time domain [datafusion]
via GitHub
-
Re: [I] PostgreSQL compatibility: `time - interval` should wrap within the 24-hour time domain [datafusion]
via GitHub
-
[I] Centralize aggregate-scope expression rendering in the SQL unparser [datafusion]
via GitHub
-
[I] Centralize higher-order list lambda evaluation helpers [datafusion]
via GitHub
-
[I] Refactor: Add an optimizer-local helper for schema-aware child rewrites [datafusion]
via GitHub
-
[I] Document decimal AVG wrapping arithmetic behind explicit helpers [datafusion]
via GitHub
-
Re: [I] `to_date`, `to_timestamp`, and `to_unixtime` fail on NULL string and format arguments [datafusion]
via GitHub
-
Re: [I] Bug in lambda variable resolution [datafusion]
via GitHub
-
Re: [PR] Feat: add dictionaries as a supported group column type [datafusion]
via GitHub