commits
Thread
Date
Earlier messages
Later messages
Messages by Thread
Re: [PR] feat(spark): support clustering for LSM tables [hudi]
via GitHub
Re: [PR] feat(spark): support clustering for LSM tables [hudi]
via GitHub
Re: [PR] feat(spark): support clustering for LSM tables [hudi]
via GitHub
Re: [PR] feat(spark): support clustering for LSM tables [hudi]
via GitHub
Re: [PR] feat(spark): support clustering for LSM tables [hudi]
via GitHub
Re: [PR] feat(spark): support clustering for LSM tables [hudi]
via GitHub
Re: [PR] feat(spark): support clustering for LSM tables [hudi]
via GitHub
Re: [PR] feat(spark): support clustering for LSM tables [hudi]
via GitHub
Re: [PR] feat(spark): support clustering for LSM tables [hudi]
via GitHub
[I] [BUG] ALTER TABLE RENAME/DROP COLUMN fails with MissingSchemaFieldException under default configs since #13595 [hudi]
via GitHub
Re: [I] Add the GooseFS integration document [hudi]
via GitHub
Re: [I] Update docs on implementing getMandatoryFieldsForMerging for custom record merge implementation [hudi]
via GitHub
Re: [I] Docs for Debezium source [hudi]
via GitHub
Re: [I] Docs for Debezium source [hudi]
via GitHub
Re: [I] Support incremental queries in presto-hudi connector [hudi]
via GitHub
Re: [I] Support incremental queries in presto-hudi connector [hudi]
via GitHub
Re: [I] Add trino/presto bundle validation [hudi]
via GitHub
Re: [I] Add trino/presto bundle validation [hudi]
via GitHub
Re: [I] Support data encryption in MOR tables [hudi]
via GitHub
Re: [I] Support data encryption in MOR tables [hudi]
via GitHub
Re: [I] Evaluate performance of bootstrap using large dataset [hudi]
via GitHub
Re: [I] Evaluate performance of bootstrap using large dataset [hudi]
via GitHub
Re: [I] Test MOR: Hive QL with bootstrap [hudi]
via GitHub
Re: [I] Test MOR: Hive QL with bootstrap [hudi]
via GitHub
Re: [I] Develop a validation tool for bootstrap table [hudi]
via GitHub
Re: [I] Develop a validation tool for bootstrap table [hudi]
via GitHub
Re: [I] Test MOR: Deltastreamer metadata-only and full-record bootstrap operation [hudi]
via GitHub
Re: [I] Test MOR: Deltastreamer metadata-only and full-record bootstrap operation [hudi]
via GitHub
Re: [I] Test COW: Spark datasource writing with non-Hudi partitions [hudi]
via GitHub
Re: [I] Test COW: Spark datasource writing with non-Hudi partitions [hudi]
via GitHub
Re: [I] Validate against supported hive versions [hudi]
via GitHub
Re: [I] Validate against supported hive versions [hudi]
via GitHub
Re: [I] Handle deletes in S3 deltastreamer source [hudi]
via GitHub
Re: [I] Handle deletes in S3 deltastreamer source [hudi]
via GitHub
Re: [I] Rewrite the java write client with the right abstractions [hudi]
via GitHub
Re: [I] Rewrite the java write client with the right abstractions [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [PR] feat(storage): default parquet codec to zstd for flink and spark 3.5+ [hudi]
via GitHub
Re: [I] Vet all critical code paths for double-checked locking [hudi]
via GitHub
Re: [I] Vet all critical code paths for double-checked locking [hudi]
via GitHub
Re: [I] Adding perf benchmark using jmh to Hudi [hudi]
via GitHub
Re: [I] Adding perf benchmark using jmh to Hudi [hudi]
via GitHub
Re: [I] Explore a new way to fix import order [hudi]
via GitHub
Re: [I] Explore a new way to fix import order [hudi]
via GitHub
Re: [I] Follow on code improvements to HFile tables [hudi]
via GitHub
Re: [I] Follow on code improvements to HFile tables [hudi]
via GitHub
Re: [PR] fix(spark-sql): reject creating a table that pairs a non partitioned key generator with partition columns [hudi]
via GitHub
Re: [PR] fix(spark-sql): reject creating a table that pairs a non partitioned key generator with partition columns [hudi]
via GitHub
Re: [PR] fix(spark-sql): reject creating a table that pairs a non partitioned key generator with partition columns [hudi]
via GitHub
Re: [PR] fix(spark-sql): reject creating a table that pairs a non partitioned key generator with partition columns [hudi]
via GitHub
Re: [PR] fix(spark-sql): reject creating a table that pairs a non partitioned key generator with partition columns [hudi]
via GitHub
Re: [I] Prepped Delete Unit Test For Flink [hudi]
via GitHub
Re: [I] Spark Sql Merge Into does not ignore case [hudi]
via GitHub
Re: [I] Fix deletion of entire record in MDT for col stats, bloom filter [hudi]
via GitHub
Re: [I] Incremental file sync bug fixes [hudi]
via GitHub
Re: [I] Explore different HFile block size for each MDT partition [hudi]
via GitHub
Re: [I] KEEP_LATEST_BY_HOURS should consider modified time instead of commit time while setting earliestCommitToRetain value [hudi]
via GitHub
Re: [I] Ability to Disable Partition Deletes during Clean [hudi]
via GitHub
(hudi) branch bot/trino-pin updated (7ee273bdf134 -> b932ede57fef)
github-bot
(hudi) 01/01: chore(trino): advance trino master pin to 92757c4365a1
github-bot
Re: [I] RFC for Hudi Reverse Streamer [hudi]
via GitHub
Re: [I] RFC for Hudi Reverse Streamer [hudi]
via GitHub
Re: [I] Refactor deltastreamer commnad line config params to use HoodieConfig/ConfigProperty [hudi]
via GitHub
Re: [I] Refactor deltastreamer commnad line config params to use HoodieConfig/ConfigProperty [hudi]
via GitHub
Re: [I] Remove autoCommit in BaseCommitActionExecutor [hudi]
via GitHub
Re: [I] Remove autoCommit in BaseCommitActionExecutor [hudi]
via GitHub
Re: [I] Datadog metric reporter should not hard fail when api key is invalid [hudi]
via GitHub
Re: [I] Datadog metric reporter should not hard fail when api key is invalid [hudi]
via GitHub
Re: [I] Unify instant interface in HoodieActiveTimeline [hudi]
via GitHub
Re: [I] Unify instant interface in HoodieActiveTimeline [hudi]
via GitHub
Re: [I] Refactor TestHoodieLogFormat.java class [hudi]
via GitHub
Re: [I] Refactor TestHoodieLogFormat.java class [hudi]
via GitHub
[PR] perf(core): copy an HFile record rather than its whole block per record [hudi-rs]
via GitHub
Re: [PR] perf(core): copy an HFile record rather than its whole block per record [hudi-rs]
via GitHub
Re: [PR] perf(core): copy an HFile record rather than its whole block per record [hudi-rs]
via GitHub
Re: [PR] perf(core): copy an HFile record rather than its whole block per record [hudi-rs]
via GitHub
[PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [PR] feat(flink): add new RocksDBPartitionedIndexBackend [hudi]
via GitHub
Re: [I] MIT doesn't handle some spark types correctly [hudi]
via GitHub
Re: [I] Avoid reading log files for resolving schema for _hoodie_operation field [hudi]
via GitHub
Re: [I] Unify file format-specific record writing [hudi]
via GitHub
Re: [I] Validate file slices upto a commit in HoodieTableMetadataValidator [hudi]
via GitHub
Re: [I] Support Dataframe.observe for Hudi tables [hudi]
via GitHub
Re: [I] Address the overhead of using IncrementalQueryAnalyzer in HoodieIncrSource [hudi]
via GitHub
Re: [I] [Umbrella] RFC-81 : Hoodie stand alone catalog [hudi]
via GitHub
Re: [I] Fix Presto integration tests in docker demo [hudi]
via GitHub
Re: [I] Fix constructors for all bulk insert sort partitioners to ensure we could use it as user defined partitioners [hudi]
via GitHub
Re: [I] Add fault injection testing to CI [hudi]
via GitHub
Re: [I] Implement persisting logic for CF settings [hudi]
via GitHub
Re: [I] Replace unnecessary FileSystem, Path, and FileStatus usage in other modules [hudi]
via GitHub
Re: [I] Add constructor to new filegroup reader to deduce the fileslice [hudi]
via GitHub
Re: [I] Add SelfDescribingInputFormatInterface for hive FileInputFormat [hudi]
via GitHub
Re: [I] Supporting a query task can read multiple file-slice to reduce spark task num [hudi]
via GitHub
Re: [I] aws query engine don't support all hudi promotion type [hudi]
via GitHub
Re: [I] Fix Trino failure when reading corrupted block at end of log file [hudi]
via GitHub
Re: [I] Optimize shouldIgnoreConfig check in HoodieWriterUtils [hudi]
via GitHub
Re: [I] Bug fixes and improvements on metadata table - Phase 1 [hudi]
via GitHub
Re: [I] Revsit Merging small archival files logic for TimelineArchiveWriterV1 which is not ported [hudi]
via GitHub
Re: [I] Revisit setRecordMerger API in HoodieReaderContext [hudi]
via GitHub
Re: [I] Group record merging configs into a single java object [hudi]
via GitHub
Re: [I] Remove redundant table and timeline validity check in HoodieStreamer [hudi]
via GitHub
Re: [I] Support Hudi Async Rollback in Flink Engine [hudi]
via GitHub
Re: [I] Base schema used by executors of the same writer should be the same [hudi]
via GitHub
Re: [I] Group merger related config fields and use the group in merger [hudi]
via GitHub
Re: [I] Unmerged reading is broken for hive implementation [hudi]
via GitHub
Re: [I] Fix Hardcodings of Timeline versions in Schema on read code-paths [hudi]
via GitHub
Re: [I] Operation metadata field is not implemented for spark records [hudi]
via GitHub
Re: [I] Set isTightBound to false in partition stats for delete operation [hudi]
via GitHub
Re: [I] Audit all places where HoodieAvroUtils.getNestedFieldValAsString() can return null for a nonexistant field [hudi]
via GitHub
Re: [I] Implement type conversion for columnar batch projection [hudi]
via GitHub
Re: [I] Evaluate Avro schema util classes [hudi]
via GitHub
Re: [I] Evaluate Avro schema util classes [hudi]
via GitHub
Re: [I] Evaluate Avro schema util classes [hudi]
via GitHub
Re: [I] Support partial update in Spark Structured Streaming [hudi]
via GitHub
[PR] docs(cleaning): document partition TTL [hudi]
via GitHub
Re: [PR] docs(cleaning): document partition TTL [hudi]
via GitHub
Re: [PR] docs(cleaning): document partition TTL [hudi]
via GitHub
Re: [PR] docs(cleaning): document partition TTL [hudi]
via GitHub
Re: [PR] docs(cleaning): document partition TTL [hudi]
via GitHub
Re: [PR] docs(cleaning): document partition TTL [hudi]
via GitHub
Re: [PR] docs(cleaning): document partition TTL [hudi]
via GitHub
Re: [PR] docs(cleaning): document partition TTL [hudi]
via GitHub
Re: [I] Investigate record projection for spark records [hudi]
via GitHub
Re: [I] Check if we need to support functional index on bootstrap tables [hudi]
via GitHub
Re: [I] Add a table validation tool [hudi]
via GitHub
Re: [I] Bug fixes and improvements on Secondary and Expression Index - Phase 1 [hudi]
via GitHub
Re: [I] Regression in Spark SQL when using hoodie.datasource.hive_sync.skip_ro_suffix [hudi]
via GitHub
Re: [I] Spark Record / Spark Merger gaps with Avro during writing [hudi]
via GitHub
Re: [I] Expand NBCC to support other index types on Spark [hudi]
via GitHub
Re: [I] LakeView SyncTool [hudi]
via GitHub
Re: [I] Engine type is spark by default in the writeconfig [hudi]
via GitHub
Re: [I] Handle multiple column secondary indexes [hudi]
via GitHub
Re: [I] Fix command execution with pipe in IT [hudi]
via GitHub
Re: [I] Support timely compaction triggers even if there is not data to consume in deltastreamer continuous mode [hudi]
via GitHub
Re: [I] CustomKeyGenerator can not be created with flink [hudi]
via GitHub
Re: [I] Introduce a `.abort` state for abandoned commits and table services [hudi]
via GitHub
Re: [I] Support upgrade and downgrade of MDT directly during MDT writes [hudi]
via GitHub
Re: [I] Make primaryKey and other column configs case insensitive [hudi]
via GitHub
Re: [I] Calculate "mandatory partition fields to read from the file" inside of the filegroup reader so we can have cross engine support [hudi]
via GitHub
Re: [I] Add reader state class to remove state from the reader context [hudi]
via GitHub
Re: [I] Investigate DPP (Dynamic partition pruning) with timestamp keygen with new fg reader [hudi]
via GitHub
Re: [I] All base file reading incl HFile or Parquet Keyed lookup all of this happens via FileGroupReader [hudi]
via GitHub
Re: [I] Remove populateMetaFields handling in RowCustomColumnsSortPartitioner [hudi]
via GitHub
Re: [I] Implements LRU eviction strategy for in-memory map of ExternalSpillableMap [hudi]
via GitHub
Re: [I] Review Java Functional Indexing APIs (extend, add functions) [hudi]
via GitHub
Re: [I] Add an iterator api for HoodieUnMergedLogRecordScanner [hudi]
via GitHub
Re: [I] Add CF settings to create_table with Flink [hudi]
via GitHub
Re: [I] Filtering of clustering replacecommits should be resilient to ongoing replacecommit rollbacks [hudi]
via GitHub
Re: [I] Allow high priority writer to force-acquire lock within a bounded amount of time [hudi]
via GitHub
Re: [I] Multi-writer unique key enforcement for OCC/NBCC [hudi]
via GitHub
Re: [I] Get rid of logic not needed by spark3.3+ [hudi]
via GitHub
Re: [I] Get rid of legacy parquet file format [hudi]
via GitHub
Re: [I] Create inplace columnar batch projection [hudi]
via GitHub
Re: [I] Full compaction scheduling [hudi]
via GitHub
Re: [I] Avoid creating zero row group parquet file [hudi]
via GitHub
Re: [I] Introduce in-memory-cache for ExternalSpillableMap to improve performance [hudi]
via GitHub
Re: [I] Deprecate hoodie.datasource.read.extract.partition.values.from.path [hudi]
via GitHub
Re: [I] Full compaction execution [hudi]
via GitHub
Earlier messages
Later messages