iceberg_compaction_commit_batch_size
Número de arquivos de dados mesclados que a compactação Iceberg em segundo plano acumula antes de publicá-los em um novo snapshot. Os resultados da compactação são publicados assim que não há mais candidatos para compactar. Portanto, essa configuração apenas limita por quanto tempo arquivos já mesclados permanecem sem ser publicados enquanto a compactação continua encontrando trabalho.0 restaura o comportamento antigo
de publicar somente quando a compactação não tem mais candidatos — um estado que nunca é alcançado enquanto a tabela continua
recebendo novos arquivos de dados. Assim, toda saída mesclada é gravada no armazenamento de objetos e nunca é referenciada por um snapshot.
iceberg_compaction_data_cleanup
Tempo após o qual os dados serão excluídos.iceberg_compaction_delay_bias
Intervalo mínimo entre 2 operações de compactação em segundo plano.iceberg_compaction_max_bytes_in_data_file
Máximo de bytes de um arquivo de dados parquet iceberg produzido por compactação. O padrão espelha o padrão documentado da Iceberg table propertywrite.target-file-size-bytes (512 MiB),
consulte https://iceberg.apache.org/docs/1.5.2/configuration/. Mantenha-o acima de
iceberg_data_file_size_lower_threshold_compaction; caso contrário, todo arquivo de saída ficará abaixo do threshold inferior
e será novamente selecionado para compactação.
iceberg_compaction_max_rows_in_data_file
Número máximo de linhas de um arquivo de dados Parquet do Iceberg produzido por compactação. Por padrão, é definido como o valor máximo, de modo que apenas o limite de tamanhoiceberg_compaction_max_bytes_in_data_file decide quantos dados vão para um arquivo de saída, da mesma forma que
o Iceberg não possui um equivalente de contagem de linhas para write.target-file-size-bytes.