Slackbot
10/27/2023, 3:05 PMGian Merlino
10/27/2023, 3:28 PMGian Merlino
10/27/2023, 3:29 PMGian Merlino
10/27/2023, 3:29 PMsriramdas sivasai
10/27/2023, 3:31 PMGian Merlino
10/27/2023, 3:44 PMGian Merlino
10/27/2023, 3:44 PMsriramdas sivasai
10/27/2023, 4:02 PMcouldnt not allocate segment for row with timestamp[2023-10-16T18:37:27.000z]sriramdas sivasai
10/27/2023, 4:03 PMsriramdas sivasai
10/27/2023, 4:03 PM20 | druid | 192.168.39.62:48746 | druid | Query | 16 | Sending data | SELECT payload FROM druid_segments WHERE used = 1 AND dataSource = 'data_table' AND ((start < '2023-08-20T00:34:00.001Z' AND `end` > '2023-08-20T00:34:00.000Z') OR (start = '-146136543-09-08T08:23:32.096Z' AND "end" != '146140482-04-24T15:36:27.903Z' AND "end" > '2023-08-20T00:34:00.000Z') OR (start != '-146136543-09-08T08:23:32.096Z' AND "end" = '146140482-04-24T15:36:27.903Z' AND start < '2023-08-20T00:34:00.001Z') OR (start = '-146136543-09-08T08:23:32.096Z' AND "end" = '146140482-04-24T15:36:27.903Z')) |Gian Merlino
10/27/2023, 5:14 PMsegmentGranularity?Gian Merlino
10/27/2023, 5:15 PMminute) it's possible using a coarser one will lead to fewer allocations with late data. usually people go with hoursriramdas sivasai
10/27/2023, 5:16 PMBen Krug
10/27/2023, 11:16 PMsriramdas sivasai
10/27/2023, 11:17 PMBen Krug
10/27/2023, 11:27 PMsriramdas sivasai
10/27/2023, 11:55 PMsriramdas sivasai
10/28/2023, 2:43 AMlate_kafka_topic and late_datasource running the index_parallel task from the late_datasource to original_datasource periodically would work ?
please feel free to suggest any better approach ?John Kowtko
10/29/2023, 7:05 PMBen Krug
10/31/2023, 1:34 AMappendToExisting: true could work.