版本:Latest-4.1
schema_change_mem_bytes
- 单位:字节
- 描述:Schema Change使用的内存。
segment_flush_queue_count
- 单位:计数
- 描述:segment flush线程池中排队的任务数量。
- 单位:字节
- 描述:segment元数据使用的内存。
segment_read
segment_replicate_queue_count
- 单位:计数
- 描述:Segment Replicate线程池中排队的任务数量。
segment_zonemap_mem_bytes
- 单位:字节
- 描述:segment zonemap使用的内存。
short_key_index_mem_bytes
small_file_cache_count
sort_key_sampling_data_page_fallback_total
- 单位: 计数
- 描述: 从数据页采样排序键时放弃某个 Segment、退回到该 Segment 粗粒度
[min, max] 区间的累计次数:Schema 不符合预期、sort_key_idxes 与 Segment 自身的 Schema 不一致、页读取失败、读取行数不足,或采样值超出 Segment 声明的边界。采样采用失败即退化(fail-open)策略,因此该指标上升不会导致分裂失败,但意味着 Tablet 分裂与范围分裂 Compaction 使用的边界比预期更粗。
sort_key_sampling_data_page_latency
- 单位: us
- 描述: 从数据页采样单个 Segment 排序键所花费的时间,以 bvar 延迟序列发布(平均值、分位数、最大值、qps 与计数)。统计所有通过采样预算检查的尝试,包括随后退回粗粒度区间的尝试,因此持续失败即退化的慢 Tablet 在此依然可见。
sort_key_sampling_data_page_segments_total
- 单位: 计数
- 描述: 采样确定走数据页路径的 Segment 累计数量。该计数在采样几何确定之后、首次读取之前累加,因此随后读取失败并退化的 Segment 同样计入——该指标的目的是显示"未走"免费的 Short Key Index 路径。若要了解实际付出的 I/O,请查看
sort_key_sampling_read_bytes_total。
sort_key_sampling_read_bytes_total
- 单位: 字节
- 描述: 采样排序键时从 Segment 数据页读取的累计压缩字节数。取自页读取器自身的统计,因此只统计真实发生的传输,包括随后退化的那些尝试。这是观察分裂点采样 I/O 开销的指标。
sort_key_sampling_rowsets_opened_total
- 单位: 计数
- 描述: 为采样而打开 Segment 文件的 Rowset 累计数量。打开操作以该 Rowset 至少有一个 Segment 具有非零采样预算为前提,因此只有真正尝试采样时该指标才会上升。请与
sort_key_sampling_samples_total 对照阅读:打开了 Rowset 却没有产生样本,说明采样预算没有落到被读取的那些 Segment 上。
sort_key_sampling_samples_total
- 单位: 计数
- 描述: 两条采样路径共同产生的排序键样本累计数量。若该指标上升而
sort_key_sampling_data_page_segments_total 未上升,说明样本来自免费的 Short Key Index 路径。
sort_key_sampling_short_key_index_fallback_total
- 单位: 计数
- 描述: 进入 Short Key Index 采样路径后放弃该 Segment 的累计次数,原因包括:几何信息与 Segment 自身行数交叉校验不通过、索引项解码失败、采样值乱序或超出 Segment 声明的边界。放弃并不意味着该 Segment 就此没有采样:只要它分到了数据页预算,接下来会改走数据页采样,只有预算为 0 或数据页采样同样一无所获时,才退回到粗粒度
[min, max] 区间。该指标不统计两种情形:一是索引块少于两个的 Segment,它直接离开该路径而不计数,改由数据页按行粒度采样;二是 Short Key Index 无法完整编码排序键的 Schema(例如 VARCHAR 排序键),这类表根本不会进入该路径,指标恒为 0,相应 Segment 体现在 sort_key_sampling_data_page_segments_total 中。
sort_key_sampling_short_key_index_latency
- 单位: us
- 描述: 从 Short Key Index 采样单个 Segment 排序键所花费的时间,以 bvar 延迟序列发布(平均值、分位数、最大值、qps 与计数)。该路径不读取任何数据页,因此其取值应远低于
sort_key_sampling_data_page_latency。
spill_disk_bytes_used
- 单位: 字节
- 标签:
storage_type
- 描述: 所有溢出存储目录当前已占用的磁盘字节数。
storage_type=local 汇总 BE 溢出 DirManager 管理的每个目录中正在使用的字节数。storage_type=remote 为对称保留,当前始终为 0,因为远端溢出存储由单独的查询实例各自管理,没有全局的聚合数据。
spm_baseline_count
- 单位:个
- 类型:瞬时值
- 描述:FE Leader 上当前全局 SQL Plan Management(SPM)基线的数量。
spm_capture_candidate_total
- 单位:个
- 类型:累积值
- 标签:
result(captured、skipped_duplicate、skipped_table_count、skipped_table_missing、skipped_db_missing、skipped_pattern_mismatch 或 failed)
- 描述:SPM Auto-Capture 候选处理结果的总次数。不同标签值表示查询历史中的候选 SQL 在自动捕获流程中的不同归类结果。
spm_rewrite_total
- 单位:个
- 类型:累积值
- 标签:
result(hit、miss 或 error)
- 描述:SPM 改写尝试结果的总次数。
hit 表示成功匹配并应用了基线,miss 表示执行了改写流程但没有命中可用基线,error 表示 SPM 改写过程中发生异常并回退到原始查询。
snmp
- 单位: -
- 描述:
/proc/net/snmp 返回的指标。
starrocks_be_clone_task_copy_bytes
- 单位: 字节
- 类型: 累积
- 描述: BE 节点中 Clone 任务复制的总文件大小,包括 INTER_NODE 和 INTRA_NODE 类型。
starrocks_be_clone_task_copy_duration_ms
- 单位: 毫秒
- 类型: 累积
- 描述: BE 节点中 Clone 任务复制消耗的总时间,包括 INTER_NODE 和 INTRA_NODE 类型。
starrocks_be_exec_state_report_active_threads
- 单位: 计数
- 类型: 瞬时
- 描述: 报告 Fragment 实例执行状态的线程池中正在执行的任务数量。
starrocks_be_exec_state_report_queue_count
- 单位: 计数
- 类型: 瞬时
- 描述: 报告 Fragment 实例执行状态的线程池中排队的任务数量,最多 1000 个。
starrocks_be_exec_state_report_running_threads
- 单位: 计数
- 类型: 瞬时
- 描述: 报告 Fragment 实例执行状态的线程池中的线程数量,最少 1 个,最多 2 个。
starrocks_be_exec_state_report_threadpool_size
- 单位: 计数
- 类型: 瞬时
- 描述: 报告 Fragment 实例执行状态的线程池中的最大线程数量,默认为 2。
starrocks_be_files_scan_num_bytes_read
- 单位: 字节
- 描述: 从外部存储读取的总字节数。标签:
file_format, scan_type。
starrocks_be_files_scan_num_files_read
- 单位: 计数
- 描述: 从外部存储读取的文件数量 (CSV, Parquet, ORC, JSON, Avro)。标签:
file_format, scan_type。
starrocks_be_files_scan_num_raw_rows_read
- 单位: 计数
- 描述: 在格式验证和谓词过滤之前从外部存储读取的总原始行数。标签:
file_format, scan_type。
starrocks_be_files_scan_num_rows_return
- 单位: 计数
- 描述: 谓词过滤后返回的行数。标签:
file_format, scan_type。
starrocks_be_files_scan_num_valid_rows_read
- 单位: 计数
- 描述: 读取的有效行数(不包括格式无效的行)。标签:
file_format, scan_type。