跳到主要内容
版本:Latest-4.1

指标 s

schema_change_mem_bytes​

  • 单位:字节
  • 描述:Schema Change使用的内存。

segment_flush_queue_count​

  • 单位:计数
  • 描述:segment flush线程池中排队的任务数量。

segment_metadata_mem_bytes​

  • 单位:字节
  • 描述:segment元数据使用的内存。

segment_read​

  • 单位:计数
  • 描述:segment读取总数。

segment_replicate_queue_count​

  • 单位:计数
  • 描述:Segment Replicate线程池中排队的任务数量。

segment_zonemap_mem_bytes​

  • 单位:字节
  • 描述:segment zonemap使用的内存。

short_key_index_mem_bytes​

  • 单位:字节
  • 描述:短键索引使用的内存。

small_file_cache_count​

  • 单位: 计数
  • 描述: 小文件缓存的数量。

sort_key_sampling_data_page_fallback_total​

  • 单位: 计数
  • 描述: 从数据页采样排序键时放弃某个 Segment、退回到该 Segment 粗粒度 [min, max] 区间的累计次数:Schema 不符合预期、sort_key_idxes 与 Segment 自身的 Schema 不一致、页读取失败、读取行数不足,或采样值超出 Segment 声明的边界。采样采用失败即退化(fail-open)策略,因此该指标上升不会导致分裂失败,但意味着 Tablet 分裂与范围分裂 Compaction 使用的边界比预期更粗。

sort_key_sampling_data_page_latency​

  • 单位: us
  • 描述: 从数据页采样单个 Segment 排序键所花费的时间,以 bvar 延迟序列发布(平均值、分位数、最大值、qps 与计数)。统计所有通过采样预算检查的尝试,包括随后退回粗粒度区间的尝试,因此持续失败即退化的慢 Tablet 在此依然可见。

sort_key_sampling_data_page_segments_total​

  • 单位: 计数
  • 描述: 采样确定走数据页路径的 Segment 累计数量。该计数在采样几何确定之后、首次读取之前累加,因此随后读取失败并退化的 Segment 同样计入——该指标的目的是显示"未走"免费的 Short Key Index 路径。若要了解实际付出的 I/O,请查看 sort_key_sampling_read_bytes_total。

sort_key_sampling_read_bytes_total​

  • 单位: 字节
  • 描述: 采样排序键时从 Segment 数据页读取的累计压缩字节数。取自页读取器自身的统计,因此只统计真实发生的传输,包括随后退化的那些尝试。这是观察分裂点采样 I/O 开销的指标。

sort_key_sampling_rowsets_opened_total​

  • 单位: 计数
  • 描述: 为采样而打开 Segment 文件的 Rowset 累计数量。打开操作以该 Rowset 至少有一个 Segment 具有非零采样预算为前提,因此只有真正尝试采样时该指标才会上升。请与 sort_key_sampling_samples_total 对照阅读:打开了 Rowset 却没有产生样本,说明采样预算没有落到被读取的那些 Segment 上。

sort_key_sampling_samples_total​

  • 单位: 计数
  • 描述: 两条采样路径共同产生的排序键样本累计数量。若该指标上升而 sort_key_sampling_data_page_segments_total 未上升,说明样本来自免费的 Short Key Index 路径。

sort_key_sampling_short_key_index_fallback_total​

  • 单位: 计数
  • 描述: 进入 Short Key Index 采样路径后放弃该 Segment 的累计次数,原因包括:几何信息与 Segment 自身行数交叉校验不通过、索引项解码失败、采样值乱序或超出 Segment 声明的边界。放弃并不意味着该 Segment 就此没有采样:只要它分到了数据页预算,接下来会改走数据页采样,只有预算为 0 或数据页采样同样一无所获时,才退回到粗粒度 [min, max] 区间。该指标不统计两种情形:一是索引块少于两个的 Segment,它直接离开该路径而不计数,改由数据页按行粒度采样;二是 Short Key Index 无法完整编码排序键的 Schema(例如 VARCHAR 排序键),这类表根本不会进入该路径,指标恒为 0,相应 Segment 体现在 sort_key_sampling_data_page_segments_total 中。

sort_key_sampling_short_key_index_latency​

  • 单位: us
  • 描述: 从 Short Key Index 采样单个 Segment 排序键所花费的时间,以 bvar 延迟序列发布(平均值、分位数、最大值、qps 与计数)。该路径不读取任何数据页,因此其取值应远低于 sort_key_sampling_data_page_latency。

spill_disk_bytes_used​

  • 单位: 字节
  • 标签: storage_type
  • 描述: 所有溢出存储目录当前已占用的磁盘字节数。storage_type=local 汇总 BE 溢出 DirManager 管理的每个目录中正在使用的字节数。storage_type=remote 为对称保留,当前始终为 0,因为远端溢出存储由单独的查询实例各自管理,没有全局的聚合数据。

spm_baseline_count​

  • 单位:个
  • 类型:瞬时值
  • 描述:FE Leader 上当前全局 SQL Plan Management(SPM)基线的数量。

spm_capture_candidate_total​

  • 单位:个
  • 类型:累积值
  • 标签:result(captured、skipped_duplicate、skipped_table_count、skipped_table_missing、skipped_db_missing、skipped_pattern_mismatch 或 failed)
  • 描述:SPM Auto-Capture 候选处理结果的总次数。不同标签值表示查询历史中的候选 SQL 在自动捕获流程中的不同归类结果。

spm_rewrite_total​

  • 单位:个
  • 类型:累积值
  • 标签:result(hit、miss 或 error)
  • 描述:SPM 改写尝试结果的总次数。hit 表示成功匹配并应用了基线,miss 表示执行了改写流程但没有命中可用基线,error 表示 SPM 改写过程中发生异常并回退到原始查询。

snmp​

  • 单位: -
  • 描述: /proc/net/snmp 返回的指标。

starrocks_be_clone_task_copy_bytes​

  • 单位: 字节
  • 类型: 累积
  • 描述: BE 节点中 Clone 任务复制的总文件大小,包括 INTER_NODE 和 INTRA_NODE 类型。

starrocks_be_clone_task_copy_duration_ms​

  • 单位: 毫秒
  • 类型: 累积
  • 描述: BE 节点中 Clone 任务复制消耗的总时间,包括 INTER_NODE 和 INTRA_NODE 类型。

starrocks_be_exec_state_report_active_threads​

  • 单位: 计数
  • 类型: 瞬时
  • 描述: 报告 Fragment 实例执行状态的线程池中正在执行的任务数量。

starrocks_be_exec_state_report_queue_count​

  • 单位: 计数
  • 类型: 瞬时
  • 描述: 报告 Fragment 实例执行状态的线程池中排队的任务数量,最多 1000 个。

starrocks_be_exec_state_report_running_threads​

  • 单位: 计数
  • 类型: 瞬时
  • 描述: 报告 Fragment 实例执行状态的线程池中的线程数量,最少 1 个,最多 2 个。

starrocks_be_exec_state_report_threadpool_size​

  • 单位: 计数
  • 类型: 瞬时
  • 描述: 报告 Fragment 实例执行状态的线程池中的最大线程数量,默认为 2。

starrocks_be_files_scan_num_bytes_read​

  • 单位: 字节
  • 描述: 从外部存储读取的总字节数。标签: file_format, scan_type。

starrocks_be_files_scan_num_files_read​

  • 单位: 计数
  • 描述: 从外部存储读取的文件数量 (CSV, Parquet, ORC, JSON, Avro)。标签: file_format, scan_type。

starrocks_be_files_scan_num_raw_rows_read​

  • 单位: 计数
  • 描述: 在格式验证和谓词过滤之前从外部存储读取的总原始行数。标签: file_format, scan_type。

starrocks_be_files_scan_num_rows_return​

  • 单位: 计数
  • 描述: 谓词过滤后返回的行数。标签: file_format, scan_type。

starrocks_be_files_scan_num_valid_rows_read​

  • 单位: 计数
  • 描述: 读取的有效行数(不包括格式无效的行)。标签: file_format, scan_type。

starrocks_be_lake_tablet_metadata_get_not_found_total​

  • 单位: 计数
  • 类型: 累积值
  • 描述: 仅存算分离模式。从远程存储读取 Lake Tablet 元数据时返回 NotFound 的尝试总数。Tablet 元数据要么存放在其独立的元数据文件中,要么存放在 Bundle 元数据文件中,二者必居其一且不会同时存在;对这两种位置的读取均会计入该指标,包括 Vacuum 流程发起的 Bundle 文件读取。每次失败的回退读取均会单独计数。缓存未命中和读取成功不会增加该指标。复制流程中对源集群元数据的读取、以及恢复流程中对快照元数据的读取不计入该指标。

starrocks_be_mem_pool_mem_limit_bytes​

  • 单位: 字节
  • 类型: 瞬时
  • 描述: 每个内存池的内存限制,以字节为单位。

starrocks_be_mem_pool_mem_usage_bytes​

  • 单位: 字节
  • 类型: 瞬时
  • 描述: 每个内存池当前使用的总内存,以字节为单位。

starrocks_be_mem_pool_mem_usage_ratio​

  • 单位: -
  • 类型: 瞬时
  • 描述:内存池的内存使用量与内存池的内存限制之比。

starrocks_be_mem_pool_workgroup_count​

  • 单位:计数
  • 类型:瞬时
  • 描述:分配给每个内存池的资源组数量。

starrocks_be_pipe_prepare_pool_queue_len​

  • 单位:计数
  • 类型:瞬时
  • 描述:管道准备线程池任务队列长度的瞬时值。

starrocks_be_priority_exec_state_report_active_threads​

  • 单位:计数
  • 类型:瞬时
  • 描述:报告Fragment实例最终执行状态的线程池中正在执行的任务数量。

starrocks_be_priority_exec_state_report_queue_count​

  • 单位:计数
  • 类型:瞬时
  • 描述:报告Fragment实例最终执行状态的线程池中排队等待的任务数量,最大值为2147483647。

starrocks_be_priority_exec_state_report_running_threads​

  • 单位:计数
  • 类型:瞬时
  • 描述:报告Fragment实例最终执行状态的线程池中的线程数量,最小值为1,最大值为2。

starrocks_be_priority_exec_state_report_threadpool_size​

  • 单位:计数
  • 类型:瞬时
  • 描述:报告Fragment实例最终执行状态的线程池中的最大线程数量,默认为2。

starrocks_be_resource_group_cpu_limit_ratio​

  • 单位:-
  • 类型:瞬时
  • 描述:资源组CPU配额比的瞬时值。

starrocks_be_resource_group_cpu_use_ratio​

  • 单位:-
  • 类型:平均
  • 描述:资源组使用的CPU时间与所有资源组CPU时间之比。

starrocks_be_resource_group_mem_inuse_bytes​

  • 单位:字节
  • 类型:瞬时
  • 描述:资源组内存使用量的瞬时值。

starrocks_be_resource_group_mem_limit_bytes​

  • 单位:字节
  • 类型:瞬时
  • 描述:资源组内存配额的瞬时值。

starrocks_be_segment_file_not_found_total​

  • 单位:计数
  • 描述:在段打开期间未找到段文件(文件丢失)的总次数。持续增加的值可能表示数据丢失或存储不一致。

starrocks_be_staros_shard_info_fallback_total​

  • 单位:计数
  • 类型:累积
  • 描述:仅存算分离模式。BE 的 StarOSWorker 因本地缓存中没有所需的 shard 信息(即 FE 在查询 / 合并 / lake 操作引用该 shard 之前尚未将其推送到该 BE)而实际向 starmgr 发起的 RPC(g_starlet->get_shard_info())总次数。仅在 starlet 就绪检查通过且 RPC 实际发出后才计入;starlet 尚未就绪的超时不包含在内。正常情况下该值应接近零。持续或上升的速率是一个强烈信号,表明 FE 端的任务或节点选择正把任务调度到尚未拥有该 shard 的 BE,或者 FE 端的 shard 推送存在滞后。建议告警:单个 BE 在 5 分钟窗口内的速率过高。

starrocks_be_staros_shard_info_fallback_failed_total​

  • 单位:计数
  • 类型:累积
  • 描述:仅存算分离模式。starrocks_be_staros_shard_info_fallback_total 中 starmgr RPC 返回非 OK 状态的子集。可使用比率 failed_total / fallback_total 将 starmgr 的瞬时错误与正常的成功回退区分开来进行告警。

starrocks_be_staros_shard_count​

  • 单位:计数
  • 类型:瞬时值
  • 描述:仅存算分离模式。当前分配给该 BE 的 StarOSWorker 的 shard 数量(即 worker 本地 shard 表的大小)。该值在 StarOSWorker::add_shard 与 StarOSWorker::remove_shard 内同步写入(mutation 时推送),不是在指标采集时重新计算;因此采集到的值反映的是最近一次 shard 表的变更结果。BE 关闭时该 gauge 不会被清零,会保留到下一次发生 mutation 为止。可用于观测各 BE 之间的 shard 分布均衡情况,并发现与 FE 端调度结果的偏差。

starrocks_fe_alter_duration_ms​

  • 单位:毫秒
  • 类型:摘要
  • 标签:execution_mode(fse、legacy_fse 或 rewrite)、is_leader
  • 描述:应用一次 ALTER TABLE 变更的耗时(毫秒),按语句统计。仅由 Leader FE 上报(is_leader="true")。包含 0.75、0.95、0.98、0.99、0.999 分位数及 _sum、_count。execution_mode 标签表示变更的应用方式:
    • fse:当前的 Fast Schema Evolution(FSE),在语句执行期间立即完成。
    • legacy_fse:旧版 FSE 路径,在后台执行,通常慢得多。仅出现在存算分离集群且表未开启 cloud_native_fast_schema_evolution_v2 时(默认开启,此时走 fse)。
    • rewrite:该变更需要物理重写表数据(例如修改列类型),同样在后台执行。

starrocks_fe_alter_operation_total​

  • 单位:计数
  • 类型:累积
  • 标签:type(add_column、drop_column 或 modify_column)、is_leader
  • 描述:ALTER TABLE 列操作的次数,按类型统计。一条语句可以包含多个操作——例如 ADD COLUMN a, DROP COLUMN b——每个操作按其类型分别计数。重命名、调整列顺序以及仅修改注释不计入。仅由 Leader FE 上报(is_leader="true")。

starrocks_fe_clone_task_copy_bytes​

  • 单位:字节
  • 类型:累积
  • 描述:集群中Clone任务复制的总文件大小,包括INTER_NODE和INTRA_NODE类型。

starrocks_fe_clone_task_copy_duration_ms​

  • 单位:毫秒
  • 类型:累积
  • 描述:集群中Clone任务消耗的总复制时间,包括INTER_NODE和INTRA_NODE类型。

starrocks_fe_clone_task_success​

  • 单位:计数
  • 类型:累积
  • 描述:集群中成功执行的克隆任务数量。

starrocks_fe_clone_task_total​

  • 单位:计数
  • 类型:累积
  • 描述:集群中克隆任务的总数。

starrocks_fe_last_finished_job_timestamp​

  • 单位:毫秒
  • 类型:瞬时
  • 描述:表示特定仓库下最后一次查询或加载的结束时间。对于存算一体集群,此项仅监控默认仓库。

starrocks_fe_max_journal_replay_lag​

  • 单位:计数
  • 类型:瞬时
  • 描述:所有存活的 Follower 或 Observer FE 中,为追上 Leader 仍需回放的元数据日志的最大条数。仅由 Leader FE 上报(is_leader="true"),因为只有 Leader 同时知道自身的日志写入位置以及通过心跳获取的其他各节点已回放的日志 ID。非存活的 FE 节点会被排除,因为它们最后上报的日志 ID 停留在最后一次成功心跳时的值;此类节点请通过 SHOW FRONTENDS 的 Alive 列来发现。当其他节点均已追上、没有其他存活的 FE 节点,以及单 FE 集群时,该值为 0。该值较高或持续增长,说明至少有一个节点的元数据回放已落后,将导致该节点提供陈旧的元数据,并在超过 meta_delay_toleration_second 后把查询转发给 Leader。

starrocks_fe_memory_usage​

  • 单位:字节或计数
  • 类型:瞬时
  • 描述:表示特定仓库下各种模块的内存统计信息。对于存算一体集群,此项仅监控默认仓库。

starrocks_fe_meta_log_count​

  • 单位:计数
  • 类型:瞬时
  • 描述:没有检查点的编辑日志数量。100000范围内的值被认为是合理的。

starrocks_fe_publish_version_daemon_loop_total​

  • 单位:计数
  • 类型:累积
  • 描述:此FE节点上publish-version-daemon循环的总运行次数。

以下指标是summary类型的指标,提供事务不同阶段的延迟分布。这些指标仅由Leader FE节点报告。

每个指标包括以下输出:

  • 分位数:不同百分位边界的延迟值。这些通过quantile标签公开,其值可以是0.75、0.95、0.98、0.99和0.999。
  • <metric_name>_sum:此阶段花费的总累积时间,例如starrocks_fe_txn_total_latency_ms_sum。
  • <metric_name>_count:此阶段记录的事务总数,例如starrocks_fe_txn_total_latency_ms_count。

所有事务指标共享以下标签:

  • type:按加载作业源类型(例如,all、stream_load、routine_load)对事务进行分类。这允许监控整体事务性能和特定加载类型的性能。报告组可以通过FE参数配置txn_latency_metric_report_groups。
  • is_leader:指示报告的FE节点是否为Leader。只有Leader FE (is_leader="true") 报告实际指标值。Follower将具有is_leader="false"并报告无数据。

starrocks_fe_query_resource_group​

  • 单位:计数
  • 类型:累积
  • 描述:表示在特定资源组下执行的查询总数。

starrocks_fe_query_resource_group​

  • 单位:计数
  • 类型:累积
  • 描述:每个资源组的查询数量。

starrocks_fe_query_resource_group_err​

  • 单位:计数
  • 类型:累积
  • 描述:表示在特定资源组下失败的查询数量。

starrocks_fe_query_resource_group_err​

  • 单位:计数
  • 类型:累积
  • 描述:每个资源组的错误查询数量。

starrocks_fe_query_resource_group_latency​

  • 单位:毫秒
  • 类型:累积
  • 描述:表示特定资源组下查询的延迟统计信息。

starrocks_fe_query_resource_group_latency​

  • 单位:秒
  • 类型:平均
  • 描述:每个资源组的查询延迟百分位数。

starrocks_fe_routine_load_error_rows​

  • 单位:计数
  • 描述:所有例行加载作业在数据加载过程中遇到的错误行总数。

starrocks_fe_routine_load_jobs​

  • 单位:计数

  • 描述:处于不同状态的例行加载作业总数。例如:

    starrocks_fe_routine_load_jobs{state="NEED_SCHEDULE"} 0
    starrocks_fe_routine_load_jobs{state="RUNNING"} 1
    starrocks_fe_routine_load_jobs{state="PAUSED"} 0
    starrocks_fe_routine_load_jobs{state="STOPPED"} 0
    starrocks_fe_routine_load_jobs{state="CANCELLED"} 1
    starrocks_fe_routine_load_jobs{state="UNSTABLE"} 0

starrocks_fe_routine_load_max_lag_of_partition​

  • 单位:-
  • 描述:每个例行加载作业的最大 Kafka 分区偏移量滞后。仅当 FE 配置 enable_routine_load_lag_metrics 设置为 true 且偏移量滞后大于或等于 FE 配置 min_routine_load_lag_for_metrics 时才收集。默认情况下,enable_routine_load_lag_metrics 为 false,min_routine_load_lag_for_metrics 为 10000。

starrocks_fe_routine_load_max_lag_time_of_partition​

  • 单位:秒
  • 描述:每个例行加载作业的最大 Kafka 分区偏移时间戳滞后。仅当 FE 配置 enable_routine_load_lag_time_metrics 设置为 true 时才收集。默认情况下,enable_routine_load_lag_time_metrics 为 false。

starrocks_fe_routine_load_paused​

  • 单位:计数
  • 描述:例行加载作业暂停的总次数。

starrocks_fe_routine_load_receive_bytes​

  • 单位:字节
  • 描述:所有例行加载作业加载的数据总量。

starrocks_fe_routine_load_rows​

  • 单位:计数
  • 描述:所有例行加载作业加载的总行数。

starrocks_fe_safe_mode​

  • 单位:-
  • 类型:瞬时
  • 描述:指示是否启用安全模式。有效值:0(禁用)和 1(启用)。当安全模式启用时,集群不再接受任何加载请求。

starrocks_fe_scheduled_pending_tablet_num​

  • 单位:计数
  • 类型:瞬时
  • 描述:FE 调度的处于 Pending 状态的克隆任务数量,包括 BALANCE 和 REPAIR 类型。

starrocks_fe_scheduled_running_tablet_num​

  • 单位:计数
  • 类型:瞬时
  • 描述:FE 调度的处于 Running 状态的克隆任务数量,包括 BALANCE 和 REPAIR 类型。

starrocks_fe_slow_lock_held_time_ms​

  • 单位:毫秒
  • 类型:摘要
  • 描述:当检测到慢锁时,直方图跟踪锁持有时间(以毫秒为单位)。当锁等待时间超过 slow_lock_threshold_ms 配置参数时,此指标会更新。它跟踪在检测到慢锁事件时所有锁持有者中的最大锁持有时间。每个指标包括分位数(0.75、0.95、0.98、0.99、0.999)、_sum 和 _count 输出。注意:在高争用情况下,此指标可能无法准确反映确切的锁持有时间,因为一旦等待时间超过阈值,指标就会更新,但持有时间可能会继续增加,直到持有者完成其操作并释放锁。但是,即使发生死锁,此指标仍然可以更新。

starrocks_fe_slow_lock_wait_time_ms​

  • 单位:毫秒
  • 类型:摘要
  • 描述:当检测到慢锁时,直方图跟踪锁等待时间(以毫秒为单位)。当锁等待时间超过 slow_lock_threshold_ms 配置参数时,此指标会更新。它准确跟踪在锁争用场景中线程等待获取锁的时间。每个指标包括分位数(0.75、0.95、0.98、0.99、0.999)、_sum 和 _count 输出。此指标提供精确的等待时间测量。注意:当发生死锁时,此指标无法更新,因此不能用于检测死锁情况。

starrocks_fe_sql_block_hit_count​

  • 单位:计数
  • 描述:被拦截的黑名单 SQL 的次数。

starrocks_fe_tablet_pre_split_eligibility_skipped​

  • 单位:计数
  • 类型:累计
  • 标签:reason — SkipReason 枚举值(小写形式)。单次导入级取值:not_range_distribution、table_not_normal、has_materialized_view_or_rollup、unsupported_sort_key、metadata_not_resolved、multiple_base_index_tablets、partition_not_empty、disabled_by_config、disabled_by_session。多分区路径(P2-a)的逐分区取值:unsupported_partition_column_type(分区源列类型无法投影,如 STRUCT/ARRAY)、invalid_partition_value(采样到的分区列值无法格式化为 AddPartitionClause,如非空列出现 null、日期无法解析)、grouper_empty(每行样本都被格式化器或分析器丢弃)、stale_catalog_state(grouper 阶段看到的分区在 coordinator 持 READ 锁重新解析时已消失 —— 并发分区 drop/replace)、partition_not_eligible_post_create(预建后的逐分区资格复检失败,通常因分区已非空或现在拥有多 tablet)。
  • 描述:基于采样的 Tablet 预分裂(Sample-Based Tablet Pre-Split)在 FE 端被资格门拒绝、采样器尚未启动的总次数,按拒绝原因细分。运维可据此一眼定位"预分裂没跑"是哪条具体分支造成的。多分区路径(P2-a)下,本计数器同时记录 grouper 与逐分区复解析阶段抛出的逐分区跳过原因。

starrocks_fe_tablet_pre_split_sampler_invocations​

  • 单位:计数
  • 类型:累计
  • 描述:由基于采样的 Tablet 预分裂触发的采样器调用总次数。每次资格门通过、生产采样管道开始采样时递增一次。

starrocks_fe_tablet_pre_split_sampler_failed​

  • 单位:计数
  • 类型:累计
  • 标签:reason — 资格门通过后的失败类别(SkipReason 的小写形式),取值之一:sample_failed(采样执行器抛错)、timeout_pre_submit(采样 + 规划 + 构建阶段超出 tablet_pre_split_pre_submit_timeout_seconds)、submit_failed(TabletReshardJobMgr 拒绝接纳)、pre_create_failed(多分区路径:LocalMetastore.addPartitions 在预建目标分区时抛错 —— 该单个分区会被踢出合并提交并回退到 BE 运行时自动建分区,同载入中的其他分区继续推进,同时计入 tablet_pre_split_sampler_failed{reason=pre_create_failed})。
  • 描述:采样器尝试但未能产出已接纳的 reshard 作业的总次数,按原因细分。与 tablet_pre_split_eligibility_skipped(采样器从未运行)以及 tablet_pre_split_tier_used(记录成功生成边界的层级)相区分。meta-tier → data-tier 回退本身不算失败,由 tablet_pre_split_tier_used{tier=data_tier} 跟踪。

starrocks_fe_tablet_pre_split_tier_used​

  • 单位:计数
  • 类型:累计
  • 标签:tier — meta_tier(边界由 Parquet/ORC row-group 统计算出,不读取行数据)或 data_tier(边界由 FILES 子查询采样的实际行算出,包含直接 data-tier 调用与 meta-tier → data-tier 回退两种来源)。
  • 描述:基于采样的 Tablet 预分裂调用总数,按生成边界的采样器层级细分。

starrocks_fe_tablet_pre_split_boundaries_planned​

  • 单位:计数
  • 类型:直方图
  • 描述:每次调用规划器产生的边界元组数量。等于 effectiveTabletCount - 1(K 个 tablet 的切分需要 K-1 个切点)。

starrocks_fe_tablet_pre_split_partitions_total​

  • 单位:计数
  • 类型:累计
  • 描述:多分区路径(P2-a)计数器。基于采样的 Tablet 预分裂协调器统计的预测目标分区总数 —— 每个通过 grouper 的 PartitionSamples 条目递增一次。配合 tablet_pre_split_partitions_capped 与 tablet_pre_split_pre_create{result=...} 系列,运维可了解每次多分区调用实际作用的分区数。单分区路径下保持为 0。

starrocks_fe_tablet_pre_split_partitions_capped​

  • 单位:计数
  • 类型:累计
  • 描述:多分区路径(P2-a)计数器。grouper 因单次导入的预测分区数超过 tablet_pre_split_max_partitions_per_load 而丢弃的分区数。grouper 保留样本数最多的分区、丢弃样本数最少的尾部;被丢弃的分区回退到 BE 运行时自动建分区且不做预分裂。持续非零意味着上限正在生效 —— 可考虑调高 tablet_pre_split_max_partitions_per_load 或降低载入的分区基数。

starrocks_fe_tablet_pre_split_pre_create​

  • 单位:计数
  • 类型:累计
  • 标签:result — succeeded(LocalMetastore.addPartitions 正常返回 —— 分区已创建或已被静默去重)、failed(addPartitions 抛错,如并发 ALTER 或写 journal 失败;该分区回退到 BE 运行时自动建分区,并同时计入 tablet_pre_split_sampler_failed{reason=pre_create_failed})、already_exists(预建时发现分区已在 catalog 中 —— 并发载入竞争;协调器复用已有分区)。
  • 描述:多分区路径(P2-a)计数器。协调器通过 LocalMetastore.addPartitions 发起的分区预建尝试数,按结果细分。总尝试数 = 三个标签之和。单分区路径下保持为 0。

starrocks_fe_tablet_pre_split_pre_submit_wait_ms​

  • 单位:毫秒
  • 类型:直方图
  • 描述:基于采样的 Tablet 预分裂在「提交前阶段」(采样 + 规划 + 构建 reshard 作业)耗费的墙钟时间。受 tablet_pre_split_pre_submit_timeout_seconds 上限约束。

starrocks_fe_tablet_pre_split_post_submit_wait_ms​

  • 单位:毫秒
  • 类型:直方图
  • 描述:协调器等待已提交的预分裂 reshard 作业到达 FINISHED 状态所耗费的墙钟时间。在所有生产导入类型上均触发 —— INSERT-from-FILES 与 INSERT-from-table(均经由 InsertPreSplitHook,在 StmtExecutor 中、StatementPlanner.plan 打开导入 txn 之前调用)以及 Broker Load(经由 BrokerLoadPreSplitHook,在 BrokerLoadJob.createLoadingTask 中、beginTxn 打开 T_load 之前调用),三者均通过共享的 PreSplitFlow 同步等待;测试用的 runPreSplit 同步包装路径也触发。所有路径下触发导入本身均按分裂后的 tablet 布局做计划。

starrocks_fe_tablet_pre_split_post_submit_hard_cap​

  • 单位:计数
  • 类型:累计
  • 描述:基于采样的 Tablet 预分裂触发提交后硬上限的事件总数。已提交的 reshard 作业未能在 tablet_pre_split_post_submit_wait_seconds 内到达 FINISHED 时递增。所有生产导入类型超时后均会触发 —— INSERT-from-FILES、INSERT-from-table 与 Broker Load(三者均通过共享的 PreSplitFlow 同步等待);测试用的 runPreSplit 同步包装路径也会触发。导入此时不中止地继续执行,按当时可见的 Tablet 布局做计划(守护线程还未推进则仍为原单 tablet 布局,若守护线程在放弃等待之后才完成则可能已部分/完全分裂);不递增 tablet_pre_split_load_abort,因为导入本身未被中止。

starrocks_fe_tablet_pre_split_load_abort​

  • 单位:计数
  • 类型:累计
  • 描述:因基于采样的 Tablet 预分裂未能在限定时间内确认 reshard 作业到达 FINISHED 而导致回滚的导入事务总数。tablet_pre_split_post_submit_hard_cap 的姊妹计数器。生产导入路径超时后不中止地继续执行(按当时可见的布局做计划)而非中止事务,因此该计数器在当前生产环境保持为零;仅在使用严格语义的 runPreSplit 包装路径(测试,或未来选择 "超时即中止" 的调用方)时触发。

starrocks_fe_tablet_reshard_job_total​

  • 单位:计数
  • 类型:累计
  • 标签:type(split 或 merge)
  • 描述:TabletReshardJobMgr 接纳的 Tablet reshard 作业总数,在作业入队并写入 journal 后递增。既包含自动 reshard(Tablet 分裂与合并),也包含由基于采样的 Tablet 预分裂提交的作业。按状态细分的作业数还可通过通用的 job gauge 观察,其标签为 job="tablet_reshard"、type 与 state。仅 Leader FE 递增该计数器;Follower 上保持为零,FE 重启或主从切换后从零重新开始。

starrocks_fe_tablet_reshard_job_finished​

  • 单位:计数
  • 类型:累计
  • 标签:type(split 或 merge)
  • 描述:到达 FINISHED 的 Tablet reshard 作业总数。与 tablet_reshard_job_total 对比即可看出已接纳的作业中有多少完成。仅 Leader FE 递增该计数器。

starrocks_fe_tablet_reshard_job_aborted​

  • 单位:计数
  • 类型:累计
  • 标签:type(split 或 merge)
  • 描述:以 ABORTED 结束的 Tablet reshard 作业总数。作业只能在其事务提交前中止;一旦提交便没有回滚路径,此后的失败只会重试而不会中止,因此不会计入这里。该情形请用 tablet_reshard_publish_failed 观察。仅 Leader FE 递增该计数器。

starrocks_fe_tablet_reshard_publish_failed​

  • 单位:计数
  • 类型:累计
  • 描述:失败并将被重试的 reshard publish 尝试总数,每次尝试递增一次。由于 reshard 事务在 publish 时已经提交,publish 失败会按指数退避(1s 起翻倍,上限 30s)一直重试直到成功:作业保持 RUNNING 且永不中止,所以作业卡住期间 tablet_reshard_job_aborted 一直是平的。因此告警应以该计数器为准。退避到 30s 上限后,持续失败的分区仍会让它每分钟递增约两次,故 increase(starrocks_fe_tablet_reshard_publish_failed[5m]) > 0 可在首次失败后约一分钟内发现卡住的作业。每次失败的原因会写入 information_schema.tablet_reshard_jobs 的 ERROR_MESSAGE 列以及 fe.warn.log。仅 Leader FE 递增该计数器。

starrocks_fe_tablet_reshard_parallel_tablets​

  • 单位:计数
  • 类型:瞬时
  • 描述:所有未完成的 reshard 作业中当前正在 reshard 的 Tablet 数量,即实时的 reshard 并行度。非 Leader FE 节点上报 0。

starrocks_fe_tablet_max_compaction_score​

  • 单位:计数
  • 类型:瞬时
  • 描述:表示每个 BE 节点上的最高 Compaction Score。

starrocks_fe_tablet_num​

  • 单位:计数
  • 类型:瞬时
  • 描述:表示每个BE节点上的tablet数量。

starrocks_fe_txn_max_committed_pending_publish_ms​

  • 单位:毫秒
  • 类型:瞬时
  • 描述:当前处于 COMMITTED 状态、等待发布为 VISIBLE 的事务中,停留时间最长者已等待的时长(毫秒),即最早提交但尚未发布的事务的存在时长。与 starrocks_fe_txn_publish_* 这类在事务完成后记录的汇总(summary)指标不同,该指标是实时反映当前最坏情况等待时间的瞬时值(gauge)。该值按数据库通过 db 标签上报,且仅由 Leader FE 节点上报(is_leader="true")。当没有等待发布的已提交事务时返回 0。该值较高或持续增长,表示版本发布卡住或落后于提交。

starrocks_fe_txn_publish_ack_latency_ms​

  • 单位:毫秒
  • 类型:汇总
  • 描述:最终确认延迟,从 ready-to-finish 时间到事务被标记为 VISIBLE 的最终 finish 时间。此指标包括事务准备完成后的最终确认步骤。

starrocks_fe_txn_publish_can_finish_latency_ms​

  • 单位:毫秒
  • 类型:汇总
  • 描述:从 publish 任务完成到 canTxnFinish() 首次返回 true 的延迟,测量时间从 publish version finish 到 ready-to-finish。

starrocks_fe_txn_publish_execute_latency_ms​

  • 单位:毫秒
  • 类型:汇总
  • 描述:publish 任务的实际执行时间,从任务被选取到完成。此指标表示使事务更改可见所花费的实际时间。

starrocks_fe_txn_publish_latency_ms​

  • 单位:毫秒
  • 类型:汇总
  • 描述:publish 阶段的延迟,从 commit 时间到 finish 时间。这是已提交事务对查询可见所需的时间。它是 schedule、execute、can_finish 和 ack 子阶段的总和。

starrocks_fe_txn_publish_schedule_latency_ms​

  • 单位:毫秒
  • 类型:汇总
  • 描述:事务提交后等待发布的时间,从 commit 时间到发布任务被选取的时间。此指标反映了 publish 管道中的调度延迟或排队时间。

starrocks_fe_txn_total_latency_ms​

  • 单位:毫秒
  • 类型:汇总
  • 描述:事务完成的总延迟,从 prepare 时间到 finish 时间。此指标表示事务的完整端到端持续时间。

starrocks_fe_txn_write_latency_ms​

  • 单位:毫秒
  • 类型:汇总
  • 描述:事务 write 阶段的延迟,从 prepare 时间到 commit 时间。此指标隔离了事务准备发布之前的数据写入和准备阶段的性能。

starrocks_fe_unfinished_backup_job​

  • 单位:计数
  • 类型:瞬时
  • 描述:表示特定仓库下正在运行的BACKUP任务数量。对于存算一体集群,此项仅监控默认仓库。对于存算分离集群,此值始终为 0。

starrocks_fe_unfinished_query​

  • 单位:计数
  • 类型:瞬时
  • 描述:表示特定仓库下当前正在运行的查询数量。对于存算一体集群,此项仅监控默认仓库。

starrocks_fe_unfinished_restore_job​

  • 单位:计数
  • 类型:瞬时
  • 描述:表示特定仓库下正在运行的RESTORE任务数量。对于存算一体集群,此项仅监控默认仓库。对于存算分离集群,此值始终为 0。

storage_page_cache_mem_bytes​

  • 单位:字节
  • 描述:存储页缓存使用的内存。

stream_load​

  • 单位:-
  • 描述:总加载行数和接收字节数。

stream_load_pipe_count​

  • 单位:计数
  • 描述:当前正在运行的Stream Load任务数量。

streaming_load_bytes​

  • 单位:字节
  • 描述:Stream Load加载的总字节数。

streaming_load_current_processing​

  • 单位: 计数
  • 描述: 当前正在运行的Stream Load任务数量。

streaming_load_duration_ms​

  • 单位: 毫秒
  • 描述: Stream Load的总耗时。

streaming_load_requests_total​

  • 单位: 计数
  • 描述: Stream Load请求的总数量。
分割​
Rocky the happy otterStarRocks Assistant

AI generated answers are based on docs and other sources. Please test answers in non-production environments.