GCP Cloud Run¶
采集 GCP Cloud Run 服务请求流量、延迟分解、容器 CPU/内存资源、实例扩缩与探针启动等指标
配置¶
安装 Func¶
推荐开通 观测云集成 - 扩展 - 托管版 Func: 一切前置条件都自动安装好, 请继续脚本安装
如果自行部署 Func 参考自行部署 Func
安装脚本¶
-
登陆Func 控制台,点击【脚本市场】,进入观测云脚本市场,搜索
integration_gcp_run -
点击【安装】后,输入相应的参数:账户文件名、Target Principal、帐号名
-
点击【部署启动脚本】,系统会自动创建
Startup脚本集,并自动配置相应的启动脚本。 -
开启后可以在「管理 / 自动触发配置」里看到对应的自动触发配置。点击【执行】,即可立即执行一次,无需等待定期时间。稍等片刻,可以查看执行任务记录以及对应日志。
验证¶
- 在「管理 / 自动触发配置」确认对应的任务是否已存在对应的自动触发配置,同时可以查看对应任务记录及日志检查是否有异常
- 在观测云,「指标」中查看是否存在
gcp_run指标集及对应监控数据 - 在观测云,「指标」查看是否有对应监控数据
指标¶
Cloud Run 的指标统一上报到 gcp_run 指标集。原始指标 为 Cloud Monitoring run.googleapis.com/ 命名空间下的指标类型;分布型指标由采集器按统计量拆分为 _avg、_p95、_p99、_samplecount、_sumsqdev 多个字段。
公共标签:
| 标签 | 描述信息 |
|---|---|
| account_name | 集成账号名称,作为唯一识别 |
| cloud_provider | 云厂商,固定为 gcp |
| project_id | GCP 项目 ID |
| project_name | GCP 项目名称 |
| location | 服务所在区域 |
| service_name | Cloud Run 服务名 |
| revision_name | 修订版本名 |
| configuration_name | 配置名称 |
| container_name | 容器名称(容器级指标) |
| monitor_resource_type | 监控资源类型 |
部分指标携带的特有标签:response_code、response_code_class(请求类指标),state(容器/实例状态),readiness_status(就绪状态),scaling_driver(扩缩驱动),probe_type、probe_action、is_healthy、is_default(探针类指标),kind(网络流量类型)。
gcp_run¶
| 指标 | 原始指标 | 描述信息 | 单位 |
|---|---|---|---|
| container_billable_instance_time | container/billable_instance_time | 可计费的容器实例运行时间 | 秒 |
| container_completed_probe_attempt_count | container/completed_probe_attempt_count | 已完成的探针尝试次数 | 次 |
| container_completed_probe_count | container/completed_probe_count | 已完成的探针检查次数 | 次 |
| container_containers | container/containers | 各状态下的容器数量 | 个 |
| container_cpu_allocation_time | container/cpu/allocation_time | 分配给容器的 CPU 时间 | 核·秒 |
| container_cpu_usage_avg | container/cpu/usage | 容器 CPU 使用量平均值 | 秒 |
| container_cpu_usage_p95 | container/cpu/usage | 容器 CPU 使用量 95 分位 | 秒 |
| container_cpu_usage_p99 | container/cpu/usage | 容器 CPU 使用量 99 分位 | 秒 |
| container_cpu_usage_samplecount | container/cpu/usage | 容器 CPU 使用量采样点数 | 个 |
| container_cpu_utilizations_avg | container/cpu/utilizations | 容器 CPU 利用率平均值 | 比值(0-1) |
| container_cpu_utilizations_p95 | container/cpu/utilizations | 容器 CPU 利用率 95 分位 | 比值(0-1) |
| container_cpu_utilizations_p99 | container/cpu/utilizations | 容器 CPU 利用率 99 分位 | 比值(0-1) |
| container_cpu_utilizations_samplecount | container/cpu/utilizations | 容器 CPU 利用率采样点数 | 个 |
| container_instance_count | container/instance_count | 各状态(活跃、空闲)的容器实例数 | 个 |
| container_instance_count_with_readiness | container/instance_count_with_readiness | 按就绪状态划分的容器实例数 | 个 |
| container_max_request_concurrencies_avg | container/max_request_concurrencies | 单实例最大请求并发数平均值 | 个 |
| container_max_request_concurrencies_p95 | container/max_request_concurrencies | 单实例最大请求并发数 95 分位 | 个 |
| container_max_request_concurrencies_p99 | container/max_request_concurrencies | 单实例最大请求并发数 99 分位 | 个 |
| container_max_request_concurrencies_samplecount | container/max_request_concurrencies | 单实例最大请求并发数采样点数 | 个 |
| container_memory_allocation_time | container/memory/allocation_time | 分配给容器的内存时间 | 字节·秒 |
| container_memory_tmpfs_usage_samplecount | container/memory/tmpfs_usage | 容器 tmpfs 内存使用量采样点数 | 个 |
| container_memory_usage_avg | container/memory/usage | 容器内存使用量平均值 | 字节 |
| container_memory_usage_p95 | container/memory/usage | 容器内存使用量 95 分位 | 字节 |
| container_memory_usage_p99 | container/memory/usage | 容器内存使用量 99 分位 | 字节 |
| container_memory_usage_samplecount | container/memory/usage | 容器内存使用量采样点数 | 个 |
| container_memory_utilizations_avg | container/memory/utilizations | 容器内存利用率平均值 | 比值(0-1) |
| container_memory_utilizations_p95 | container/memory/utilizations | 容器内存利用率 95 分位 | 比值(0-1) |
| container_memory_utilizations_p99 | container/memory/utilizations | 容器内存利用率 99 分位 | 比值(0-1) |
| container_memory_utilizations_samplecount | container/memory/utilizations | 容器内存利用率采样点数 | 个 |
| container_network_received_bytes_count | container/network/received_bytes_count | 容器网络接收字节数 | 字节 |
| container_network_sent_bytes_count | container/network/sent_bytes_count | 容器网络发送字节数 | 字节 |
| container_probe_attempt_latencies_avg | container/probe_attempt_latencies | 单次探针尝试延迟平均值 | 毫秒 |
| container_probe_attempt_latencies_p95 | container/probe_attempt_latencies | 单次探针尝试延迟 95 分位 | 毫秒 |
| container_probe_attempt_latencies_p99 | container/probe_attempt_latencies | 单次探针尝试延迟 99 分位 | 毫秒 |
| container_probe_attempt_latencies_samplecount | container/probe_attempt_latencies | 单次探针尝试延迟采样点数 | 个 |
| container_probe_latencies_avg | container/probe_latencies | 探针延迟平均值(含重试) | 毫秒 |
| container_probe_latencies_p95 | container/probe_latencies | 探针延迟 95 分位(含重试) | 毫秒 |
| container_probe_latencies_p99 | container/probe_latencies | 探针延迟 99 分位(含重试) | 毫秒 |
| container_probe_latencies_samplecount | container/probe_latencies | 探针延迟采样点数 | 个 |
| container_startup_latencies_avg | container/startup_latencies | 容器启动延迟平均值 | 毫秒 |
| container_startup_latencies_p95 | container/startup_latencies | 容器启动延迟 95 分位 | 毫秒 |
| container_startup_latencies_p99 | container/startup_latencies | 容器启动延迟 99 分位 | 毫秒 |
| container_startup_latencies_samplecount | container/startup_latencies | 容器启动延迟采样点数 | 个 |
| pending_queue_pending_requests | pending_queue/pending_requests | 待处理请求队列长度 | 个 |
| request_count | request_count | 请求数 | 次 |
| request_latencies_avg | request_latencies | 请求延迟平均值 | 毫秒 |
| request_latencies_p95 | request_latencies | 请求延迟 95 分位 | 毫秒 |
| request_latencies_p99 | request_latencies | 请求延迟 99 分位 | 毫秒 |
| request_latencies_samplecount | request_latencies | 请求延迟采样点数 | 个 |
| request_latencies_sumsqdev | request_latencies | 请求延迟平方偏差和 | 毫秒² |
| request_latency_e_2_e_latencies_avg | request_latency/e2e_latencies | 端到端请求延迟平均值 | 毫秒 |
| request_latency_e_2_e_latencies_p95 | request_latency/e2e_latencies | 端到端请求延迟 95 分位 | 毫秒 |
| request_latency_e_2_e_latencies_p99 | request_latency/e2e_latencies | 端到端请求延迟 99 分位 | 毫秒 |
| request_latency_e_2_e_latencies_samplecount | request_latency/e2e_latencies | 端到端请求延迟采样点数 | 个 |
| request_latency_e_2_e_latencies_sumsqdev | request_latency/e2e_latencies | 端到端请求延迟平方偏差和 | 毫秒² |
| request_latency_ingress_to_region_avg | request_latency/ingress_to_region | 入口到服务所在区域的延迟平均值 | 毫秒 |
| request_latency_ingress_to_region_samplecount | request_latency/ingress_to_region | 入口到区域延迟采样点数 | 个 |
| request_latency_ingress_to_region_sumsqdev | request_latency/ingress_to_region | 入口到区域延迟平方偏差和 | 毫秒² |
| request_latency_pending_samplecount | request_latency/pending | 请求排队等待延迟采样点数 | 个 |
| request_latency_response_egress_avg | request_latency/response_egress | 响应出口延迟平均值 | 毫秒 |
| request_latency_response_egress_samplecount | request_latency/response_egress | 响应出口延迟采样点数 | 个 |
| request_latency_response_egress_sumsqdev | request_latency/response_egress | 响应出口延迟平方偏差和 | 毫秒² |
| request_latency_routing_avg | request_latency/routing | 请求路由延迟平均值 | 毫秒 |
| request_latency_routing_samplecount | request_latency/routing | 请求路由延迟采样点数 | 个 |
| request_latency_routing_sumsqdev | request_latency/routing | 请求路由延迟平方偏差和 | 毫秒² |
| request_latency_user_execution_avg | request_latency/user_execution | 用户代码执行延迟平均值 | 毫秒 |
| request_latency_user_execution_p95 | request_latency/user_execution | 用户代码执行延迟 95 分位 | 毫秒 |
| request_latency_user_execution_p99 | request_latency/user_execution | 用户代码执行延迟 99 分位 | 毫秒 |
| request_latency_user_execution_samplecount | request_latency/user_execution | 用户代码执行延迟采样点数 | 个 |
| scaling_recommended_instances | scaling/recommended_instances | 自动扩缩推荐的实例数 | 个 |