本頁列出 Memorystore for Valkey 適用的指標,並說明各項指標的用途。
如要瞭解如何查看這些指標,請參閱「監控執行個體」一文。
備份指標
執行個體層級指標
本節列出並說明執行個體層級的備份和匯入指標。
| 指標名稱 | 說明 |
|---|---|
memorystore.googleapis.com/instance/backup/last_backup_start_time
|
這項指標會顯示上次備份作業的開始時間。 |
memorystore.googleapis.com/instance/backup/last_backup_status
|
這項指標會顯示最近一次備份嘗試是否成功完成。狀態分別是 1 (適用於 Success) 和 0 (適用於 Failed)。 |
memorystore.googleapis.com/instance/backup/last_backup_duration
|
這項指標會顯示上次備份作業的時間長度 (以毫秒為單位)。 |
memorystore.googleapis.com/instance/backup/last_backup_size
|
這項指標會顯示上次備份的大小 (以位元組為單位)。這項指標是監控備份效率和規劃儲存容量的重要指標。 |
memorystore.googleapis.com/instance/import/last_import_start_time
|
這項指標會顯示上次匯入作業的開始時間。 |
memorystore.googleapis.com/instance/import/last_import_duration
|
這項指標會顯示上次匯入作業的時間長度 (以毫秒為單位)。 |
Bloom 篩選器和 JSON 指標
本節列出 Bloom 篩選器和 JSON 文件的節點層級指標。
節點層級指標
這些指標可提供詳細洞察資料,包括 Bloom 篩選器物件和 JSON 文件總數,以及這些篩選器和文件消耗的記憶體量。
| 指標名稱 | 說明 |
|---|---|
memorystore.googleapis.com/instance/node/bloomfilter/objects_count
|
這項指標會測量插入執行個體的 Bloom 篩選器物件總數。 |
memorystore.googleapis.com/instance/node/bloomfilter/used_memory
|
這項指標會測量 Bloom 篩選器耗用的記憶體量。為避免超出執行個體的容量限制,您可以使用指標追蹤縮放篩選器的記憶體成長。如果執行個體的記憶體容量超出上限,這些篩選器會新增子篩選器。 |
memorystore.googleapis.com/instance/node/json/documents_count
|
這項指標會評估執行個體節點上的 JSON 文件總數。您可以使用這項指標追蹤資料分配和容量,因為這項指標會顯示節點層級的索引、刪除或合併文件數量。 |
memorystore.googleapis.com/instance/node/json/used_memory
|
這項指標會測量 JSON 文件耗用的記憶體量 (以位元組為單位,或以可用記憶體百分比表示)。您可以使用這項指標監控容量、找出記憶體受限的節點,以及觸發調整大小動作。 |
憑證授權單位 (CA) 指標
本節列出與客戶管理的憑證授權單位 (CA) 相關聯的指標。
執行個體層級指標
這些指標提供與執行個體中機器相關聯的憑證高階總覽。
| 指標名稱 | 說明 |
|---|---|
memorystore.googleapis.com/instance/security/rotate_tls_cert_count
|
這項指標會顯示與執行個體中機器相關聯的輪替憑證狀態。 指標可能處於下列狀態:
|
Cloud Monitoring 指標
本節列出並說明適用於 Memorystore for Valkey 的 Cloud Monitoring 指標。
執行個體層級指標
這些指標可概略瞭解執行個體的整體健康狀態和效能。您可以運用這些指標瞭解例項的整體容量和使用率,並找出潛在瓶頸或可改善之處。
| 指標名稱 | 說明 |
|---|---|
memorystore.googleapis.com/instance/clients/average_connected_clients
|
這項指標會評估指定時間內,執行個體平均的有效用戶端連線數。您可以利用這項指標監控連線調度情形、找出應用程式瓶頸,並確保執行個體穩定運作 |
memorystore.googleapis.com/instance/clients/maximum_connected_clients
|
這項指標會顯示執行個體所有節點的活躍用戶端連線數上限。您可以使用這項指標,隨時監控執行個體上的最高連線負載。這對確保執行個體的高效能至關重要,因為連線數量過多可能會增加回應時間。 |
memorystore.googleapis.com/instance/clients/maximum_connection_duration
|
這項指標會測量執行個體中單一節點的用戶端連線最長持續時間。您可以運用這項指標管理資源耗盡情形、確保負載平衡,以及強制執行安全性政策。 |
memorystore.googleapis.com/instance/clients/total_connected_clients
|
這項指標會追蹤目前連至執行個體的有效用戶端連線數量。您可以利用這項指標監控資料庫的負載,並避免連線數超出上限。 |
memorystore.googleapis.com/instance/stats/total_connections_received_count
|
這項指標會顯示執行個體在過去一分鐘內建立的累計用戶端連線數。您可以使用這項指標分析流量負載、確保未超出連線限制,並判斷是否需要擴充執行個體。 |
memorystore.googleapis.com/instance/stats/total_rejected_connections_count
|
這項指標會追蹤因達到 maxclients 限制而遭拒的執行個體連線總數。 |
memorystore.googleapis.com/instance/commandstats/total_usec_count
|
這項指標會測量每個指令耗用的 CPU 總時間。這項指標表示使用的微秒總數,可深入瞭解執行個體的效能和延遲。 |
memorystore.googleapis.com/instance/commandstats/total_calls_count
|
這項指標會計算執行個體節點上與特定指令相關聯的呼叫總數 (以分鐘為單位)。如要找出特定指令的瓶頸或高流量,可以使用指標監控主要和副本節點的指令輸送量 (每分鐘的指令數)。 |
memorystore.googleapis.com/instance/cpu/average_utilization
|
這項指標會顯示執行個體的平均 CPU 使用率 (從 0.0 到 1.0)。您可以根據這項指標找出資源過度佈建或使用率不足的情況、管理自動調整規模的閾值,以及偵測效能瓶頸,理想的使用率為 40% 到 70%。 |
memorystore.googleapis.com/instance/cpu/maximum_utilization
|
這項指標會顯示執行個體中所有節點的 CPU 尖峰用量 (介於 0.0 到 1.0 之間)。 這項指標只會匯總 請確認主要節點的 CPU 使用率不超過 0.8 秒,且每個指定為讀取副本的副本不超過 0.5 秒。詳情請參閱「CPU 使用率最佳做法」。 |
memorystore.googleapis.com/instance/stats/average_expired_keys
|
這項指標會評估執行個體所有主要節點的平均金鑰到期事件數。您可以使用這項指標監控即將到期的金鑰數量。 |
memorystore.googleapis.com/instance/stats/maximum_expired_keys
|
這項指標會測量執行個體所有主要節點中,發生金鑰到期事件的次數上限。 |
memorystore.googleapis.com/instance/stats/total_expired_keys_count
|
這項指標會追蹤執行個體所有主要節點中發生的金鑰到期事件總數。您可以透過這項指標,監控即將過期的金鑰數量。 |
memorystore.googleapis.com/instance/stats/average_evicted_keys
|
這項指標會追蹤執行個體主要分片因記憶體容量限制而遭逐出的平均鍵數。 |
memorystore.googleapis.com/instance/stats/maximum_evicted_keys
|
這項指標顯示因記憶體容量而從主要執行個體的節點或分片中逐出的鍵數量上限。 |
memorystore.googleapis.com/instance/stats/total_evicted_keys_count
|
這項指標顯示主要執行個體的節點因記憶體容量而剔除的鍵總數。 |
memorystore.googleapis.com/instance/keyspace/total_keys
|
這項指標會顯示儲存在執行個體中的金鑰數量。 |
memorystore.googleapis.com/instance/stats/average_keyspace_hits
|
這項指標顯示執行個體中所有節點的平均金鑰成功查閱次數。 |
memorystore.googleapis.com/instance/stats/maximum_keyspace_hits
|
這項指標會顯示執行個體節點中,成功查閱鍵的次數上限。您可以使用這項指標監控執行個體的效能,並找出執行個體中潛在的熱點。 |
memorystore.googleapis.com/instance/stats/total_keyspace_hits_count
|
這項指標會追蹤執行個體中所有節點的成功鍵查閱累積次數。 |
memorystore.googleapis.com/instance/stats/average_keyspace_misses
|
這項指標會顯示執行個體中,金鑰查閱失敗的平均次數。您可以使用這項指標,追蹤系統要求金鑰但未在快取中找到金鑰的頻率。 |
memorystore.googleapis.com/instance/stats/maximum_keyspace_misses
|
這項指標顯示執行個體節點中,鍵值查閱失敗次數的上限。 |
memorystore.googleapis.com/instance/stats/total_keyspace_misses_count
|
這項指標顯示所有執行個體節點中,金鑰查閱失敗的總次數。 |
memorystore.googleapis.com/instance/memory/average_utilization
|
這項指標會顯示執行個體的平均記憶體使用率 (從 0.0 到 1.0)。您可以使用這項指標監控執行個體的容量,並設定快訊閾值。舉例來說,您可以設定快訊門檻,在平均記憶體用量超過特定百分比 (例如 80%) 時通知使用者。 |
memorystore.googleapis.com/instance/memory/maximum_utilization
|
這項指標顯示所有執行個體節點的最大記憶體使用率 (從 0.0 到 1.0)。您可以使用這項指標判斷調度執行個體資源的時機。建議您監控使用情況,確保使用率維持在 100% 以下。在高寫入負載下,如果這項指標達到 65% 至 85%,效能可能會降低。 |
memorystore.googleapis.com/instance/memory/total_used_memory
|
這項指標會顯示執行個體的記憶體用量總計 (以位元組為單位)。您可以使用這項指標監控執行個體的容量。 |
memorystore.googleapis.com/instance/memory/size |
這項指標會測量執行個體中所有節點的 RAM 總量、用量和可用量。您可以使用這項指標監控執行個體的容量,並避免節點故障。 |
memorystore.googleapis.com/instance/replication/average_ack_lag
|
這項指標會顯示執行個體中副本的平均確認延遲時間 (以秒為單位)。 確認延遲是執行個體中主要節點的瓶頸。這是因為備用節點無法跟上主要節點傳送的資訊,發生這種情況時,主要節點必須等待副本確認收到資訊。這可能會導致交易提交速度變慢,並對主要節點的效能造成影響。 |
memorystore.googleapis.com/instance/replication/maximum_ack_lag
|
這項指標會顯示執行個體中副本的最大確認延遲時間 (以秒為單位)。 |
memorystore.googleapis.com/instance/replication/average_offset_diff
|
這項指標顯示執行個體中,平均複製確認位移差 (以位元組為單位)。 「複製確認偏移差異」是指副本及其主要執行個體之間未複製的位元組數。 |
memorystore.googleapis.com/instance/replication/maximum_offset_diff
|
這項指標會顯示執行個體中,最大的複製偏移差異 (以位元組為單位)。 複製偏移差異是指備用資源和主要執行個體之間未複製的位元組數。 |
memorystore.googleapis.com/instance/stats/total_net_input_bytes_count
|
這項指標會顯示執行個體端點接收的傳入網路位元組數。 |
memorystore.googleapis.com/instance/stats/total_net_output_bytes_count
|
這項指標會顯示執行個體端點傳送的輸出網路位元組數。 |
節點層級指標
這些指標可深入瞭解執行個體中個別節點的健康狀態和效能。您可以運用這些指標排解節點問題,進一步提升節點效能。
| 指標名稱 | 說明 |
|---|---|
memorystore.googleapis.com/instance/node/clients/connected_clients
|
這項指標表示連至執行個體節點的有效用戶端連線數量,不包括副本連線。您可以使用這項指標監控連線限制,並找出分片接收不成比例流量的熱點。 |
memorystore.googleapis.com/instance/node/clients/blocked_clients
|
這項指標會顯示執行個體節點封鎖的用戶端連線數量。如果遭到封鎖的用戶端連線數量偏高或快速增加,可能表示許多用戶端都在等待作業。這可能會導致延遲時間增加。 |
memorystore.googleapis.com/instance/node/server/uptime |
這項指標會測量執行個體節點的正常運作時間。您可以使用這項指標,追蹤伺服器持續運作的時間長度,不會重新啟動或發生故障。 |
memorystore.googleapis.com/instance/node/stats/connections_received_count
|
這項指標會追蹤指定時間範圍內,在執行個體節點上建立的用戶端連線總數。您可以使用 指標,監控執行個體中個別節點的連線流量。 因此,您可以分析負載分配情形,並找出連線活動的尖峰。 |
memorystore.googleapis.com/instance/node/stats/rejected_connections_count
|
這項指標顯示因執行個體節點達到 maxclients 限制而遭拒的連線數量。您可以透過這項指標判斷節點是否承受高連線壓力,並因無法處理更多連線而拒絕建立新連線。 |
memorystore.googleapis.com/instance/node/commandstats/usec_count
|
這項指標會顯示每個指令在執行個體節點中耗費的總時間。您可以使用這項指標分析指令的效能、找出緩慢的指令,以及排解節點層級的延遲問題。 |
memorystore.googleapis.com/instance/node/commandstats/calls_count
|
這項指標會追蹤執行個體節點上每分鐘的指令呼叫總數。您可以使用這項指標監控流量分配情形、找出使用量大的指令,以及排解個別節點的瓶頸問題。 |
memorystore.googleapis.com/instance/node/cpu/utilization
|
這項指標會顯示執行個體節點的 CPU 使用率 (從 0.0 到 1.0)。 |
memorystore.googleapis.com/instance/node/stats/expired_keys_count
|
這項指標會顯示執行個體節點中的過期事件總數。您可以透過這項指標監控金鑰從執行個體中移除的速率,因為金鑰的存留時間 (TTL) 已達到零。 |
memorystore.googleapis.com/instance/node/stats/evicted_keys_count
|
這項指標會計算執行個體節點因達到記憶體上限而逐出的鍵總數。這項指標可判斷執行個體是否面臨記憶體壓力。如果逐出的鍵數量偏高或持續增加,表示執行個體空間不足,因此會移除鍵,以便為新資料騰出空間。 |
memorystore.googleapis.com/instance/node/keyspace/total_keys
|
這項指標會評估執行個體節點儲存的索引鍵總數。這項指標可顯示節點的資料分布和分片情形。 |
memorystore.googleapis.com/instance/node/stats/keyspace_hits_count
|
這項指標會追蹤執行個體節點上成功的重要查閱次數。您可以使用這項指標,監控節點擷取記憶體內資料的效率。 |
memorystore.googleapis.com/instance/node/stats/keyspace_misses_count
|
這項指標會追蹤執行個體節點上失敗的索引鍵查閱次數。 |
memorystore.googleapis.com/instance/node/memory/utilization
|
這項指標會追蹤執行個體節點的記憶體使用率 (從 0.0 到 1.0)。您可以運用這項指標避免節點故障,並確保執行個體穩定運作。 |
memorystore.googleapis.com/instance/node/memory/usage |
這項指標可衡量執行個體節點的記憶體用量。 |
memorystore.googleapis.com/instance/node/stats/net_input_bytes_count
|
這項指標會測量執行個體節點接收的連入網路位元組總數。您可以使用這項指標監控網路總處理量、找出潛在瓶頸,以及分析節點上的流量尖峰。 |
memorystore.googleapis.com/instance/node/stats/net_output_bytes_count
|
這項指標會評估執行個體節點傳送的輸出網路位元組總數。您可以利用這項指標監控節點的網路輸出量,以利調整效能及規劃容量。 |
memorystore.googleapis.com/instance/node/replication/offset
|
這項指標會測量執行個體節點的複製偏移位元組。將執行個體的副本升級為主要執行個體之前,您可以使用指標檢查副本是否已處理所有資料。這可避免資料遺失。 |
memorystore.googleapis.com/instance/node/server/healthy
|
這項指標會判斷執行個體節點是否可用,以及是否正常運作。 |
memorystore.googleapis.com/instance/node/migration_status
|
這項指標與將自行管理的 Redis 和 Valkey 執行個體工作負載遷移至 Memorystore for Valkey 相關聯。您可以使用這項指標,判斷來源和目標執行個體分片之間的複寫連結在遷移程序中是否正常運作。 |
memorystore.googleapis.com/instance/node/migration_received_bytes_size
|
這項指標會顯示目標執行個體節點收到的位元組數,用來評估遷移期間節點的資料流入量。您可以使用這項指標,監控遷移程序中的資料同步進度。 |
memorystore.googleapis.com/instance/node/migration_link_reconnect_count
|
這項指標會測量遷移重新連線的嘗試次數。您可以根據這項指標,判斷目標執行個體嘗試重新連線至來源執行個體的頻率,以便進行遷移。 |
memorystore.googleapis.com/instance/node/stats/evicted_clients_count
|
這項指標會追蹤 Memorystore for Valkey 中斷連線的用戶端總數,因為所有用戶端緩衝區耗用的記憶體總和超過預先定義的記憶體用量上限。您可以將這項指標做為保護機制,防止用戶端記憶體用量過高,導致伺服器記憶體耗盡並觸發當機。 |
memorystore.googleapis.com/instance/node/clients/tracking_clients
|
這項指標會追蹤已註冊接收伺服器端追蹤和失效訊息的有效 Valkey 用戶端數量。您可以使用這項指標監控及偵錯用戶端快取實作,確保伺服器追蹤功能正常運作。 |
memorystore.googleapis.com/instance/node/clients/maxclients
|
這項指標會顯示 Memorystore for Valkey 允許在執行個體節點上建立的並行用戶端連線數量上限。 |
memorystore.googleapis.com/instance/node/clients/recent_max_input_buffer
|
這項指標會回報所有有效連線中,用於處理單一傳入用戶端指令的最大記憶體緩衝區空間 (以位元組為單位)。您可以使用這項指標追蹤連線穩定性,並防止記憶體膨脹。如果特定用戶端的輸入緩衝區空間持續達到上限,可能會導致執行個體發生網路停滯或連線中斷的情況。 |
memorystore.googleapis.com/instance/node/clients/recent_max_output_buffer
|
這項指標會測量最近連線至伺服器的用戶端連線中,最長的輸出清單 (以位元組為單位)。這項指標是伺服器健康狀態的重要指標,因為它會找出要求大量資料的用戶端,且這些用戶端要求資料的速度比伺服器傳送資料的速度快。 |
memorystore.googleapis.com/instance/node/commandstats/rejected_calls_count
|
這項指標會顯示伺服器在執行前拒絕的 Valkey 指令 (呼叫) 數量。這些呼叫是由前提條件觸發,例如指令中含有語法錯誤,或執行記憶體受限的指令時,執行個體記憶體不足 (OOM)。 |
memorystore.googleapis.com/instance/node/commandstats/failed_calls_count
|
這項指標會追蹤執行個體節點上失敗的作業次數。 您可以根據這項指標,評估用戶端應用程式是否傳遞不當參數,或與資料集結構定義不同步。此外,您還可以診斷失敗次數增加是否與指令效能下降有關。 |
memorystore.googleapis.com/instance/node/keyspace/keys_with_expiration
|
這項指標會追蹤執行個體中設有存留時間 (TTL) 或到期時間戳記的有效金鑰數量。您可以使用這項指標監控快取限制、記憶體用量和工作階段管理。 |
memorystore.googleapis.com/instance/node/memory/dataset_usage
|
這項指標會測量執行個體節點中資料集或主要資料物件耗用的記憶體量。 |
memorystore.googleapis.com/instance/node/memory/mem_not_counted_for_evict
|
這項指標會顯示伺服器在評估主要收回作業所需的記憶體時,排除的記憶體量。 Memorystore for Valkey 在計算是否需要逐出鍵時,會比較總分配記憶體 ( |
memorystore.googleapis.com/instance/node/memory/number_of_cached_scripts
|
這項指標會追蹤伺服器在執行個體節點上快取的 EVAL 指令碼總數。您可以使用這項指標,監控執行個體中與 Lua 指令碼相關的負荷。 |
memorystore.googleapis.com/instance/node/memory/number_of_functions
|
這項指標會追蹤在執行個體節點上定義的函式總數。您可以透過這項指標,深入瞭解執行個體中 Valkey 函式功能的使用情形。 |
memorystore.googleapis.com/instance/node/memory/lua_usage
|
這項指標會追蹤 Lua 在執行個體節點上用於指令碼的位元組數。EVAL |
memorystore.googleapis.com/instance/node/memory/replica_clients_usage
|
這項指標會追蹤副本用戶端在執行個體節點上消耗的記憶體量 (以位元組為單位)。這項指標會評估副本用戶端使用的記憶體。 由於副本緩衝區會與複製積壓工作共用記憶體,因此當副本未觸發記憶體用量增加 (超出為積壓工作分配的記憶體) 時,指標可能會回報 |
memorystore.googleapis.com/instance/node/memory/normal_clients_usage
|
這項指標會追蹤非副本用戶端在執行個體節點上使用的記憶體量 (以位元組為單位)。這項指標會測量非副本用戶端連線的記憶體用量。 |
memorystore.googleapis.com/instance/node/memory/peak_usage
|
這項指標會追蹤 Memorystore for Valkey 在執行個體節點上消耗的尖峰記憶體。這項指標會測量 Memorystore for Valkey 自上次啟動以來使用的記憶體量上限 (以位元組為單位)。 |
memorystore.googleapis.com/instance/node/memory/rss_usage
|
這項指標會追蹤執行個體節點上 Memorystore for Valkey 的常駐集大小 (RSS) 用量。這項指標代表 Memorystore for Valkey 分配的位元組數。 監控 RSS 用量至關重要,因為這反映了實際的實體 RAM 用量,因此可以偵測到記憶體片段過多。舉例來說,如果 RSS 接近執行個體的容器限制,可能會導致 OOM 問題。 |
memorystore.googleapis.com/instance/node/memory/scripts_usage
|
這項指標會追蹤與執行個體節點上指令碼相關聯的記憶體負荷。這項指標會測量 EVAL 和 Valkey 函式指令碼使用的記憶體負荷位元組數。這類記憶體會視為執行個體的整體 used_memory 一部分。 |
memorystore.googleapis.com/instance/node/memory/maxmemory_policy
|
這項指標會追蹤執行個體節點的逐出政策設定。這項指標會回報節點的目前 maxmemory-policy 設定,決定 Memorystore for Valkey 達到 maxmemory 限制時,如何選取要逐出的鍵。 |
memorystore.googleapis.com/instance/node/persistence/aof_enabled
|
這項指標表示執行個體節點是否已啟用僅限附加檔案 (AOF) 持續性。 |
memorystore.googleapis.com/instance/node/persistence/async_loading
|
這項指標會指出 Memorystore for Valkey 是否在提供現有資料時,以非同步方式載入複寫資料集。這項指標會追蹤 Memorystore for Valkey 載入資料集的狀態。當 repl-diskless-load 設定啟用並設為 swapdb 時,就會發生這種情況。 |
memorystore.googleapis.com/instance/node/persistence/loading
|
這項指標表示 Memorystore for Valkey 是否在執行個體節點上載入 dump 檔案。您可以使用這項指標評估 Memorystore for Valkey 是否從永久儲存空間載入資料,例如 Redis 資料庫 (RDB) 快照或 AOF 檔案。 |
memorystore.googleapis.com/instance/node/persistence/current_cow_peak
|
這項指標會追蹤執行個體節點上子項分叉程序期間,與寫入時複製 (COW) 作業相關聯的尖峰記憶體用量。這項指標會測量子項分叉執行時,COW 記憶體的大小上限 (以位元組為單位)。這類作業包括分叉程序,例如建立 RDB 快照或執行 AOF 重新寫入。 監控 COW 大小峰值對於容量規劃和避免 OOM 問題非常重要,因為在分叉程序期間,節點的總記憶體用量會增加,增加量等於分叉處於啟用狀態時修改的資料量。 |
memorystore.googleapis.com/instance/node/persistence/current_cow_size
|
這項指標會追蹤子項分叉程序在執行個體節點上處於活動狀態時,COW 記憶體的目前大小。這項指標會測量分叉程序期間複製的記憶體大小 (以位元組為單位),例如建立 RDB 快照或執行 AOF 重寫。 您可以使用這項指標,監控進行中的分支作業的即時記憶體負荷。 |
memorystore.googleapis.com/instance/node/persistence/rdb_last_bgsave_time_sec
|
這項指標會追蹤執行個體節點上 RDB 最近一次背景儲存 ( 您可以使用這項指標監控持續性作業的效能影響,尤其是在維護或擴充事件期間。 |
memorystore.googleapis.com/instance/node/persistence/rdb_last_cow_size
|
這項指標會追蹤執行個體節點最近一次 RDB 儲存作業期間的 COW 記憶體大小。這項指標會測量在背景建立上一個 RDB 快照時複製的記憶體量 (以位元組為單位)。 您可以使用這項指標,在維護或更新設定期間,偵錯完整同步處理的潛在問題,因為這項指標可深入瞭解持續性程序的記憶體負荷。 |
memorystore.googleapis.com/instance/node/persistence/current_fork_percentage
|
這項指標會追蹤執行個體節點上目前的分支程序進度,指出作用中分支作業的完成百分比,例如用於 RDB 快照或 AOF 重寫的作業。 |
memorystore.googleapis.com/instance/node/persistence/aof_rewrite_in_progress
|
這項指標會提供即時狀態 (1 代表 true,0 代表 false),指出 Memorystore for Valkey 是否在執行個體節點上執行 AOF 重寫。您可以根據這項指標,判斷背景 AOF 作業是否導致延遲或記憶體用量明顯增加。重寫作業可能會觸發暫時的負載尖峰。 |
memorystore.googleapis.com/instance/node/persistence/aof_last_cow_size
|
這項指標會追蹤執行個體節點最近一次 AOF 重寫作業期間使用的 COW 記憶體大小。這項指標會測量 Memorystore for Valkey 在執行上次背景 AOF 重寫時複製的記憶體量 (以位元組為單位)。 您可以使用這項指標,在持續性作業期間監控 COW 記憶體大小。這對容量規劃至關重要,因為在分叉程序期間,節點的總記憶體用量會增加,增加量等於分叉啟動期間修改的資料量。如果您未管理 COW 記憶體,執行個體可能會發生 OOM 問題。 |
memorystore.googleapis.com/instance/node/persistence/aof_last_rewrite_time_sec
|
這項指標會測量執行個體節點上最近一次背景 AOF 重寫作業完成所需的時間 (以秒為單位)。您可以使用這項指標評估背景 AOF 持續性對效能的影響,並瞭解重寫作業造成的暫時性負載尖峰持續時間。 |
memorystore.googleapis.com/instance/node/errorstats/errors_count
|
這項指標會詳細列出 Memorystore for Valkey 內部統計資料的 ERRORSTATS 區段所衍生的錯誤。這項指標會測量一段時間內的錯誤次數變化。
|
memorystore.googleapis.com/instance/node/stats/acl_access_denied_auths_count
|
這項指標會回報一段時間內,因存取控制清單 (ACL) 拒絕存取而導致的驗證失敗總次數。 |
memorystore.googleapis.com/instance/node/stats/expire_cycle_cpu_millisecond_count
|
這項指標會測量一段時間內,用於有效到期週期累計的 CPU 時間。 |
memorystore.googleapis.com/instance/node/stats/expired_keys_percentage
|
這項指標會顯示特定時間點的預估過期金鑰百分比。這項指標可提供有關到期程序的洞察資訊。如果百分比持續偏高,表示 Memorystore for Valkey 可能未分配足夠的背景 CPU 週期,以跟上鍵到期率。 |
memorystore.googleapis.com/instance/node/stats/expired_time_cap_reached_count
|
這項指標會測量在一段時間間隔內,達到時間限制的週期累計次數。如果這項指標的值偏高或持續增加,通常表示過期金鑰導致記憶體用量偏高。為維護資料集健康狀態,可能需要更多背景 CPU 週期。 |
memorystore.googleapis.com/instance/node/stats/pubsub_channels
|
這項指標會顯示有用戶端訂閱項目的全球 Pub/Sub 頻道數量。 |
memorystore.googleapis.com/instance/node/stats/pubsub_patterns
|
這項指標會顯示有用戶端訂閱項目的 Pub/Sub 模式全域數量。 |
memorystore.googleapis.com/instance/node/stats/pubsubshard_channels
|
這項指標會顯示有用戶端訂閱項目的 Pub/Sub 分片管道全球數量。 |
memorystore.googleapis.com/instance/node/stats/total_fork_count
|
這項指標會評估一段時間內總分岔數的變化,是 Memorystore for Valkey 背景活動的重要指標。 您可以利用這項指標監控容量規劃的分支頻率,因為每個分支程序都會用到 COW 記憶體。COW 記憶體會增加執行個體節點的整體記憶體用量。 |
memorystore.googleapis.com/instance/node/stats/tracking_total_keys
|
這項指標會顯示 Memorystore for Valkey 追蹤的鍵數量。 這項指標是伺服器端追蹤功能的一環,可讓用戶端維護本機快取,並在 Memorystore for Valkey 上的鍵變更時失效。 |
memorystore.googleapis.com/instance/node/stats/tracking_total_items
|
這項指標顯示 Memorystore for Valkey 追蹤的項目總數。這項指標代表觀看各個鍵的所有用戶端總和。 |
memorystore.googleapis.com/instance/node/stats/tracking_total_prefixes
|
這項指標會顯示 Memorystore for Valkey prefix 表格中追蹤的前置字元數量。 |
redis.googleapis.com/cluster/node/stats/latest_fork_usec
|
這項指標會顯示最新分叉作業的持續時間 (以微秒為單位)。 |
memorystore.googleapis.com/instance/node/replication/primary_sync_in_progress
|
這項指標會顯示主要執行個體是否與副本同步。值為 您可以使用這項指標排解資料一致性問題,並瞭解擴充或維護事件的進度。 |
memorystore.googleapis.com/instance/node/replication/sync_partial_ok_count
|
這項指標會計算部分重新同步嘗試成功次數。 |
memorystore.googleapis.com/instance/node/replication/sync_partial_err_count
|
這項指標會測量部分重新同步嘗試失敗的次數。 您可以將這項指標做為複製健康狀態的指標。如果部分重新同步失敗,備用資源必須執行完整重新同步。這包括在主要執行個體上建立 RDB 快照,並透過網路傳輸整個資料集。 |
memorystore.googleapis.com/instance/node/replication/sync_full_count
|
這項指標會測量主要執行個體與副本之間完整重新同步的次數變化。如果部分重新同步失敗,系統會執行完整重新同步。如果主要執行個體上的複製積壓工作量不足以保存備用資源在連線中斷期間遺失的資料,就會發生這種情況。 您可以使用這項指標,診斷執行個體的複寫健康狀態和容量問題。 |
memorystore.googleapis.com/instance/node/memory/maxmemory
|
這項指標反映執行個體節點的 這項指標定義了資料儲存空間和伺服器負擔的記憶體用量上限,因此可用於容量規劃和排解 OOM 問題。 如要進一步瞭解 |
memorystore.googleapis.com/instance/node/clients/pubsub_clients
|
這項指標會顯示 Pub/Sub 用戶端數量。您可以使用這項指標評估整體用戶端負載,以及專用於即時訊息的資源用量。 |
memorystore.googleapis.com/instance/node/clients/watching_clients
|
這項指標會顯示處於觀看模式的用戶端數量。監看用戶端是有效多鍵交易的指標,這類交易依賴樂觀並行控制,確保資料完整性。 |
memorystore.googleapis.com/instance/node/stats/evicted_scripts_count
|
這項指標會顯示 |
memorystore.googleapis.com/instance/node/stats/client_query_buffer_limit_disconnections_count
|
這項指標會顯示因用戶端達到查詢緩衝區限制而發生的中斷連線總次數。您可以將這項指標做為防護機制,避免用戶端記憶體用量失控。記憶體用量過高可能會導致伺服器記憶體耗盡,進而引發當機。 |
memorystore.googleapis.com/instance/node/stats/client_output_buffer_limit_disconnections_count |
這項指標顯示用戶端達到輸出緩衝區限制而導致的連線中斷總次數。 您可以使用這項指標監控輸出緩衝區中斷連線的情形。監控這些中斷連線情形對於維持伺服器穩定性至關重要,因為輸出緩衝區過大是導致記憶體壓力意外增加和記憶體不足 (OOM) 問題的常見原因。 |
跨區域複製指標
本節列出並說明跨區域複製指標。
| 指標名稱 | 說明 |
|---|---|
memorystore.googleapis.com/instance/cross_instance_replication/secondary_replication_links |
這項指標會顯示主要和次要執行個體之間的分片連結數。在跨區域複製群組中,主要執行個體會回報與群組中次要執行個體之間的跨區域複製連結數量。對於每個次要執行個體,這個數字應等於分片數。如果這個數字低於分片數,則這項指標會指出複寫器與追隨者之間停止複寫時的分片數。在理想狀態下,這個指標的數字與主要執行個體的分片數相同。 |
memorystore.googleapis.com/instance/cross_instance_replication/secondary_maximum_replication_offset_diff |
這項指標會顯示主要和次要分片之間的最大複寫偏移差異。 |
memorystore.googleapis.com/instance/cross_instance_replication/secondary_average_replication_offset_diff |
這項指標顯示主要和次要分片之間的平均複寫偏移差異。 |
持續性指標
本節列出並說明持續性指標。
RDB 持久性指標
本節列出並說明 RDB 持續性指標。
執行個體層級指標
本節列出並說明執行個體層級的 RDB 持續性指標。
| 指標名稱 | 說明 |
|---|---|
memorystore.googleapis.com/instance/persistence/rdb_saves_count
|
這項指標會追蹤在執行個體節點上進行 RDB 持久性快照 (也稱為「RDB 儲存」) 的累計次數。您可以使用這項指標,監控每個節點的 RDB 快照頻率和成功率。 指標含有 |
memorystore.googleapis.com/instance/persistence/rdb_last_success_ages
|
這項指標會顯示執行個體中所有節點的快照發布時間。如果發生復原事件,您可以使用這項指標查看資料過時的時間範圍。理想情況下,發布時間的延遲時間應少於 (或等於) 快照頻率。 |
節點層級指標
| 指標名稱 | 說明 |
|---|---|
memorystore.googleapis.com/instance/node/persistence/rdb_bgsave_in_progress
|
這項指標表示執行個體節點上是否已啟用 RDB (BGSAVE)。TRUE 狀態表示 BGSAVE 處於啟用狀態。 |
memorystore.googleapis.com/instance/node/persistence/rdb_last_bgsave_status
|
這項指標會指出執行個體節點上的 BGSAVE 作業是否完成或發生錯誤。TRUE 狀態表示作業已完成。 |
memorystore.googleapis.com/instance/node/persistence/rdb_saves_count
|
這項指標會追蹤在執行個體節點上建立的 RDB 快照累計數量。您可以使用這項指標監控節點上的快照頻率和成功率。 |
memorystore.googleapis.com/instance/node/persistence/rdb_last_save_age
|
這項指標會測量自上次成功建立 RDB 快照以來經過的時間 (以秒為單位)。您可以使用這項指標,監控執行個體節點上 RDB 持續性資料的過時程度。 |
memorystore.googleapis.com/instance/node/persistence/rdb_next_save_time_until
|
這項指標會測量執行個體節點下次排定產生 RDB 快照前剩餘的時間 (以秒為單位)。您可以使用這項指標監控 RDB 持續性排程,並追蹤下次自動產生快照的時間。 |
memorystore.googleapis.com/instance/node/persistence/current_save_keys_total
|
這項指標會追蹤執行個體節點上目前 RDB 儲存作業處理的金鑰總數。 |
AOF 持久性指標
本節列出並說明 AOF 持久性指標。
執行個體層級指標
本節列出並說明執行個體層級的 AOF 持久性指標。
| 指標名稱 | 說明 |
|---|---|
memorystore.googleapis.com/instance/persistence/aof_fsync_lags
|
這項指標會測量執行個體中所有節點的時間差 (或延遲),這些節點會通過將資料寫入 AOF 的時間,以及將資料成功同步至耐久儲存空間的時間。 如果 |
memorystore.googleapis.com/instance/persistence/aof_rewrite_count
|
這項指標會追蹤執行個體節點觸發 AOF 重寫作業的累計次數。您可以根據這項指標診斷效能問題,因為 AOF 重寫作業頻率過高可能會導致執行個體出現延遲尖峰或記憶體壓力。 指標含有 |
節點層級指標
本節列出並說明節點層級的 AOF 持久性指標。
| 指標名稱 | 說明 |
|---|---|
memorystore.googleapis.com/instance/node/persistence/aof_last_write_status
|
這項指標會顯示執行個體節點上,上次寫入 AOF 檔案的作業狀態。如果狀態為 TRUE,表示寫入作業成功。您可以使用這項指標,確認 Memorystore for Valkey 是否成功保存資料。 |
memorystore.googleapis.com/instance/node/persistence/aof_last_bgrewrite_status
|
這項指標會顯示執行個體節點上最近一次 AOF bgrewrite
作業的狀態。如果狀態為 TRUE,表示作業成功。 |
memorystore.googleapis.com/instance/node/persistence/aof_fsync_lag
|
這項指標會測量執行個體節點的時間差 (或延遲),也就是從資料寫入 AOF 到資料成功同步至耐久儲存空間之間的時間差。 如果 |
memorystore.googleapis.com/instance/node/persistence/aof_rewrites_count
|
這項指標會追蹤執行個體節點觸發 AOF 重寫作業的累計次數。您可以運用這項指標診斷效能問題。如果 AOF 重寫頻率過高,可能會導致執行個體延遲增加或記憶體壓力過大。 指標含有 |
memorystore.googleapis.com/instance/node/persistence/aof_fsync_errors_count
|
這項指標會追蹤執行個體節點上 AOF fsync() 系統呼叫失敗的累計次數。這項指標僅適用於已啟用 AOF 的執行個體,且 appendfsync 參數設為 everysec 或 always。 |
常見的持續性指標
本節列出並說明適用於 AOF 和 RDB 持續性的指標。
節點層級指標
本節列出並說明節點層級的 AOF 和 RDB 持續性指標。
| 指標名稱 | 說明 |
|---|---|
memorystore.googleapis.com/instance/node/persistence/auto_restore_count
|
這項指標會追蹤執行個體節點從持續性 dump 檔案 (AOF 或 RDB) 自動還原的累計次數。 指標含有 |
持續性指標的應用實例
本節說明 AOF 和 RDB 持續性指標的範例用途。
檢查 AOF 寫入作業是否導致延遲和記憶體壓力
假設您發現執行個體或執行個體內的節點延遲時間或記憶體用量增加,請檢查額外用量是否與 AOF 持久性有關。
AOF 重寫作業可能會觸發暫時的負載尖峰。建議您檢查 aof_rewrites_count 指標,因為這項指標會提供執行個體或執行個體節點生命週期內的 AOF 重寫累計次數。
假設這項指標顯示,重寫次數的增量對應於延遲時間的增加。如要減少重寫頻率,請降低寫入率或增加分片數。
檢查 RDB 儲存作業是否導致延遲和記憶體壓力
假設您在執行個體或執行個體內的節點上,偵測到延遲或記憶體用量增加,如果發生這種情況,請檢查額外用量是否與 RDB 持續性有關。
RDB 儲存作業可能會觸發暫時性的負載尖峰。建議您檢查 rdb_saves_count 指標,因為這項指標會提供例項或例項節點生命週期內 RDB 儲存作業的累計次數。
假設這項指標顯示,RDB 儲存次數增加會導致延遲時間變長。如要降低 RDB 儲存頻率,請增加 RDB 快照間隔。此外,如要降低基準負載量,請水平擴展執行個體。
解讀 Memorystore for Valkey 的指標
許多指標都屬於下列類別:平均值、最大值和總值。
我們提供相同指標的「平均」和「最大」變體,方便您使用這兩個指標找出該指標系列的熱點。
指標的總計值與指標的平均和最大變異無關。這個值提供的洞察資料與熱點變體的用途無關。
瞭解平均和最高指標
假設您要比較某個執行個體的 average_keyspace_hits 和 maximum_keyspace_hits 指標值。這兩項指標的差異越大,表示執行個體中出現熱點的次數越多。如果指標值接近,表示命中次數在執行個體中的節點之間分布較平均。
這項原則適用於所有指標,包括相同指標的平均和最高變體。
互動區範例
比較執行個體中所有分片的 average_keyspace_hits 和 maximum_keyspace_hits 指標值,即可判斷哪些分片發生熱點。舉例來說,假設六個分片執行個體中的分片有下列點擊次數:
- 資料分割 1 - 2 命中
- 分片 2 - 2 次命中
- 分片 3 - 2 個命中
- 分片 4 - 2 次命中
- 分片 5 - 2 次命中
- 第 6 至 8 個分片命中
在本範例中,average_keyspace_hits 指標會傳回值 3,但 maximum_keyspace_hits 指標會傳回值 8。命中次數並未平均分配到執行個體中的分片。分片 6 是熱點,因為處理的流量比例過高。