監控內容安全

本文說明如何透過 Model Armor,查看支援的 AI 代理程式內容安全洞察資料。

Model Armor 會篩選要求和回覆,找出安全風險,例如間接提示詞注入攻擊、敏感資料外洩,以及生成或提供有害內容。詳情請參閱「Model Armor」。

您可以在下列層級查看 Model Armor 作業的結果:

事前準備

  1. 登入 Google Cloud 帳戶。如果您是 Google Cloud新手,歡迎 建立帳戶,親自評估產品在實際工作環境中的成效。新客戶還能獲得價值 $300 美元的免費抵免額,可用於執行、測試及部署工作負載。
  2. Enable the Model Armor API.

    Roles required to enable APIs

    To enable APIs, you need the serviceusage.services.enable permission. If you created the project, then you likely already have this permission through the Owner role (roles/owner). Otherwise, you can get this permission through the Service Usage Admin role (roles/serviceusage.serviceUsageAdmin). Learn how to grant roles.

    Enable the API

  3. Enable the Model Armor API.

    Roles required to enable APIs

    To enable APIs, you need the serviceusage.services.enable permission. If you created the project, then you likely already have this permission through the Owner role (roles/owner). Otherwise, you can get this permission through the Service Usage Admin role (roles/serviceusage.serviceUsageAdmin). Learn how to grant roles.

    Enable the API

  4. 在專案中為一或多個閘道設定 Model Armor
  5. 如要監控與 Google Cloud MCP 伺服器通訊的代理程式,請使用 MCP 伺服器設定 Model Armor
  6. 為代理程式設定追蹤

必要角色

如要取得監控內容安全違規事項所需的權限,請要求管理員在專案中授予您下列 IAM 角色:

如要進一步瞭解如何授予角色,請參閱「管理專案、資料夾和組織的存取權」。

這些預先定義的角色具備監控內容安全違規事項所需的權限。如要查看確切的必要權限,請展開「Required permissions」(必要權限) 部分:

所需權限

如要監控內容安全違規事項,必須具備下列權限:

  • monitoring.monitoredResourceDescriptors.list
  • monitoring.metricDescriptors.list

您或許還可透過自訂角色或其他預先定義的角色取得這些權限。

支援的代理程式

「安全性」分頁會填入以下代理程式的 Model Armor 洞察資料:

查看專案中支援的 AI 代理程式內容洞察資料 (頂層檢視畫面)

如要查看專案中所有支援的 AI 代理程式的內容安全洞察資訊,請按照下列步驟操作:

  1. 前往 Google Cloud 控制台的 Gemini Enterprise Agent Platform「安全性」分頁。

    前往「安全性」頁面

  2. 選取專案。

如果「安全性」分頁未顯示內容安全洞察,且專案中有支援的 AI 代理程式,請確認您已為代理程式設定追蹤

查看 AI 代理的內容洞察資料 (代理層級檢視畫面)

如要查看支援代理程式的內容安全深入分析,請按照下列步驟操作:

  1. 前往 Google Cloud 控制台的「Agent Registry」頁面。

    前往 Agent Registry

  2. 選取專案。
  3. 按一下代理程式的名稱。
  4. 按一下 [Security] (安全性) 分頁標籤。

查看已標記或封鎖的互動次數

前往頂層代理商層級的「安全性」分頁。

在「安全性」分頁中,查看互動次數,包括遭檢舉和封鎖的互動。「安全性」分頁會顯示下列指標:

  • 互動總數:Model Armor 分析的提示詞和回覆總數。
  • 標記的互動:違反 Model Armor 範本或底限設定中已設定政策的互動次數。
  • 已封鎖的互動數量:如果您在 INSPECT_AND_BLOCK 模式中設定 Model Armor,系統會封鎖互動。這些遭到封鎖的互動違反了底限設定或範本。

監控內容安全違規事項

前往頂層代理商層級的「安全性」分頁。

在「隨時間變化的違規次數」圖表中,監控隨時間變化的違規次數。

系統偵測到的違規事項會歸類到下列領域:

如要進一步瞭解這些偵測器,請參閱「Model Armor 篩選器」。

找出違規次數最多的服務專員

前往頂層「安全性」分頁標籤。

「安全性」分頁會顯示違規次數最多的前 10 名代理。清單會顯示每個代理程式的 ID,以及該代理程式偵測到的違規次數。

如要查看清單中特定代理程式的 Model Armor 洞察資料,請前往 Agent Registry,並依代理程式 ID 搜尋代理程式。然後前往該代理的代理層級「安全性」分頁。

前往 Agent Registry

使用 SQL 查詢及分析遙測資料

如要查詢及分析 Model Armor 的遙測資料,請使用 Observability Analytics,這項工具提供以 SQL 為基礎的查詢介面。

  1. 前往頂層「安全性」分頁標籤。
  2. 如要查詢特定檢視區,請依序點選「更多圖表選項」>「在可觀測性分析中探索」

如需 Observability Analytics 的一般使用說明,請參閱「使用 Observability Analytics 查詢及分析遙測資料」。

將違規資料下載為 PNG 或 CSV 檔案

如要將違規事項資料下載為 PNG 或 CSV 檔案,請按照下列步驟操作:

  1. 在「安全性」分頁的「違規事項隨時間變化」檢視畫面中,選取要下載資料的期間。
  2. 依序點選「更多圖表選項」>「下載」
  3. 按一下「下載 PNG」或「下載 CSV」,即可下載偏好的資料格式。

後續步驟

指南

瞭解 Model Armor 的稽核記錄。

指南

瞭解如何設定 Model Armor 的記錄功能。

疑難排解

瞭解如何排解 Model Armor 問題。