本文說明如何透過 Model Armor,查看支援的 AI 代理程式內容安全洞察資料。
Model Armor 會篩選要求和回覆,找出安全風險,例如間接提示詞注入攻擊、敏感資料外洩,以及生成或提供有害內容。詳情請參閱「Model Armor」。
您可以在下列層級查看 Model Armor 作業的結果:
- 頂層檢視畫面:專案中所有支援的 AI 代理深入分析
- 代理程式層級檢視畫面:單一 AI 代理程式的洞察資料
事前準備
- 登入 Google Cloud 帳戶。如果您是 Google Cloud新手,歡迎 建立帳戶,親自評估產品在實際工作環境中的成效。新客戶還能獲得價值 $300 美元的免費抵免額,可用於執行、測試及部署工作負載。
Enable the Model Armor API.
Roles required to enable APIs
To enable APIs, you need the
serviceusage.services.enablepermission. If you created the project, then you likely already have this permission through the Owner role (roles/owner). Otherwise, you can get this permission through the Service Usage Admin role (roles/serviceusage.serviceUsageAdmin). Learn how to grant roles.Enable the Model Armor API.
Roles required to enable APIs
To enable APIs, you need the
serviceusage.services.enablepermission. If you created the project, then you likely already have this permission through the Owner role (roles/owner). Otherwise, you can get this permission through the Service Usage Admin role (roles/serviceusage.serviceUsageAdmin). Learn how to grant roles.- 在專案中為一或多個閘道設定 Model Armor。
- 如要監控與 Google Cloud MCP 伺服器通訊的代理程式,請使用 MCP 伺服器設定 Model Armor。
- 為代理程式設定追蹤。
必要角色
如要取得監控內容安全違規事項所需的權限,請要求管理員在專案中授予您下列 IAM 角色:
- 觀測能力檢視畫面存取子 (
roles/observability.viewAccessor) - Observability Analytics 使用者 (
roles/observability.analyticsUser) - 記錄檢視器 (
roles/logging.viewer) - 記錄檔檢視存取者 (
roles/logging.viewAccessor)
如要進一步瞭解如何授予角色,請參閱「管理專案、資料夾和組織的存取權」。
這些預先定義的角色具備監控內容安全違規事項所需的權限。如要查看確切的必要權限,請展開「Required permissions」(必要權限) 部分:
所需權限
如要監控內容安全違規事項,必須具備下列權限:
-
monitoring.monitoredResourceDescriptors.list -
monitoring.metricDescriptors.list
支援的代理程式
「安全性」分頁會填入以下代理程式的 Model Armor 洞察資料:
- 部署在 Agent Runtime 中,並由已設定 Model Armor 的閘道控管的代理。
- 在 Agent Runtime 中部署的代理,並與 MCP 伺服器通訊。Google Cloud
- 在已設定 Model Armor 底限設定的專案中,部署至 Agent Runtime 的代理程式。
查看專案中支援的 AI 代理程式內容洞察資料 (頂層檢視畫面)
如要查看專案中所有支援的 AI 代理程式的內容安全洞察資訊,請按照下列步驟操作:
- 前往 Google Cloud 控制台的 Gemini Enterprise Agent Platform「安全性」分頁。
- 選取專案。
如果「安全性」分頁未顯示內容安全洞察,且專案中有支援的 AI 代理程式,請確認您已為代理程式設定追蹤。
查看 AI 代理的內容洞察資料 (代理層級檢視畫面)
如要查看支援代理程式的內容安全深入分析,請按照下列步驟操作:
- 前往 Google Cloud 控制台的「Agent Registry」頁面。
- 選取專案。
- 按一下代理程式的名稱。
- 按一下 [Security] (安全性) 分頁標籤。
查看已標記或封鎖的互動次數
在「安全性」分頁中,查看互動次數,包括遭檢舉和封鎖的互動。「安全性」分頁會顯示下列指標:
- 互動總數:Model Armor 分析的提示詞和回覆總數。
- 標記的互動:違反 Model Armor 範本或底限設定中已設定政策的互動次數。
- 已封鎖的互動數量:如果您在
INSPECT_AND_BLOCK模式中設定 Model Armor,系統會封鎖互動。這些遭到封鎖的互動違反了底限設定或範本。
監控內容安全違規事項
在「隨時間變化的違規次數」圖表中,監控隨時間變化的違規次數。
系統偵測到的違規事項會歸類到下列領域:
- 提示注入和越獄:內容違規事項,表示提示含有惡意指令或越獄嘗試。詳情請參閱「提示詞注入和越獄偵測」。
- 惡意網址:內容違規事項,指出存在惡意網址。詳情請參閱「惡意網址偵測」。
- 負責任的 AI 技術:安全篩選器偵測到的內容違規事項,例如騷擾和仇恨言論。如需負責任的 AI 技術類別完整清單,請參閱負責任的 AI 安全性篩選器。
- 機密資料:內容違規事項涉及出現您定義的機密資訊類型或自訂資訊類型。詳情請參閱「Sensitive Data Protection」。
如要進一步瞭解這些偵測器,請參閱「Model Armor 篩選器」。
找出違規次數最多的服務專員
前往頂層「安全性」分頁標籤。
「安全性」分頁會顯示違規次數最多的前 10 名代理。清單會顯示每個代理程式的 ID,以及該代理程式偵測到的違規次數。
如要查看清單中特定代理程式的 Model Armor 洞察資料,請前往 Agent Registry,並依代理程式 ID 搜尋代理程式。然後前往該代理的代理層級「安全性」分頁。
使用 SQL 查詢及分析遙測資料
如要查詢及分析 Model Armor 的遙測資料,請使用 Observability Analytics,這項工具提供以 SQL 為基礎的查詢介面。
- 前往頂層「安全性」分頁標籤。
- 如要查詢特定檢視區,請依序點選「更多圖表選項」>「在可觀測性分析中探索」。
如需 Observability Analytics 的一般使用說明,請參閱「使用 Observability Analytics 查詢及分析遙測資料」。
將違規資料下載為 PNG 或 CSV 檔案
如要將違規事項資料下載為 PNG 或 CSV 檔案,請按照下列步驟操作:
- 在「安全性」分頁的「違規事項隨時間變化」檢視畫面中,選取要下載資料的期間。
- 依序點選「更多圖表選項」>「下載」。
- 按一下「下載 PNG」或「下載 CSV」,即可下載偏好的資料格式。