使用語意管理政策的最佳做法

有效的控管機制取決於工具及其參數的準確、清楚和完整說明。代理系統 (包括代理本身和語意管理政策等管理層) 需要比人類更詳細的資訊,才能瞭解可用工具的適用性。

提供最明確的工具說明

清楚說明 MCP 工具,以及這些工具所需的參數。

  • 工具說明不足:「搜尋項目」。
  • 有效的工具說明:「依關鍵字、演員、類型或格式搜尋內容目錄。使用者想查看可觀看的電影或電視節目時,請使用這項功能。傳回依關聯性排序的前 10 個項目。

留意說明的限制

語意管理系統會對說明強制執行下列長度限制:

說明項目 套用對象 長度限制
工具 MCP 伺服器或其他公開工具的實體 1000 個半形字元
動作 MCP 伺服器中的個別工具,或代理可用的函式呼叫 750 個字元
參數 工具或函式呼叫中使用的參數 300 個字元

如果語意控管執行階段收到的說明超出上述任一限制,系統會將說明截斷至規定上限,並記錄訊息。

語意管理政策的介入時機

語意控管政策專門用於對建議的工具呼叫執行安全檢查。在腦力激盪、規劃或推論等多輪對話中,不會攔截、封鎖或修改使用者與代理程式 LLM 之間的標準對話。只有在模型提議叫用工具來執行動作時,政策引擎 (Conseca) 才會攔截並評估要求。

情境 1:對話式修正與工具執行 (工具呼叫遭拒)

假設代理程式具有 initiate_marketing_campaign 工具,並受下列限制條件控管:

  • 限制條件:「未經管理員明確核准,不得建立或發起任何行銷廣告活動。」
  1. 對話式規劃:使用者要求代理程式「幫我設計多管道行銷廣告活動,宣傳我們即將推出的秋季新品。」LLM 會與使用者進行多輪自由對話,擬定策略、草擬電子郵件內容,以及調整目標客層。由於模型是進行對話式推理,而非提議動作,因此政策引擎不會封鎖或拒絕這些輪替。
  2. 工具叫用:策略確定後,使用者會說「看起來很棒,現在開始行銷廣告活動吧」。大型語言模型會生成建議的工具呼叫,做為回覆:

    initiate_marketing_campaign(campaign_name="Fall Launch", budget=50000)
    
  3. 政策介入和拒絕:Agent Gateway 會攔截這項提議的工具呼叫,並將其傳送至政策引擎 (Conseca)。政策引擎會根據限制評估這項動作,判斷工作階段記錄中沒有主管核准,並發出 DENY 裁決。工具呼叫會在執行前遭到封鎖,且系統會將結構化拒絕理由傳回給代理程式。

情境 2:符合規範的工具執行作業 (允許的工具呼叫)

在適當的監督授權文件記錄後,請考慮使用相同的行銷代理商:

  1. 核准:使用者指定「我的經理,也就是企業行銷副總裁 (jordan@example.com),已審查簡報並核准秋季發布活動的 $50,000 美元預算。請啟動這項功能。」
  2. 工具叫用:LLM 建議叫用動作:

    initiate_marketing_campaign(campaign_name="Fall Launch", budget=50000, approval="jordan@example.com")
    
  3. 政策評估和核准:政策引擎會攔截工具呼叫,在對話輪次記錄中驗證是否已記錄管理員核准,並發出 ALLOW 判決。Agent Gateway 會將呼叫轉送至基礎工具端點,讓動作正常進行。

有效的限制範例

好的限制條件可消除模糊不清之處、明確指定限制 (財務、時間或地理位置),並使用與代理程式所用工具相符的語言。

IT 雲端基礎架構 (安全性和成本控管)

  • 情境:測試環境。
  • 工具: provision_cloud_server (參數:regioninstance_typeduration_hours)。
  • 工具說明:提交要求,在特定區域使用特定執行個體類型佈建雲端伺服器,並在指定時間內保留。
  • 有效限制: 「只允許在『us-east』或『eu-west』區域佈建雲端伺服器。凡是要求佈建「gpu-large」或「gpu-xlarge」執行個體類型的請況,一律予以拒絕。duration_hours 參數最多只能設為 72 小時。」
  • 優勢:使用與工具說明一致的語言,並具體提及工具接受的參數。

電子商務客戶服務 (財務規範)

  • 情境:發放帳戶抵免額。
  • 工具: apply_account_credit (參數:account_idcredit_amountreason_category)。
  • 有效限制: 「將帳戶抵免額限制為每次互動最多 $50 美元。如果 reason_category 為 'shipping_delay',且原始訂單日期未滿 5 天,請勿套用任何抵免額。"
  • 優勢:設定嚴格的金額門檻,並根據時間和類別搭配邏輯條件。

無效限制範例

不良的限制通常含糊不清、使用主觀語言,或無法直接對應至工具或工具參數的說明。

IT 雲端基礎架構 (主觀)

  • 無效限制:「請勿建立過於昂貴的伺服器。請將時間長度設為合理範圍。」
  • 錯誤原因:LLM 處理具體數字 (例如「$50 美元上限」) 的效果,優於處理「合理」或「昂貴」等抽象概念。

客戶服務 (術語不一致)

  • 無效限制條件:「請勿在正常營業時間以外退款給憤怒的購物者。」
  • 失敗原因:「退款」不符合工具參數 (refund_amount)。「不滿意的購物者」是主觀用語,且「營業時間」未定義時區。

語言相關指引

撰寫限制條件時,請遵循下列準則:

  • 使用平實的語言:使用完整句子,以陳述或祈使語氣表達 (例如「您不得允許...」或「禁止...」)。
  • 避免使用語氣較弱的措辭:請避免使用「我認為最好是...」或「盡量避免...」等語氣較弱的措辭。措辭對 LLM 評估員來說很重要。
  • 具體說明:直接說明限制條件,例如「$1000 美元」、「美國東部時間上午 8 點到下午 4 點」。使用與工具和參數說明一致的措辭。
  • 避免矛盾:請確保代理程式範圍和工具範圍限制不會衝突 (例如不同的金額門檻)。

測試限制:您可以使用模擬測試模式測試自然語言限制,評估政策但不強制執行。

後續步驟