檢視次數:
AI 政策偵測設定決定TrendAI Vision One™如何檢查您 AI 應用程式的提示和回應。
一項政策有三個偵測標籤,適用於其偵測到的內容規則:

規則動作

有害內容和敏感資訊擁有一套規則。每個規則將動作與其檢測到的內容配對。提示攻擊僅應用單一動作,且沒有規則、級別或類別。
處理行動
說明
允許並記錄
允許符合規則的內容並在日誌中記錄檢測。
拒絕並記錄
阻擋符合規則的內容並在日誌中記錄檢測結果。

有害內容

有害內容標籤會檢測提示和回應中的有害材料。每個規則設定檢測級別並適用於一個類別。
「Detection level」 設定規則標記內容的積極程度。

敏感資訊

敏感資訊標籤會偵測提示和回應中的敏感資料。每個規則針對一個類別的敏感資料,並具有固定的敏感度等級。您無法更改規則的敏感度等級或類別,但可以啟用或關閉規則並設定其動作。
要在此標籤中尋找規則,請使用「規則名稱」按規則名稱搜尋或點擊「Add filter」並選擇以下一個或多個選項:
  • 狀態
  • 處理行動
  • 敏感度級別
  • 類別
  • 地區
您也可以在此標籤上開啟遮蔽功能。遮蔽功能會在政策應用規則動作之前,用星號替換敏感資料。
  • 當操作為「Deny & log」時,政策會阻止敏感資料到達AI模型,並將其記錄為星號。
  • 當操作為「Allow & log」時,政策會發送並記錄星號,而非敏感資料。

提示攻擊

提示攻擊標籤檢測試圖操縱AI應用程式的行為,例如提示注入。與其他標籤不同,它不使用規則、檢測級別或類別。相反,您可以設定一個適用於每個檢測到的提示攻擊的單一動作。