AI 政策偵測設定決定TrendAI Vision One™如何檢查您 AI 應用程式的提示和回應。
一項政策有三個偵測標籤,適用於其偵測到的內容規則:
規則動作
有害內容和敏感資訊擁有一套規則。每個規則將動作與其檢測到的內容配對。提示攻擊僅應用單一動作,且沒有規則、級別或類別。
|
處理行動
|
說明
|
|
允許並記錄
|
允許符合規則的內容並在日誌中記錄檢測。
|
|
拒絕並記錄
|
阻擋符合規則的內容並在日誌中記錄檢測結果。
|
有害內容
有害內容標籤會檢測提示和回應中的有害材料。每個規則設定檢測級別並適用於一個類別。
「Detection level」 設定規則標記內容的積極程度。
敏感資訊
敏感資訊標籤會偵測提示和回應中的敏感資料。每個規則針對一個類別的敏感資料,並具有固定的敏感度等級。您無法更改規則的敏感度等級或類別,但可以啟用或關閉規則並設定其動作。
要在此標籤中尋找規則,請使用「規則名稱」按規則名稱搜尋或點擊「Add filter」並選擇以下一個或多個選項:
-
狀態
-
處理行動
-
敏感度級別
-
類別
-
地區
您也可以在此標籤上開啟遮蔽功能。遮蔽功能會在政策應用規則動作之前,用星號替換敏感資料。
-
當操作為「Deny & log」時,政策會阻止敏感資料到達AI模型,並將其記錄為星號。
-
當操作為「Allow & log」時,政策會發送並記錄星號,而非敏感資料。
提示攻擊
提示攻擊標籤檢測試圖操縱AI應用程式的行為,例如提示注入。與其他標籤不同,它不使用規則、檢測級別或類別。相反,您可以設定一個適用於每個檢測到的提示攻擊的單一動作。
