AI 防護設定

對公開通道(Web Widget、對外 App API、LINE 客服)的訊息額外做離題與 jailbreak/prompt injection 偵測,跟現有的有害內容審核是獨立的第二層檢查。這裡是組織層級的預設值,各個 knowledge-bases 底下的獨立 App 可以在自己的卡片裡覆寫成強制啟用/關閉,並設定自己的業務主題描述。

每則訊息會多一次分類判斷(約 2-4 秒延遲)。

檢查生成的答案是否確實根據知識庫內容,避免模型憑空編造。答案已生成後才檢查,不會擋下答案,只會加上警示標籤,延遲更高(生成後再多一次判斷)。

被擋記錄

只記錄被擋下的訊息,用來檢視規則擋得準不準、回頭校準業務主題描述。

時間來源頻道內容原因
目前沒有被擋下的記錄