越獄攻擊 Jailbreaking 一種對大型語言模型或其他 AI 系統的攻擊方法,通過巧妙地設計輸入提示詞或利用模型的漏洞,繞過系統的安全防護和內容政策限制,使模型生成原本應該被阻止的內容,如有害建議、違法信息或有成見的輸出。 AI倫理與治理大型語言模型Prompt工程 越獄攻擊 是什麼?→