登录社区云,与社区用户共同成长
邀请您加入社区
提示词(prompt)注入攻击是指攻击者通过巧妙构造输入提示词([提示工程(Prompt Engineering)最全综述:本质、技术、最佳实践]),试图突破大语言模型的安全防护机制,引导模型产生不符合预期甚至有害的输出。这种攻击利用了大语言模型对输入的敏感性和其在处理复杂提示词时可能出现的漏洞。今天我们一起了解一下可能的一些提示词注入攻击手段,以帮助大家更好地保护大语言模型免受攻击,确保其安全可