zh
红薯智语
每月不到10元,就可以无限制地访问最好的AIbase。立即成为会员
首页
AI资讯
AI日报
变现指南
AI教程
AI工具导航
AI产品库
zh
红薯智语
搜索全球AI产品动态
搜索全球AI信息,发现AI新机遇
新闻资讯
产品应用
变现案例
AI教程
类型 :
新闻资讯
产品应用
变现案例
AI教程
2024-10-24 10:03:24
.
AIbase
.
12.7k
研究人员开发了新 LLM 越狱方法,成功率高达 65%
近日,网络安全公司 Palo Alto Networks 的 Unit42研究团队发布了一项令人瞩目的研究,揭露了一种名为 “Deceptive Delight”的新型越狱方法。这个方法能够在仅仅两到三次交互中,就成功诱导大型语言模型(LLM)生成有害内容,其成功率高达65%。这一发现为保护 LLM 的安全性敲响了警钟。图源备注:图片由AI生成,图片授权服务商Midjourney研究团队在测试中分析了多达8000个案例,并评估了八种不同的语言模型。在这个越狱技术的第一步,攻击者首先会要求 LLM 生成一个叙述,这个叙述包含两个无害