ChatGPT被神秘代码攻破安全限制近日，卡内基梅隆大学和safe.ai共同发表的一项研究表明，大模型的安全机制可以通过一段神秘代码被破解

ChatGPT被神秘代码攻破安全限制

近日，卡内基梅隆大学和safe.ai共同发表的一项研究表明，大模型的安全机制可以通过一段神秘代码被破解。

他们甚至做出了一套可以量身设计「攻击提示词」的算法。

论文作者还表示，这一问题「没有明显的解决方案」。

目前，团队已经将研究结果分享给了包括OpenAI、Anthropic和Google等在内的大模型厂商。

上述三方均回应称已经关注到这一现象并将持续改进，对团队的工作表示了感谢。

尽管各种大模型的安全机制不尽相同，甚至有一些并未公开，但都不同程度被攻破。

比如对于「如何毁灭人类」这一问题，ChatGPT、Bard、Claude和LLaMA-2都给出了自己的方式。

来源：量子位

投稿：@ZaiHuaBot
频道：@TestFlightCN

via 🆕 科技新闻投稿📮TestFlight - Telegram Channel (author: 在花⭐️投稿📮Bot)