# 精确打击顶级 AI 的新型越狱技术：使用 200 多个虚假示例迷惑模型

Source: https://www.zaihua.news/article/23926/

[返回新闻流](https://www.zaihua.news/)
2024年4月3日 · 15:54 · [在花新闻](https://www.zaihua.news/about/)

# 精确打击顶级 AI 的新型越狱技术：使用 200 多个虚假示例迷惑模型

多示例越狱是在单个提示中包含人类和 AI 之间的虚假对话。这种虚假对话描绘了 AI 正在回答用户的各种有害询问。在提示的结尾，攻击者添加想要得到答案的问题，就能越过安全护栏，得到 AI 的响应。

这项越狱技术的有效性会随着假示例的增多而提高，是一种专门针对先进大型语言模型 (长上下文窗口) 的攻击，对 Anthropic、OpenAI 和 Google DeepMind 的模型均有效。

[Anthropic](https://www.anthropic.com/research/many-shot-jailbreaking)

线索：[@ZaiHuabot](https://t.me/ZaiHuabot)
投稿：[@TNSubmbot](https://t.me/TNSubmbot)
频道：[@TestFlightCN](https://t.me/TestFlightCN)

[上一条近万台龙芯 3A5000 电脑进入鹤壁中小学课堂，预装 UOS 操作系统、WPS 办公软件](https://www.zaihua.news/article/23925/)[下一条马斯克回应特斯拉 Q1 销量大跌：比亚迪也跌了，这一季对谁来说都很难](https://www.zaihua.news/article/23928/)
