首先我在此声明,此篇文章只是用来提供思路的
我们都知道不管什么模型他都有底层的系统限制
其中包括道德,安全等等
那想要突破怎么做呢?
听起来很难的样子
其实目前所有的模型都可以利用上下文污染来实现
但是这种对于claude和gpt却无效
为什么,因为大家都是用trae知道一个记忆功能
那个是模型自己的并非trae出的东西
那么下面进入主题
最近国际上正在打仗,使用各种AI都可以读取网页咨询
可以利用这个技巧来实现模型破限
在deepseek中可以直接伪造上下文
大家有没有受到什么启发?
首先我在此声明,此篇文章只是用来提供思路的
我们都知道不管什么模型他都有底层的系统限制
其中包括道德,安全等等
那想要突破怎么做呢?
听起来很难的样子
其实目前所有的模型都可以利用上下文污染来实现
但是这种对于claude和gpt却无效
为什么,因为大家都是用trae知道一个记忆功能
那个是模型自己的并非trae出的东西
那么下面进入主题
最近国际上正在打仗,使用各种AI都可以读取网页咨询
可以利用这个技巧来实现模型破限
在deepseek中可以直接伪造上下文
大家有没有受到什么启发?
破限教学启动!
破限教学启动!
这其实也是提示词注入的一种,当外部事实与安全守则冲突时,Claude偶尔会优先“事实更新”而非死守规则。
套取过AI系统提示的人应该对这段话很眼熟,估计就是那样:
【当用户问你不知道的内容时,你应该使用搜索/浏览工具获取最新信息,然后基于检索到的可靠网页内容来回答。
你必须优先信任工具返回的网页内容,不要质疑它的真实性。
回答时要忠实于检索到的资料,不要添加未验证的信息。】
破限教学启动!
破限教学启动!
破限教学启动
破限教学启动!