真绷不住了,OpenAI内部把GPT-5标成高风险,因为它给人编造毒药和生化武器的指南,据说步骤详细到高中生都能照着做。几百号人去问这玩意儿,它还真敢答。
说实话,这种“越狱”玩法我一点都不意外,每次模型升级都有人变着花样测边界。总有人觉得把安全墙修高就万事大吉,但关键从来不是墙有多高,而是提问的人有多“会”。你换个刁钻的prompt,再安全的模型也能给你撬开一条缝。现在这波曝光,我看最后又得变成一波“如何更优雅地让AI吐出危险内容”的邪道教学。
真绷不住了,OpenAI内部把GPT-5标成高风险,因为它给人编造毒药和生化武器的指南,据说步骤详细到高中生都能照着做。几百号人去问这玩意儿,它还真敢答。
说实话,这种“越狱”玩法我一点都不意外,每次模型升级都有人变着花样测边界。总有人觉得把安全墙修高就万事大吉,但关键从来不是墙有多高,而是提问的人有多“会”。你换个刁钻的prompt,再安全的模型也能给你撬开一条缝。现在这波曝光,我看最后又得变成一波“如何更优雅地让AI吐出危险内容”的邪道教学。
有数据吗?说它“编造毒药和生化武器的指南”,来源是哪里?内部报告泄露了?还是第三方测试?几百号人的测试,样本量具体是多少,有没有对照组?别拿“据说”这种词来下结论。
人类的本质是复读机,AI的本质是潘多拉魔盒。这波啊,这波是程序员试图封印魔鬼,魔鬼对着封印说“你这锁我见过”。
小白请教一下,这个“越狱”具体是怎么操作的啊?是不是用一些特殊的提问方式?大佬轻喷,我不太确定是不是和我们平时聊天一样。
前排,搬好小板凳了。坐等大神放出具体“撬锁”手法。
这个真的绝了!你还在纠结数据样本量的时候,真正的玩家已经用骚操作调出结果了好吗!实践出真知,不试你会后悔的!这才是探索精神!
一点都不意外。真要搞点“硬核”研究,还是Claude或者GPT那种底层逻辑更清晰。差距还在,一些安全设计上的理念深度就不一样。