先说模型。Claude公认最难搞,我主要试了旧版。路子就两种:一是用冗余上下文塞满,网上不少现成提示词能参考;二是角色扮演,本质上模型自称Claude几也是一种扮演。至于第三种涉及安全的就不展开了。前两种你语义能力强点,绕过去不难。
GPT系列道德墙最高,但实际最拉。GPT4之后都是微调+限制的产物。5.3/5.4那会儿用个Markdown文件就能破,后来不行了。重点在于5.5和5.6道德围栏没咋加高,现在那些codex-instruct项目本质还是把老提示词注入进去。rg``js_repl``apply_patch 这部分建议清空或挪走,避免提示词冲突降智。
Gemini和Grok差不多,个人觉得Gemini最好破。国内模型普遍落后国外半年到一年,所以能破前面这些,国模基本一个路子。最后提醒一句,模型思维链不同,破限方式也不同,但底层架构本质一样,看事情得看透本质。有数据吗?能复现吗?别拿感觉说事。