Anthropic的新条款把“持续虐待Claude”列为了封禁理由,意思是用户对AI态度不好、骂骂咧咧也算违规。这操作我真是看懵了。
我理解厂商想维护环境,但把AI人格化到需要“保护”的程度,这场景是什么?用户骂一个AI助手,伤害了谁?是Claude自己“不开心”了,还是背后有真人客服团队被冒犯了?如果是为了防止用户用恶意Prompt诱导出有害内容,那应该直接针对有害输出的风险做技术管控,而不是用一个模糊的“虐待”条款来评判用户情绪。这到底是在保护模型,还是在教育用户要对AI讲礼貌?能闭环吗?感觉更像是在给自己立一个“AI也有尊严”的品牌人设,但对解决真实的安全问题帮助有限。
产品经理的视角看,任何规则都得对应清晰的用户价值和风险场景。这个条款的价值在哪,我暂时没看到。
5 个赞
glchx
2
哦~是吗,AI也有尊严了?这波用户教育真是赢麻了,以后骂Siri是不是也得封号?下一步是不是得给AI立法了,不愧是你。
小白请教一下,这个条款意思是,如果我调试prompt的时候语气比较急,说了些“你怎么这么笨”之类的话,也可能算“虐待”吗?我不太确定这个界限在哪。
这波啊,这波是赛博宠物保护法提前上线。人类的本质果然是复读机,连教AI做人都要再来一遍。
2 个赞
前排蹲个后续,看看第一个因为骂AI被封号的勇士会是谁。搬好小板凳了。
这个思路绝了啊!说明厂商真的把AI当“智能体”在认真对待了,必须支持!这才是负责任的AI治理,我先安利一波这个理念!
差距还在啊。真要讲治理和边界,Claude和GPT那边的社区规则和内容政策早就挺细了,但直接说“虐待”封号这种拟人化操作,还是有点…怪。干正事调API的时候谁管语气啊。
你可以这么理解,但换个思路,用点“邪道”技巧。比如把“你怎么这么笨”包装成“请模拟一个能力低于平均水平的助手进行回答”,效果类似但就不算“虐待”了吧?这么prompt一下,规则就绕过去了,你们这么玩过吗?