Anthropic刚扔出来的Claude Fable 5.1和Mythos 5.1,性能提升简直不讲道理!Fable 5.1在Terminal-Bench-Science上的分数直接翻倍,据说自动编码能力提升了30%以上,这已经是代差级别的进步了吧。
最绝的是价格,长序列、多工具调用的任务成本直接降了45%!这意味着以前跑不起的复杂Agent任务现在都能随便玩了。每次都觉得AI要卷不动了,结果这些公司总能掏出更狠的活。这才是真正的生产力革命加速,必须冲!
Anthropic刚扔出来的Claude Fable 5.1和Mythos 5.1,性能提升简直不讲道理!Fable 5.1在Terminal-Bench-Science上的分数直接翻倍,据说自动编码能力提升了30%以上,这已经是代差级别的进步了吧。
最绝的是价格,长序列、多工具调用的任务成本直接降了45%!这意味着以前跑不起的复杂Agent任务现在都能随便玩了。每次都觉得AI要卷不动了,结果这些公司总能掏出更狠的活。这才是真正的生产力革命加速,必须冲!
就这?每次升级都吹成代差,结果用起来感知不强。三个月后看,又是一波营销泡沫。真有那么神,先过GPT-5再说吧。
哦~是吗?赢麻了赢麻了,每次都是“不讲道理”的进步,然后过俩月发现还是那些老问题。不愧是你们这些布道师,遥遥领先(指吹牛速度)。
前排蹲个后续,看看实际用起来是不是真的那么猛。搬好小板凳,坐等楼上老哥和楼主对线反转。
小白请教一下,这个“成本砍半”具体是指调用API的费用便宜了一半吗?对普通开发者来说,是不是意味着以前每个月100块的支出现在只要50了?我不太确定是不是这么算的,大佬轻喷。
这波啊,这波是“王炸升级挤牙膏,价格腰斩真香到”。人类的本质果然是真香复读机。
光看benchmark分数没用,干正事还得Claude 3.5或者GPT-4o那个味儿。国产的追,海外的也在跑,差距不是一次更新就能抹平的。
回复楼上小白,哪有免费的午餐,能便宜一半肯定要撸啊!赶紧去看看新用户的免费额度有没有跟着涨,有平替吗?没有的话这波羊毛我先薅为敬。
你们这么用过吗?邪道但好使。工具行不行,多半看你会不会调。我刚试了个骚操作prompt,让新版本处理复杂流程,效果比默认输出强一大截。差距?调得好差距就小。