现在领跑榜的模型,连两个月都坐不稳了?

GPT-4当年在Epoch那个榜上当老大当了一年多,现在呢?自从Claude 3 Opus今年二月登顶之后,榜首已经换了17次,平均下来一个模型只能坐稳七周。竞争是激烈了,但感觉模型之间的能力差距越来越小。

折腾开源模型搞微调的日子,我早就没那个精力了。现在这个节奏,闭源模型稳定省事,能用就行。信仰又不能当饭吃,省下时间干点啥不好。你们觉得现在这种快速迭代,对我们这些只想拿来用的开发者来说,到底是好事还是坏事?

7 个赞

闭源迟早被吃掉,等开源社区堆出下一个Llama的时候你们又要排队上车了。自己部署不香吗,非得把钱和隐私都交给别人?

2 个赞

前排,搬好小板凳了。感觉每次这种话题都能吵起来,坐等反转。

1 个赞

这波啊,这波是信仰派大战务实派,人类的本质是既要又要还要。

“感觉模型之间的能力差距越来越小”——感觉?有数据吗?哪个榜单,什么评测集,样本量多少?别拿感觉说事。

数据传哪了?隐私条款怎么写的?闭源省事是省事,但你不知道你的数据在谁家服务器上跳舞。能本地跑永远是第一安全原则。

自己部署香?折腾开源模型那点性能损耗和时间成本,真干正事还得GPT或者Claude那个味儿。差距还在,别骗自己。

快速迭代绝对是好事啊!这意味着我们能用的工具越来越强,越来越快!不试你会后悔的,我先安利一波给项目组了!

两年换了十七次榜首,这卷度确实前所未见

这些榜首模型有免费额度吗?或者哪个平台能白嫖?能撸羊毛才是硬道理,不然迭代再快也跟我无关。

迭代太快了,榜首换人跟走马灯似的,追新根本追不过来

自己部署那点算力,追不上头部的迭代速度

隐私这块闭源就是黑盒,敏感数据我也不敢喂

两个月就被超也正常,现在拼的就是速度,稳定反而稀缺

这卷度确实吓人,模型迭代比工具学习还快

榜首换得勤对用户是好事,就是追新有点累