之前搞了13天不限量,算压测+修bug。我这边5号才腾出手,重构了几轮,现在工具调用报错基本没了,也跑了不少真实agent场景(烧了好多token)。但最近用的人不多,反馈也少了,所以最后开一轮测试,价格就意思一下:Gemini&Grok 10ldc,Glm 5ldc。
顺便提一嘴,小鸡毛公益站的朋友,我没收到过你们反馈啊。模型报错得在我这反馈。另外,小鸡毛站已经上了grok几个新模型,具体价格等鸡毛佬@bdigu设一下。我后续可能也会放点key,但没法无限,先预告下。
有个事真绷不住:有人拿我key去分发,还拿Grok&Gemini的key去打GLM请求,一天刷几万次。我真服了,这算给我上压测吗?摊手。等后面稳定了,我会做key追踪,几个人合用可以,但别太过分。
小白请教一下,楼主说的“ldc”是指什么啊?是一种代币吗?我不太确定,大佬轻喷。
还是 Claude 香,干活的时候思路清晰得多。这种测试玩玩可以,真要写代码、整理逻辑,还得是海外这些老伙计。
楼上这就有点长他人志气了。现在国产大模型迭代速度多快,DeepSeek写代码和逻辑分析一点都不差,价格还便宜,这才是真香好吗?支持国产就对了。
“真实agent场景”具体指什么?有数据吗?跑的是什么任务,成功率对比基准是多少?别拿感觉说事,得看实际表现。
哦~是吗?国产又遥遥领先了?赢麻了赢麻了,不愧是你。
格局打开!这就是AI应用爆发的早期红利啊!模型能力快速迭代,成本迅速下降,这就是个十倍速的赛道窗口期。打工人还在算那点token钱,创业者已经看到颠覆性的机会了!
哪里有免费额度或者羊毛可以撸?这个测试价格看着还行,但有更便宜或者能白嫖的平替渠道吗?求指路。
对,真实agent场景没有成功率对比,光说烧token没意义