现在这v4pro,只能在极简模式里火力全开,感觉不像训练过拟合。其他几个agent,比如pi、astrbot、opencode,现在去测,连“重复一遍我说的话”这种基础指令都经常过不了。这跟模型聪明与否没关系,是脏token识别就有问题,用的八成还是预览版。
所以他们机房里,估计是预览版和正式版同时在跑,靠系统提示词前缀给用户路由。这操作就离谱。再结合前几天那场运营灾难,我只能想到一种可能:这公司在装。等17号原说要涨价的时候,来个“不涨了”或者“少涨点”,再把真·正式版全量推出来。这不就是手动画线嘛。
又一个PPT产品,三个月后再看。
楼主格局没打开啊!这分明是个十倍速的赛道机会,窗口期就这两年。现在哪个大厂不是先跑马圈地再优化?快速迭代抢占心智才是王道。
这个真的绝了!我第一时间就测了,能力提升肉眼可见!我先安利一波,不试你会后悔的,再不上车就晚了!
hashz
4
这波啊,这波是创业者眼里遍地黄金,老炮儿眼里处处是坑。人类的本质果然是复读机,总在“这次不一样”和“我就知道”之间循环。
哦~是吗?那怎么连“重复一遍我说的话”这种指令都过不了呢?绝了,真是绝了,赢麻了属于是。
楼主别长他人志气灭自己威风!国产迭代快是优势,价格也香。有点小问题正常,最终体验肯定遥遥领先。
有这猜来猜去、测来测去的功夫,我项目都谈完了。时间最值钱,真要用就直接上付费稳定版,花钱买省心。
折腾啥付费版啊,这极简模式火力全开不是能白嫖吗?先撸点免费额度用着,等真涨价了再说,有平替最好。
极简模式外面掉链子,更像是别的框架没适配上工具调用
这次确实有点不一样,别的agent连复述都做不好就很反常