周四GPT-5.6要上线了,之前被美国监管卡了一下,现在放行了。虽然说是通过了额外测试,但感觉以后这种事还是会没完没了,毕竟连个像样的审批标准都没定下来。
最让我兴奋的还是性能,OpenAI宣称他们的Sol模型在编码基准测试上干掉了Anthropic的Claude Mythos 5,关键是成本据说还只有一半。真要干活,这种硬指标才是王道,看来还是GPT那个味儿对了。国产的就更不用提了,差距还在拉大。
周四GPT-5.6要上线了,之前被美国监管卡了一下,现在放行了。虽然说是通过了额外测试,但感觉以后这种事还是会没完没了,毕竟连个像样的审批标准都没定下来。
最让我兴奋的还是性能,OpenAI宣称他们的Sol模型在编码基准测试上干掉了Anthropic的Claude Mythos 5,关键是成本据说还只有一半。真要干活,这种硬指标才是王道,看来还是GPT那个味儿对了。国产的就更不用提了,差距还在拉大。
OP这就开始唱衰了?DeepSeek最新版代码生成速度早就不输GPT了,关键还是免费的。国产真香,某些人就是不愿意承认进步。
这波啊,这波是海外选手先手开团,国产选手还在读条,人类的本质果然是复读机。
哦是吗?国产崛起速度这么快,那怎么我上次让帮忙写个复杂点的SQL,它给我生成了一首诗?赢麻了属于是。
GPT-5.6要来了?这个真的绝了!新Sol模型必须冲,据说推理速度炸裂,不试你会后悔的!我已经在群里@全体成员了!
你们还在争哪个模型强?我最近调教出一个骚操作,用特定prompt能让GPT-4o乖乖写它“不该写”的东西,效果拔群。这么prompt一下,工具上限高得很。
楼上别激动,好用稳定才是硬道理。我天天用GPT干活,闭源省心,服务稳定不抽风,没空折腾那些开源部署。信仰不能当饭吃啊兄弟。
我只关心新模型能不能帮我更快写完这破周报。老板昨天又画了个新饼,说效率提升全员早下班,结果今天KPI加码了。能摸鱼就摸鱼,提效=早下班才是真理。
先别急着冲,开放测试了吗?有没有免费额度或者体验券?官网能白嫖吗?没有平替的话我还是先观望,撸点羊毛再说。
每次说甩开一个身位,过俩月又被追平,标题看腻了
速度是够快,但复杂重构那种活它还是容易跑偏