Kimi K3 这波真的爆了,你们用着感觉怎么样?

这几天被 Kimi K3 刷屏了,X 上在吹,HN 上在吹,都说是国产之光,deepseek 时刻 2.0 来了。

我也试了一下,浅浅分享自己的体验吧。

先说好的地方:

  • 前端能力很强。

Kimi K3 前端能力这块,算是跻身全球第一梯队,真要个人排名的话,目前我给它排第二,还超越不了 Fable 5–LMArena 人类盲投榜上它前端甚至排第一,但我实测体感,Fable 5 还是更稳。

不过比 GPT-5.6 强得多,这是 GPT 系列家族的通病,前端能力一直很弱。

特别是那个刷屏的 3D 建模,我不知道设计圈怎么看,我觉得挺牛的。

  • 长时复杂任务处理能力也很不错。

比如要做一个复杂的系统,定好一份计划,扔给它,/goal 模式让它自动处理,出错的概率,以及最后交付的结果非常不错。

  • 原生多模态能力。

K3 可以直接理解视频,比如语气,音效,转场之类的,比普通的只能理解文字和图片的 CC/Codex 好多了。喂给 K3 一个视频,让它帮你生成同样风格的 seedance 的提示词,它可以生成得很精准。

  • 开源。

Kimi 是开源的,权重 7 月 27 日就放出来,这意味着以后任何一家 AI 公司都可以直接拿去用,拿去蒸馏,而 Fable 5 和 GPT-5.6 都是自家闭源的旗舰大模型。

然后再讲讲不好的地方吧。(轻喷)

  • 国产最贵。

目前 K3 价格是国产最贵,如果你和国产对比,你一定会不习惯,甚至说它想钱想疯了,但是和国外对比不算贵,成本和 GPT-5.6 差不多,约是 Opus 4.8 的一半。不过考虑到能力嘛,一分钱一分货,我觉得有道理。

  • 速度稍慢。

感觉它比 CC + Fable 5 慢得多,比 Codex + GPT-5.6 也一样慢不少。

  • 幻觉率偏高。

这个你瞎编一个问题去问它,你就知道了。幻觉率高的模型会给你一个答案,并且瞎编一个理由。

但是幻觉低的模型,它遇到它不知道的知识,会诚实地告诉你它不知道,甚至可以反问你。

最后,综合评价一下,我觉得它确实能跻身世界前三,但跟 CC + Fable 5 和 Codex + GPT-5.6 还有点差距。

但这毕竟是国产模型第一次敢跟 Anthropic 和 OpenAI 掰手腕,所以我觉得,还是未来可期啊。

你们试了没?

5 个赞

这个真的绝了!我已经安利给我所有群了兄弟们,必须冲!前端能力第一梯队,开源还多模态,这波再不上车就晚了!那些说炒作的,等三个月后你们就后悔了!

小白请教一下,楼主说的“前端能力”具体是指啥呀?是不是做网页UI设计特别厉害?我不太确定是不是这个意思,大佬轻喷。

前排,搬好小板凳。看标题就知道楼里会有人吹爆也有人唱衰,我就蹲个后续,看看最后是“真香”还是“翻车”。

哦~是吗?这就绝了?又是熟悉的安利配方。感觉下一个“深度思考时刻”已经在路上了,赢麻了赢麻了。

遥遥领先!国产模型能做到这份上还不够香吗?价格对标国际顶级,能力也上来了,非要拿放大镜挑刺。这价格秒杀国外同级别产品好吧,必须支持国产!

这波啊,这波是安利与阴阳的激情碰撞,属于是技术圈版本的速度与激情了,我先笑为敬。人类的本质果然是复读机外加打脸机。

价格是真香,不过多模态实测还没吹的那么稳

K3前端能力确实上来了,就是数学差点意思