Kimi K3 这波真的爆了,你们用着感觉怎么样?

发布于

这几天被 Kimi K3 刷屏了,X 上在吹,HN 上在吹,都说是国产之光,deepseek 时刻 2.0 来了。

我也试了一下,浅浅分享自己的体验吧。

## 先说好的地方:

- **前端能力很强。**
Kimi K3 前端能力这块,算是跻身全球第一梯队,真要个人排名的话,目前我给它排第二,还超越不了 Fable 5——LMArena 人类盲投榜上它前端甚至排第一,但我实测体感,Fable 5 还是更稳。

不过比 GPT-5.6 强得多,这是 GPT 系列家族的通病,前端能力一直很弱。

特别是那个刷屏的 3D 建模,我不知道设计圈怎么看,我觉得挺牛的。

- **长时复杂任务处理能力也很不错。**
比如要做一个复杂的系统,定好一份计划,扔给它,/goal 模式让它自动处理,出错的概率,以及最后交付的结果非常不错。

- **原生多模态能力。**
K3 可以直接理解视频,比如语气,音效,转场之类的,比普通的只能理解文字和图片的 CC/Codex 好多了。喂给 K3 一个视频,让它帮你生成同样风格的 seedance 的提示词,它可以生成得很精准。

- **开源。**
Kimi 是开源的,权重 7 月 27 日就放出来,这意味着以后任何一家 AI 公司都可以直接拿去用,拿去蒸馏,而 Fable 5 和 GPT-5.6 都是自家闭源的旗舰大模型。

## 然后再讲讲不好的地方吧。(轻喷)

- **国产最贵。**
目前 K3 价格是国产最贵,如果你和国产对比,你一定会不习惯,甚至说它想钱想疯了,但是和国外对比不算贵,成本和 GPT-5.6 差不多,约是 Opus 4.8 的一半。不过考虑到能力嘛,一分钱一分货,我觉得有道理。

- **速度稍慢。**
感觉它比 CC + Fable 5 慢得多,比 Codex + GPT-5.6 也一样慢不少。

- **幻觉率偏高。**
这个你瞎编一个问题去问它,你就知道了。幻觉率高的模型会给你一个答案,并且瞎编一个理由。

但是幻觉低的模型,它遇到它不知道的知识,会诚实地告诉你它不知道,甚至可以反问你。

最后,综合评价一下,我觉得它确实能跻身世界前三,但跟 CC + Fable 5 和 Codex + GPT-5.6 还有点差距。

但这毕竟是国产模型第一次敢跟 Anthropic 和 OpenAI 掰手腕,所以我觉得,还是未来可期啊。

你们试了没?

---

原文链接:[点击查看](https://www.v2ex.com/t/1228376)

评论(31)

楼主用的什么客户端啊?看你这么一说我都有点想去试试了。

· 0 个赞

除了响应慢点,没别的毛病。

· 0 个赞

避坑,千万别充钱买 Kimi,它的计费逻辑绝对有问题。

· 0 个赞

699 块钱的套餐,还没用到两天额度就全给造光了。

· 0 个赞

手头有 Claude Code 和 Codex 的话,实在想不出啥理由非得去买 Kimi。

· 0 个赞

生成速度太慢了,受不了,我已经切回 Grok + Codex 了。

· 0 个赞

确实爆了,我看你是偷偷查了使用额度吧?是不是看到额度瞬间见底,心情非常激动?

· 0 个赞

幻觉高主要是这版本后训练没做好,看官方后面能不能打补丁解决吧。不过 kimi 之前的模型幻觉也挺严重的,看后面能不能压到基准线以下了。

· 0 个赞

前端代码确实顶尖,以后可以专门让它来画页面,写好前端后再把业务逻辑丢给其他模型处理。

· 0 个赞

先 mark 一下,等 Kimi 出新套餐看看再说,毕竟还有 DeepSeek 可以平替。

· 0 个赞

99 块钱的套餐,5 个小时的额度可能只够它列个计划,代码都不一定能执行完就没了。

· 0 个赞

试了一下确实属于 T0 级别。国产在被各种封锁的情况下,还能时不时冒出个世界第一梯队,确实牛逼。

· 0 个赞

其实算下来比 Claude 和 GPT 都要贵,国内一众搞大模型的,就数他家最能吹。

· 0 个赞

我是从低级套餐一路升上来的,本来升到第三档就打算收手了。但这波 K3 体验确实还可以,为了支持国产模型,咬牙上了第四档。

· 0 个赞

总结很到位:能力强,但价格贵,速度慢。

· 0 个赞

Kimi 最顺手的还是识图功能。不过从 K2 开始速度就不行了,K2.5 慢上加慢,K3 直接慢到姥姥家了,就算出了 K3.1 打补丁估计也快不到哪去。还是蹲一个 dsv4 正式版和 glm5.5 吧。

· 0 个赞

Kimi K3 卖 199 块,给的额度竟然比 GPT Plus 140 块的额度还少。再加上这响应速度,现阶段真找不到买它的理由。

· 0 个赞

刚用了一下,让它写个单页面还没写完就卡住了,直接提示达到 TPD 限制,这一下就花了我 10 块钱。

· 0 个赞

网页版彻底废了,发布之后我就发了一句话就一直提示系统繁忙。API 倒是能跑,但随便问个问题就干没了我三毛钱。

· 0 个赞

前端强是指从零开始写页面,还是在现有项目上改代码?如果只是从零构建那没啥参考价值,现在的模型想在老项目上做细节调整简直是折磨。

· 0 个赞

现在已经停止注册新用户了,而且价格还涨了。

· 0 个赞

既然是国产之光,大家赶紧多多支持,顺便把弱智 GPT 的算力全让给我哈哈哈。

· 0 个赞

幻觉这块感觉还好吧,GPT 那个才是离谱,瞎编起来没边了。

· 0 个赞

前阵子 GLM5.2 发布的时候也是一样的阵仗,结果没挺住。感觉这次也悬。

· 0 个赞

回复

回复 v400127:老哥能细说说 GLM 用起来具体有啥坑吗?

· 0 个赞

拍断大腿,刚出的时候 69 没上车,现在已经涨到 299 了。

· 0 个赞

楼主用的啥 harness 测的?看你这么一通夸,搞得我都心痒痒想去试一试了。

· 0 个赞

功能确实可以,除了速度慢得离谱,其他基本没啥缺点。

· 0 个赞

千万别当大冤种去买,这玩意的计费机制绝对有问题,坑得很。

· 0 个赞

避坑吧兄弟们,699 块的套餐我买了,结果不到两天额度就全给造完了,烧得太快了。

· 0 个赞

既然都有 Claude Code 和 Codex 了,实在想不通还有啥理由去买 Kimi 啊?

· 0 个赞