
【Kimi K3上手半天,说几个真实感受】先说结论:coding 够硬,但离 Fable 5 还有差距。差距在细节,不在大框。
跑了 3D 物理动画测试——用 Three.js 单文件实现"古埃及人搬运巨石"的 6 阶段动画。Fable 5、GLM 5.2 都跑过,直接横比。
惊艳:one-shot 出图,纹理动画物理都到位。滚木旋转正确,工人挥手,水浮力自然。Fable 5 需要多轮迭代才到这水准。
翻车:推理慢(10-15 分钟/次),重物拖错方向,金字塔乱了,巨石反重力飘起来。
对比 Fable 5:多轮调优后物理更稳,金字塔完整,方向正确。但 Fable 靠迭代,K3 靠首发命中。one-shot K3 赢,最终质量 Fable 5 赢。
数据:
Frontend Code Arena:K3 第 1,超 Fable 5
Terminal Bench 2.1:K3 88.3 vs GPT 5.6 Sol 88.8
价格:K3 便宜约 30%
但 Reddit 有人算了:K3 token 单价低,可推理 token 动辄上万(默认 max thinking),实际每任务 cost 和 Fable 差不多。simonw 画鹈鹕 SVG 花了 25 美分——"我用中国模型画过最贵的鹈鹕"。
r/LocalLLaMA 高赞:「K3 是蒸馏天选——唯一同级别不隐藏 reasoning traces 的 LLM。」
HN 质疑:「很多组织出于安全和 IP 顾虑,拒绝用中国模型。」
判断:K3 开源 coding 最强一档,one-shot 可怕。但 benchmark 第 1 ≠ 实际比 Fable 好。真正意义是把 3T 权重公开放出来——蒸馏、微调、自建服务,这才是让美国 AI 圈紧张的事。
易云达配资提示:文章来自网络,不代表本站观点。