Kimi K2.6 vs Claude Code:独立开发者该选谁?
源自13位全网作者
06-06 22:58
精选参考来源
1
Kimi-K2.6 前端/后端/Agent编程能力实测! 给大家带来刚刚正式发布的 kimi-k2.6 的正式版本的实测!
本次为了考验它的长程Agentic Coding能力, 我用 kimi-k2.6-code-preview 写了个 harness 游戏自动生成框架, 它可以根据给到的人设/场景/数值设计等规则, 自动生成关卡, 背景图片, 甚至配音!
其中框架驱动和草稿模型使用 kimi-k2.6, 文生图和生成语音由 kimi-k2.6 生成 prompt 后调用其它大模型生成.
最好玩的是, 我做了个"无头"版本的游戏cli接口, kimi-k2.6 能像玩互联网早期Mud游戏一样, 使用纯文本玩这个游戏, 每当它生成关卡之后, 他就可以直接进入游戏游玩一下, 来验证关卡设计得是否正确.
而内部设计又分为了对话生成skill, 脚本生成skill, 关卡生成skill, 游戏测试大师skill, 游戏资深玩家skill(由于检讨游戏性) 等等, 从而实现了让大模型自己写游戏自己玩! 每个关卡大概需要一个小时生成和验证, 如果并行验证应该还能更快一些(做多线程BFS/DFS).
另外本次依旧使用大家都熟悉的测试项目进行了前端/后端/Agent能力测试, 从测试来看, 复杂项目前端能力(建模, 空间理解, 物理模拟等)略有下降, 但后端和 Agent 能力有明显提升. 不过如果你是纯做网站的话, 可以用 kimi 网站上的的 k2.6 Agent 模式, 由于 Agent 能力足够强所以可以在这个模式下多步来提升生成的网站质量和交互体验.
#kimi #kimik26 #moonshot #月之暗面 #kimicli
2
🔥Kimi K2.6 重磅开源|300 个 Agent 协同、13 小时连续编码,实测手搓 3D 游戏!
全部
来源
来源
内容由AI生成
提示信息
取消
确认
评论举报
最新文章
热门文章
-
又学到了,暑期旅行的15个隐藏妙招,学会可太省心了!440 113 -
网龄十年,为何有人月领30GB,有人只有1GB?56 131 -
罗永浩怒斥电视机厂商:不毁灭没天理!145 450 -
评论有奖|这几件夏季洗护小事全网愣是争了好几年,今天一次性说清楚147 376
已收藏
去我的收藏夹
风中之刀
校验提示文案
风中之刀
校验提示文案