科学网—聊聊我对Kimi K 3的体感
精选
已有 227 次阅读
2026-7-20 10:49
| 系统分类: 观点评述
问题 Kimi K3 出来几天了。一直有朋友在问我:
测试了吗?效果咋样?
其实我确实一直在测试。你看,这是我在 Kimi Code 中统计目前的用量。
Kimi 还有将近 4 天才会重置周用量,而我已经用去了 73%.
下面我就给你说说实际使用感受。至于那些 Benchmark 指标啥的,咱就不说了,你在别处应该已经见到不少了。
我测试的环境是 Kimi Code + K3 Max。下面如非特别说明,都是这样的组合产生的结果。
游戏 第一个测试,是游戏。这也是我平时给学生上课「破冰」用的任务。
我给它的任务是:
给我做个 3D 版本的坦克大战,要好玩。单文件 HTML
结果当然不是一蹴而就的,中间在瞄准问题上,我有一些建议,K3 进行了修改。
然后,我把游戏部署到了 ModelScope 上,你打开就能直接玩儿。 链接在这里 。
WASD 控制方向,鼠标瞄准,空格发射。我自己玩儿了半天,哈哈。
网友 Jackywine 玩儿过之后,还录个了个屏。
反正他对效果很满意。
这个 3D 坦克大战还挺有意思,有光效,有鼠标方向,还有打击反馈!
这确实是我近一年来测试 3D 坦克大战游戏制作,感觉最为流畅、也对结果最满意的一回。
地图 下面咱们试试地图动画。
我选《权力的游戏》第一季作为测试对象。提示词为:
对权力的游戏第一季电视剧覆盖的剧情,用合适的方式,html 做地图全景动画,体现出势力变换和关键剧情时间节点
这句提示词,其实写得很粗:什么风格、几个节点、怎么着色,我一个都没说。「用合适的方式」五个字,是我留给 K3 判断的空间。
成品出来了,一个 31 KB 的单文件 HTML,占用空间还没有一张手机照片大。零依赖,不用装任何东西,浏览器打开就自动播放。
成品是一张手绘羊皮纸风格的维斯特洛示意地图,维斯特洛就是这部剧故事所在的那片大陆。你不用点任何地方,它就自己从第一集演到第十集。
开场镜头在塞外,那是第一季故事开始的地方。随着剧情推进,镜头往南走,临冬城、潘托斯、君临、鹰巢城、维斯・多斯拉克,一季故事里最重要的几个地方,一个都没漏。镜头停在哪个区域,哪个区域就是当下剧情的舞台。
全季十集被拆成 16 个剧情时间点。九块区域按家族着色,颜色跟着剧情的控制权走:劳勃死后,王领从拜拉席恩的金色变成兰尼斯特的红色;开战之后,河间地变成红蓝斜纹的交战区。
右侧的势力对比条跟着剧情增减,拜拉席恩家从 80 一路掉到 35,坦格利安从谷底慢慢抬头,异鬼的威胁则在缓慢爬升。
地图上的符号系统也有章法。军队移动是虚线箭头,罗柏南下、守夜人北征都标了出来;呓语森林、绿叉河两场战役有专门的图标;关键死亡是骷髅,劳勃、奈德、韦赛里斯、卓戈各就各位;三次称王用皇冠;地图北侧还有异鬼的标记。
死亡和龙的标记一旦放上地图,就跨节点保留,不会消失。底部是一条 16 个节点的时间轴,圆点可以点跳,播放键就在旁边,键盘的方向键和空格也能控制。
你可以 点击这个链接自己试试看 。
之后我得寸进尺,给 K3 提出要求:
同样的方式,把 house of the dragons s1-s3e04 做出来
《龙之家族》是《权力的游戏》的前传,讲的是坦格利安家族鼎盛时期的内战。
这个任务的差别在于,《权力的游戏》(第一季)是十几年前的老剧,剧情大概率已经出现在大模型的训练数据里;《龙之家族》第三季不一样,它当时正在播出。第四集北京时间 7 月 13 日才更新,离我下这个指令不到一周,所以依赖训练数据不成,得能够自己调研。
K3 自己派了一个后台子 Agent 联网调研第三季前四集的剧情。来源是 WoW Wiki(维斯特洛百科)、Wikipedia,以及 TVLine 和 Vulture 两家娱乐媒体的分集剧情回顾;调研按集进行,每一集都有出处;原著和剧集有差异的地方,在调研笔记里单独标注,没有混进地图。
地图骨架复用第一版那套手绘维斯特洛,这意味着第一版验证过的着色逻辑、镜头调度都还在,它要重做的是势力体系。
血龙狂舞是坦格利安家族的内战,对阵的两派叫黑党和绿党,所以版图上黑党、绿党、中立各一块,河间地还是交战斜纹,石阶列岛、潮头岛这些新地标补了进来,外加一条双方龙数对比条。
势力动画的关键转折点都在:第一季第九集王领转绿,第十集北境和谷地归黑,第二季河间地先进入交战状态再归黑,第三季第二集王领转黑,第三集河湾地也进入交战状态。
你可以 点击这个链接 自己来查看。
教程 咱们还是得试试正经活儿。
对于老师来说,做教学视频是个刚需。我这里给它的例子,是卓克老师在得到专栏《科技参考》第 5 季里的一篇,解读「Claude 长出意识」这条新闻的文章。
我觉得这个例子用动画讲述效果会更好,于是把文章截屏喂给了 Kimi K3,让它借助 hyperframes 用动画 + 我的声音 Minimax 克隆「讲解其中所有技术细节,要详细,面向初学者」。
K3 交回来一个小网站:一个首页,加六个概念动画页。首页是六个入口卡片,顺序就是讲解顺序。它自己把文章拆成六个概念,涵盖了原文里的技术细节。
第一节的标题就叫「『意识』?其实是『可调用的数学表征』」,直接把媒体标题党翻译成技术语言。然后回到基本功:文字接龙,看下一个词怎么从概率榜里跳出来;自注意力,看模型怎么把前文的信息搬回来;多层感知机,看它怎么认出「这是哪类问题」。
最后两节是分析工具:J - 透镜,从结果反推哪些内部表征起了作用;干预实验,把「蜘蛛」换成「蚂蚁」,看输出怎么变。
「面向初学者」这四个字,看来就是它拆概念的依据:每一节只讲一个概念,讲完就停。
每一节都是独立的 HTML 动画,配我以前调教好的克隆声旁白。篇幅都不长:最短的一节 53 秒,最长的一节 73 秒,大多在一分钟上下。我自己从头到尾看了一遍:点播放,画面开始走,旁白同时开始念,一分钟不到播完,概念就立在屏幕上了。
我把它 发布在了这个地址,你可以点击查看 。
这是部分网友看后给的反馈。
看得出来,它们觉得 K3 干得不赖。
感受 要说我使用 K3 最大的感受,那就是「安心」。
我们都知道哪些模型好,但是人家想不让你用就能不让你用。这导致很多用户都没有安全感。
替代模型也存在,但是差距也很明显。
例如之前特别受到追捧的 GLM 5.2 。公道地说,这确实是个好模型。但是它缺乏多模态能力,导致「看不见」。因为看不见,所以很多前端、图像类的任务,就缺乏自己的反馈环。
K3 此次的改进有很多。但是我觉得它能让这么多人眼前一亮,恰恰是在多模态方面没有短板。
对于我来说,上述测试的结果,让我有充分信心在日常教学任务中使用 K3 ,完成这些相对复杂的工作流程。
而用 K3 的其他附带好处,自然包括了合规性。特别是,因为它有自己的 Kimi Code 框架,「原汤化原食」。从模型到框架,全都合规,教师、学生终于不用隔着「卖家秀」和「买家秀」的鸿沟了。
囤里有粮,心里不慌,这就是我说的「安心」。
局限 当然了,目前阻碍普通人使用 K3 的最大障碍,就在算力了。
目前,你新开一个账户,想订阅 Coding plan 套餐,界面是这样的。
全是灰色,显示「已售罄」。
有人骂 Kimi ,说大家一夸,它就饥饿营销 + 涨价。其实我觉得这大可不必。价格由供需决定。只要你觉得不值,不去下单,它哪怕涨价到 100 倍,也伤不得你分毫。
最要命的,其实是 算力的短缺 。
K3 上线后不久,我就在知识星球发了个帖子。
而今天,就有星友在感慨了。
好在,本月末,Kimi K3 的全部权重就会开源了。到时候,提供 K3 的渠道,会比现在多不少。只不过,是 API 还是 Coding Plan (更优惠)方式,不好说。
小结 K3 是一款强大的开源模型,它靠着 2.8T 的规模、多模态能力和自家成熟框架,越过了「严肃任务可用」的门槛,让咱们普通用户在 Claude Code 和 Codex 之外,多了一个选择。
虽然目前算力短缺是个问题,但我相信随着时间的推移会改善的。特别是,K3 不是结束,它是一个信号。别忘了,咱们还有智谱、千问和 Deepseek 等等模型。期待它们新旗舰产品能给咱们带来更多的惊喜。
我再重复一遍这句话:
对咱们消费者来说,大模型企业的充分竞争,才是好消息。
祝 AI 赋能工作和学习愉快。
如果你觉得本文有用,请 点击文章底部的「推荐到博客首页」按钮 。
如果本文可能对你的朋友有帮助,请 转发 给他们。
欢迎 关注 我的专栏 ,以便及时收到后续的更新内容。
延伸阅读 • 看着星友 3 分钟抢光 AI 调研工具内测名额,我突然明白了什么叫生产力革命
• 【直播回放】临时笔记直播答疑与工具操作演示
• Claude Skill 快照:给你的 AI 技能迭代加个「后悔药」
• 用得愉快才算好:近期几件数码设备使用感受
• Midjourney 能识图了,这是个好事儿吗?
转载本文请联系原作者获取授权,同时请注明本文来自王树义科学网博客。 链接地址: https://blog.sciencenet.cn/blog-377709-1544334.html
上一篇: 同样读一篇论文,AI Agent 比对话框强在哪? 欢迎参加科学网十佳博文评选活动! 主办单位:
支持单位: 