热点

Kimi发布史上最大开源模型!参数高达2.8T,离Fable 5和GPT

字号+ 作者:穷山僻壤网 来源:娱乐 2026-08-10 00:24:16 我要评论(0)

来源:DeepTech深科技7 月 17 日晚,在放出了一支很艺术的预告片之后,月之暗面正式上线了 Kimi K3。这款混合专家模型拥有 2.8 万亿参数、100 万 token 上下文窗口和原生视觉

来源:DeepTech深科技

7 月 17 日晚,发布在放出了一支很方式的史上预告片之后,月之暗面正式上线了 Kimi K3。开源这款混合专家模型具有 2.8 万亿参数、模型100 万 token 上下文窗口和原生视觉理解能力,参数是高达 Kimi 迄今规模最大、能力最强的发布模型。

然而在官方发布前,史上K3 已经以另一种方式出名了:一款名为“Kivine”的开源匿名模型这几天出目前 Arena,后续几天产出高实现度的模型网页、3D 场景和小游戏,参数许多测试者直接把它称为“Fable 级”。高达

图丨KIMI 

K3 正式上线(来源:KIMI)

Kivine 当时并未公开身份。发布外界根据模型特点、史上谝和月之暗面之前的开源匿名测试习惯,推测它是 K3 的预览版本。7 月 15 日,一名用户用相同提示词让它和 Claude Fable 5 制作宇宙模拟器。Fable 5 实现得更快,界面控件也更稳固;Kivine 搭建的场景则更加复杂,加入了充足的天体细节和首先人称视角,视觉冲击力更强。这段比较很快在 X 上传开,也形成了外界对 K3 的首先印象:高效度未必占优,却频仍主动把任务做得更充分。

此后的测试大多延续了这一特点。在一项与 GPT-5.6 Sol 对照的“体素版死星战壕”测试中,原提示词只需制作静态世界,Kivine 最后交付的却是一个可以实时运行的动画场景。在樱花盆景测试中,它生成了扭曲的树干和层次分明的树冠,提示词比如和细节实现度获得测试者好评。还实用户让它用 Three.js 一次生成战争场景,模型直接搭出了带有镜头运动和交互元素的网页。

视往往丨相关测试视往往(来源:X)

另一名用户需 Kivine 制作一款《我的世界》风格的游戏,场景中需涵盖中世纪城堡、森林和花丛。模型最后做成了一款限时寻宝游戏,还加入了环境文章效、光影和手机端虚拟摇杆;作为对照的 Claude Opus 4.7,则生成了一款实现度相对便捷的上帝视角方块游戏。另一次前端测试中,Kivine 的输出被用户评价为同一提示词下见过的最好结荚之一,生成流程却耗时约 35 分钟,甚至慢于 Fable 5。

K3 正式上线后,笔者也做了一轮便捷的横向测试,需不一样模型制作一款“跷跷板台球”游戏。GPT-5.6 Sol(极高)用时不到 10 分钟,便实现了需中的全部成效。Fable 5 Extra 在约 15 分钟时已经生成可用预览,但之后修改破坏了原有交互,台球变得无法拖动。Opus 4.8 用约 20 分钟实现任务,整体功能齐全(相比其他模型没有做出台球编号),但存在明显 bug:白球会卡在球桌边缘,无法再次点击。

图丨跷跷板台球案例实测结荚:Opus

 4.8(左上)、GPT-5.6、Fable-5、KIMI K3(来源:DeepTech)

Kimi K3 Max 同样用时约 20 分钟。它不是这次测试中高效度最快的模型,最后版本的实现度却最高:题功能正常,未出现上述交互故障,还额外加入了球体碰撞文章效甚至动效。

然而,这些案例仍属于零散的用户测试。提示词数量有限,任务题集中在前端和游戏生成,Arena 的随机配对也让横向比较很难严格控制变量。漂亮的单次输出可以展示能力上限,却无法回答稳固性、成本和多轮任务成功率。K3 频仍主动扩大任务范围,也会拉首先生成时间,并可能提高之后修改和收敛的难度。

从月之暗面公布的评测结荚来看,K3 的整体谝也已经接近目前最强的一批模型,“仅次于 Claude Fable 5 和 GPT-5.6 Sol”。在照章性真实职业任务的 GDPval-AA v2 中,K3 获得 1687 分,排在 Claude Fable 5 Max 和 GPT-5.6 Sol Max 之后,高于 Claude Opus 4.8 Max 的 1600 分。

在首先周期智能体知识工作测试 AA-Briefcase 中,K3 得分为 1527,位列第二,超过 GPT-5.6 Sol Max 的 1495 分。K3 还在 BrowseComp 材料检索测试中获得 91.2 分;按照月之暗面的说法,这项成绩由单个智能体实现,没有采取上下文压缩或额外的上下文管理技术。

图丨Kimi K3架构图(来源:Moonshot AI) 

K3 的能力方向也与它在 Arena 上走红的案例基础吻合。模型共有 896 个专家,每次推理只激活其中 16 个,并采取 Kimi Delta Attention 混合线性注意力机制和 Attention Residuals。月之暗面称,这些设方式让 K3 的整体扩展效率实现 K2 的约 2.5 倍。它能够读取大型代码库、操作终端和调用工具,再根据截图、日志、测试结荚及运行状态后续修改代码,题照章性前端、游戏、方式算机辅助设方式和首先周期知识工作。

K3 目前已经通过 API 开放,完善模型权重将在未来几天发布,技术报告也即将公布。

参考材料:

1.https://platform.kimi.ai/docs/guide/kimi-k3-quickstart

2.https://www.testingcatalog.com/early-look-at-kimi-k3-generations-from-moonshot-ai-on-arena/

1.本站遵循行业规范,任何转载的稿件都会明确标注作者和来源;2.本站的原创文章,请转载时务必注明文章作者和来源,不尊重原创的行为我们将追究责任;3.作者投稿可能会经我们编辑修改或补充。

相关文章
  • 马尔穆什双响助曼城3-1逆转马竞,蓝月亮季前赛圆满收官|阿森纳|社区盾杯|马德里竞技_网易订阅

    马尔穆什双响助曼城3-1逆转马竞,蓝月亮季前赛圆满收官|阿森纳|社区盾杯|马德里竞技_网易订阅

    2026-08-09 23:03

  • 数学大佬在前面拓荒,AI研究员在后面捡宝,菲尔兹奖还能拿来破AI「黑盒」?

    数学大佬在前面拓荒,AI研究员在后面捡宝,菲尔兹奖还能拿来破AI「黑盒」?

    2026-08-09 22:44

  • 华夏饲料豆粕期货ETF(159985)已连续60日获得资金净申购,区间净流入额1.51亿元

    华夏饲料豆粕期货ETF(159985)已连续60日获得资金净申购,区间净流入额1.51亿元

    2026-08-09 22:14

  • 百利天恒胆道癌双管线III期齐头并进!科创创新药ETF汇添富(589120)涨超3%!ESMO前瞻,头部创新药企多点开花!

    百利天恒胆道癌双管线III期齐头并进!科创创新药ETF汇添富(589120)涨超3%!ESMO前瞻,头部创新药企多点开花!

    2026-08-09 21:58

网友点评