Kimi:能一次读完百万字,还能派 300 个子代理把活干完

百万字的资料丢进去,它自己拆任务、自己找人分工,最后交回来的是一份能直接用的成品。

Kimi 是月之暗面(Moonshot AI)推出的人工智能助手,最早是靠"能一次读完长文档"被记住的。到了 K3 这一代,它的重心明显往"替你干活"上挪了一格:一边把上下文窗口拉到 100 万 token,一边把 Agent 集群(Agent Swarm)的能力做到能同时调度几百个子代理。读得进只是一半,做得完才是这一代真正想解决的事。

百万字不是噱头,是它的底座

Kimi K3 的总参数量是 2.8 万亿,采用混合专家(MoE)架构,896 个专家里每个 token 只激活 16 个。这个结构带来的直接好处是:模型体量上去了,推理成本不必跟着一起膨胀。它支持 100 万 token 的上下文窗口,一份几百页的报告、一整套代码仓库、连续多轮的长对话,都可以放在同一次会话里处理,不用先切成小块再拼结果。

K3 同时是原生多模态模型,文字、图片、视频在同一套模型内部理解。把一张界面截图丢进去,让它照着写前端代码;把一段演示视频丢进去,让它梳理画面里的操作流程,中间都不需要额外的格式转换环节。对于每天都在和截图、扫描件、录屏打交道的人来说,这一步省下的是来回倒腾文件的时间。

100 万 token 上下文让整份长文档留在同一次会话里

派活:一次叫上 300 个子代理

Agent 集群是这一代最值得说的能力。它不是把几个智能体简单摆在一起,而是由一个主 Agent 负责拆解目标、判断哪里该并行、怎么分工,然后把任务派给最多 300 个子代理同时推进,单次任务可以跑出 4000 次以上的工具调用。

官方给出的量级是:在大规模搜索一类场景里,Agent 集群能把达到目标所需的关键步骤减少 3 到 4.5 倍。落到实际体感上,"采集 200 篇以上文章并分类归档""同时调研 100 个细分方向再整理成表"这类过去只能排队慢慢做的事,可以并行跑完。执行过程中子代理在做什么、调用了哪些工具、访问过哪些页面都是可见的,中途发现方向不对还来得及叫停。

kimi agent swarm parallel sub-agents
主 Agent 调度子代理并行推进,过程实时可见

桌面端、命令行和浏览器都能接上

同一套能力在几个入口上各有分工。Kimi Work 是面向办公场景的桌面端,已经随最新的测试版客户端提供 macOS 与 Windows 版本,它能连上本地文件、按设定时间自动执行任务,也能跨网页完成操作。Kimi Code 面向开发者,提供命令行工具和编辑器扩展两种用法,可以读懂代码库、改文件、跑命令,适合处理跨多个文件的工程任务。Kimi Claw 走的是零部署路线,不需要服务器或容器,几十秒内就能拉起一个持续运行的 Agent,自带包含五千多个技能的能力库。Kimi WebBridge 则是一个浏览器插件,负责点击、填表、跳转和抓取,让 Agent 能把手伸进网页里做事。

kimi work desktop agent local files
桌面端连上本地文件,可设定时任务自动执行

模型与价格速查

开放平台上目前在售的三个模型定位各不相同,价格按缓存命中、输入、输出三档给出,单位是每一百万 token。长会话里反复复用的上下文会走缓存价,这也是长文档场景下成本能压得住的原因。

模型

上下文窗口

缓存命中

输入

输出

Kimi K3

1M tokens

¥2.00

¥20.00

¥100.00

Kimi K2.7 Code

256k tokens

¥1.30

¥6.50

¥27.00

Kimi K2.6

256k tokens

¥1.10

¥6.50

¥27.00

选型上有个朴素的分工:日常对话和通用任务交给 K2.6 就够,写代码优先看 K2.7 Code,K3 留给软件工程、深度推理和知识工作这类真正吃能力的前沿场景。价格与模型阵容会随版本调整,具体以开放平台当时的口径为准。

它交回来的东西

产出形态比多数人预期的要宽。深度研究给出的是带图表、可追溯引用的报告;Kimi Docs 面向长报告、合同审阅和复杂文档流程;表格能力生成的是带公式、数据透视表和图表的真实 Excel 文件,从报表到财务模型都可以描述需求直接得到;演示稿可以把现成的文本、文档、图片或模板转成可编辑的版本;建站则是在不写代码的前提下把想法变成能发布的页面。

手上的文件也能一次性交出去。单个文件上限 100MB,同一次对话最多 50 个文件,覆盖 PDF、Word、Excel、PPT、图片、TXT 以及视频。做文献综述、比对多份合同、跨表格核对数据这类活,可以整批上传之后直接提问,不用先做归档整理。

深度研究、文档、表格与演示稿都在产出范围内

开放权重与上手方式

K3 的完整模型权重已经按 Kimi K3 License 发布到 Hugging Face,允许运行、部署、微调和修改。对想把成本算清楚、或者有自部署需求的团队来说,这是一个把主动权握在自己手里的选项,而不是只能依赖接口调用。

日常使用有网页端、桌面端和移动端三种入口,移动端覆盖 iOS、Android 与 HarmonyOS。计费是免费额度加订阅的模式:免费档能应付基础对话、文件上传和日常问答,Agent 集群这类消耗较大的能力面向付费会员开放。Agent 任务消耗的额度明显高于普通对话,这是使用前值得先知道的预期。

最后是一条来自实测的经验:任务描述得越具体、验收标准写得越清楚,交回来的成品越接近可以直接使用。涉及关键数字和对外结论的部分,仍然建议人工过一遍再往下走,把它当成一个效率极高的执行者,比当成免检成品更稳妥。

Kimi 这一代真正的变化,是把"读得进"变成了"做得完"。百万字上下文回答的是能装下多少,Agent 集群回答的是能同时推进多少——两件事叠在一起,它才更接近一个可以交付结果的助手。

Kimi下载地址
支持的操作系统: Windows macOS iOS Android Web HarmonyOS