Kimi K3
Kimi K3 是月之暗面 (Moonshot AI) 的旗舰大模型:2.8 万亿参数的稀疏 MoE 架构,每次推理只从 896 个专家里挑 16 个 (16-of-896 路由),配上 Kimi Delta Attention 和 100 万 token 的上下文窗口,目标场景是长链路的 agentic 编程、网页浏览和知识类工作。
2026 年 7 月 16 日,Kimi K3 在 Playground 和 API 里上线,同一周月之暗面被曝完成新一轮融资,估值报道称达到 315 亿美元,比 5 月的 200 亿美元涨了不少。开源权重官方说「这几天内」会跟上,目前还没放出。
可以把 K3 理解成月之暗面把 K2 的单车道高速公路换成了一个 16-of-896 的专家交换机:每个请求只走它真正需要的那几条道。
月之暗面是国产公司,但 Kimi K3 这波热度目前主要是英文科技媒体 (TechCrunch、Hacker News) 在推,权重还没放出来,第三方跑分也还没有,真正的横评窗口在权重落地之后的头几周。中文开发者本来就更熟悉 K2.7 Code、DeepSeek V4 Pro、GLM-5.1、Qwen3.6 这条国产模型序列,写英文向的对比测评或选型指南,起点比纯海外作者更近。
比所有人早 7 天看到 nascent 新词,解锁全部阶段筛选,并获得每周提前预警。
搜索热度
-
萌芽 ← 当前0–7 天
-
初现8–30 天
-
验证中31–90 天
-
上升91–180 天
-
成熟180 天以上
为什么是现在火?
2026 年 7 月 16 日,月之暗面把 Kimi K3 放进 API 和 Playground,几天前一份泄露的平台页面已经提前剧透了这次发布。这个 2.8 万亿参数的 MoE 模型被摆到了正面对标 Anthropic Opus 4.8 的位置,同期公司正在按 315 亿美元估值融资。
前景
未来 6 个月的信号走势和商业化节奏。
API 上线好几天了,开源权重还没放出来;真要是放出接近 Opus/GPT-5.6 水准的开源权重,那就是这个季度最大的事。
风险 · 权重要是跳票,或者跑分不如 K2.7 Code 好看,这波靠泄露堆起来的热度会很快退下去。
类比 · DeepSeek V4 Pro · GLM-5.1 · Qwen3.6
-
现在API 已上线,权重还没放
API 按量计费,价格是固定的;开源权重和完整跑分都还没公布。
-
3-6 个月第三方跑分会给出答案
SWE-Bench、Terminal-Bench、HLE 这类第三方评测出来后,「对标 Opus 4.8」这个说法能不能站住脚就见分晓了。
-
6-12 个月编程 agent 生态开始成型
要是权重放出来表现够硬,Kimi Code 的集成、分叉项目、成本对比类内容会跟着多起来。
“Kimi K3” 的竞争与机会
信号来自追踪到的搜索词、这个词的变现卡片,还有它的相关词。除标注“实测”的 Google KD 外均为启发式,仅供参考。
“Kimi K3” 能做的点子
把这个词做成文章、网站、产品、帖子、邮件、视频或课程,随便挑一张卡片就能开干。
等真实跑分数字出来后做第一批独立横评;发布头几天里几乎没有同类内容在竞争。
把 Andante / Moderato / Allegretto 档位的权限差异,以及 256K 和 100 万 token 上下文的分界线讲清楚,这是发布之初读者最容易搞混的地方。
手把手过一遍月之暗面 API 文档,讲清楚缓存命中和未命中的计费差异,以及第三方工具里 reasoning-effort 该怎么设。
给这一批国产开源前沿模型做一张持续更新的对比看板,目前这个具体组合还没人做过。
第一人称的早期体验实测,官方数字还没出来,早写的价值是实打实的。
月之暗面自家产品页上线时就打出了对标 Opus 4.8 级别性能的说法,但到现在还没公布跑分表。
月之暗面在推出 Kimi K3 的同一周,按 315 亿美元估值完成融资,十周内估值涨了超过五成。
大家在搜什么
来自 Google Suggest 和 Trends 的长尾词。热度和竞争度是估算,仅供参考,未经核实。内容类型由搜索词的写法推断。
“Kimi K3” 的搜索结果
现在搜索的人会看到的页面:自然结果在上,有人投广告就显示在那。广告多少是实时的商业化信号。
常见问题
什么是 Kimi K3?
Kimi K3 是月之暗面 (Moonshot AI) 的旗舰大模型:2.8 万亿参数的稀疏 MoE 架构,每次推理只从 896 个专家里挑 16 个 (16-of-896 路由),配上 Kimi Delta Attention 和 100 万 token 的上下文窗口,目标场景是长链路的 agentic 编程、网页浏览和知识类工作。
Kimi K3 为什么现在火?
2026 年 7 月 16 日,月之暗面把 Kimi K3 放进 API 和 Playground,几天前一份泄露的平台页面已经提前剧透了这次发布。这个 2.8 万亿参数的 MoE 模型被摆到了正面对标 Anthropic Opus 4.8 的位置,同期公司正在按 315 亿美元估值融资。
Kimi K3 是什么时候出现的?
约于 2026-07-16 公开出现(截至 2026-07-18 约 2 天前)。EarlyTerms 最早于 2026-07-16 记录到信号。
相关词
同一领域里的其他词:别名、子类、竞品,以及值得接着看的邻近词。
- 属于 Kimi K2.7 Code Kimi K2.7 Code 是月之暗面 (Moonshot AI) 出的开源权重编程大模型,走 MoE 架构:1 万亿总参数、每次推理激活 320 亿、上下文窗口 256K token,每次推理都强制开启思考模式。 →
- 属于 Kimi K2.6 Kimi K2.6 是 Moonshot AI 于 2026 年 4 月 20 日发布的开权重旗舰模型,1T 参数的 Mixture-of-Experts 架构(32B 激活,384 个专家,256K 上下文,原生多模态),在 Hugging Face 以… →
- 竞品 DeepSeek V4 Pro DeepSeek V4 Pro 是 DeepSeek V4 系列的旗舰档:1.6 万亿参数、49 亿激活参数的 MoE 大模型,上下文窗口 100 万 token,MIT 许可开源。截至 2026 年 4 月,这是全球参数量最大的开放权重模型,在编程 benchmark… →
- 竞品 GLM-5.1 GLM-5.1 是 Z.ai 发布的 7540 亿参数开权重大模型,专为 agentic 工程和长周期编程任务设计。它是 GLM-5 的训练后升级版,共用同一套 Mixture-of-Experts Dynamic Sparse Architecture,以 MIT 许可证发布。 →
- 竞品 GLM-5.2 GLM-5.2 是智谱 AI(Z.ai)发布的开源 MoE 大模型,744B 参数,专门针对长任务编程和自主工程场景,MIT 协议。其 IndexShare 架构在百万 token 上下文窗口下把单 token 计算量压低了 2.9 倍,超长上下文不是噱头,真能用起来。 →
- 竞品 Qwen3.6 Qwen3.6 是阿里通义千问团队的新一代大模型系列,主打「真实世界的 agent」场景。两个档位:闭源的 Qwen3.6-Plus(2026 年 4 月 2 日发布)和开放权重的 Qwen3.6-35B-A3B,35B 总参数、3B 激活参数的稀疏 MoE,4 月 16… →
- 竞品 Claude Opus 4.8 Claude Opus 4.8 是 Anthropic 于 2026 年 5 月 28 日发布的最新旗舰大模型,定价维持不变($5/$25 per million tokens)。相比 Opus 4.7,这版在 agent… →
- 竞品 GPT-5.6 Sol GPT-5.6 Sol 是 OpenAI 的旗舰模型,GPT-5.6 家族三档 (Sol、Terra、Luna) 里最顶的那一档,名字取自太阳、地球、月亮。Sol 冲的是最难啃的专业活:编程 agent、长时间跑的研究任务、电脑操作、网络安全,上下文窗口 105 万… →
- 竞品 Opus Fable Opus/Fable 是开发者圈里合出来的说法,把 Claude Opus 4.8 和 Claude Fable 5 当成同一档模型来用,而不是两个独立选项分开选。原因是 Anthropic 会把 Fable 的部分代码请求自动转给 Opus 处理,加上 Fable… →
- 相关 Agentic Coding Agentic coding 是让 AI agent 自主完成开发任务的工作方式:agent 自己规划、写代码、跑测试、读报错、修改,一轮轮迭代直到跑通,不需要人在每一步之间点头。这和 autocomplete 式的「AI pair… →
- 相关 Coding Agents Coding Agents 是一类 AI 编程工具的品类名。这类工具能自主完成代码工作:读仓库、想改法、改文件、跑测试、开 PR,而不是像 2021 年那批 copilot 只在光标处补几行。 →
- 别名
来源
这份报告引用的一手链接,点开任意一条都能自己核对。