Kimi K3 开源震撼:2.8 兆参数挑战前段班,中国绕过算力封锁再进一步
月之暗面 7 月 16 日丢出 2.8 兆参数的开源权重模型 Kimi K3,综合评测只输 Claude Fable 5。对台湾开发者来说,这代表一件事:能自己抱回家跑的模型,离最强梯队只剩一步。
周四深夜,台北一位独立接案的工程师还在改客户的后端。他顺手把手上的一段 SQL 丢给刚下载的 Kimi K3 权重跑跑看,结果让他愣了一下——回答的细致度,跟他平常付费用的云端模型几乎没差。而这个模型,是他自己抱回家、跑在自己租的机器上的。
这就是月之暗面(Moonshot AI)在 7 月 16 日发表 Kimi K3 之后,不少开发者的第一反应。一个 2.8 兆参数、开放权重的模型,把「开源」和「前段班」这两个原本有点距离的词,硬是拉近了。
事件背景
Kimi K3 是目前参数量最大的开放权重模型,采稀疏混合专家(sparse MoE)架构——2.8 兆参数不会全部启动,每次推论只唤醒其中一小部分,因此运算成本远低于同规模的密集模型。它支援 100 万 token 的上下文,摆明是冲着长流程的程式开发与 AI Agent 工作而来。
技术上,月之暗面端出两个新设计:Kimi Delta Attention(KDA)与 Attention Residuals(AttnRes),官方说法是同时改善效率与推理品质。这些名词对一般使用者很遥远,但背后的意义很直接:在被限制买不到最顶级 GPU 的情况下,中国团队还是把架构效率榨了出来。
本次重点
- 综合评测挤进前段:在 Artificial Analysis 的综合排行榜上,K3 拿到 1,547 的 Elo,比上一代 Kimi K2.6 一口气跳了 732 分,整体只落后 Claude Fable 5。
- 月之暗面自己的评测更猛:官方说 K3 在自家的程式与 Agent 测试组里,赢过包含 Claude Opus 4.8、GPT-5.5 在内的所有对手,只承认整体仍不及 Claude Fable 5 与 GPT-5.6 Sol。
- 定价策略很有企图:API 收费每百万输入 token 3 美元、输出 15 美元,是中国各家 AI 实验室里最贵的,但换算下来每个任务的成本大约只有 Anthropic Opus 4.8 的一半。
- 完整权重 7 月 27 日释出:也就是说,真正能自己下载、微调、私有部署的日子,就在几天之后。
市场影响分析
对台湾使用者:最实际的好处是「选择变多、价格被压」。当一个能自架的开源模型都逼近顶级闭源模型,云端 API 的订价自然更难硬撑。想省钱、又在意资料不外流的个人与小团队,多了一个很有份量的备案。
对台湾企业:开放权重意味着可以私有部署、资料不必送出公司,这对金融、医疗、法务这类对合规敏感的产业特别有吸引力。过去要嘛用贵的闭源 API、要嘛用能力差一截的小开源模型,现在中间地带被填起来了。当然,「中国模型」在资安与供应链信任上仍是需要各自评估的议题,不能因为便宜就照单全收。
对开发者:100 万 token 上下文加上主打 Agent 场景,让它很适合塞进 Cursor、Cline、Windsurf 这类 AI 编程工具的工作流。等 7 月 27 日权重全开,自己微调一个垂直领域的程式助手,门槛会比想像中低。
未来发展趋势
这几年美国对 GPU、对曝光机等先进制程设备一路加码管制,原本的剧本是要拉开差距。但 Kimi K3 又一次证明:限制没有让中国实验室停在原地,反而逼出更极致的架构效率。开源与闭源的能力差距正在缩小,而「最强的模型能不能被一般人抱回家」这个问题,答案愈来愈接近「可以」。
接下来值得盯的,是完整权重释出后社群的实测——官方数字漂亮归漂亮,真正的考验是丢进真实专案里会不会现形。这也是 DeepSeek 当年走过的路。
TheAI学院 总结与评语
老实说,我对「官方自评赢过谁谁谁」一向保留,那本来就是各家最会挑的战场。真正让我在意的是它的开放与成本结构:一个逼近前段班、又能私有部署、每任务成本砍半的模型,对台湾一堆算力和预算都很拮据的小团队,是实打实的杠杆。
别急着换,先等 7 月 27 日权重全开、社群实测出炉再说;但这条开源逼近闭源的曲线,已经值得每个做 AI 应用的人重新盘算自己的技术栈。
给台湾读者的具体建议:如果你现在重度依赖某一家闭源 API,不妨趁这波把「开源自架」列进评估清单,至少拿它当议价和备援的筹码。想动手的话,可以先看我们整理的 AI 应用情境 与 提示词范本 热身。
资料来源
- Moonshot AI 官方 Kimi K3 发表资讯(2026-07-16)
- VentureBeat、Tom's Hardware、Axios 相关报导(2026-07-16~17)
(本文依公开资讯整理、以官方公告为准;模型评测数据随版本更新,实际表现请以自身测试为据。)
常见问题
Kimi K3 是免费的吗?
Kimi K3 是「开放权重」模型,月之暗面预计在 2026 年 7 月 27 日释出完整权重,届时可自行下载部署;而透过官方 API 使用则采计量收费(约每百万输入 token 3 美元、输出 15 美元)。自架与 API 是两种不同的使用与计费方式。
Kimi K3 真的比 Claude、GPT 强吗?
依 Artificial Analysis 综合排行,K3 整体只落后 Claude Fable 5,并在月之暗面自家评测中赢过 Claude Opus 4.8 与 GPT-5.5。但官方也承认整体仍不及 Claude Fable 5 与 GPT-5.6 Sol。各家自评都会挑对自己有利的项目,建议以自身实测为准。
2.8 兆参数会不会很难跑?
K3 采稀疏混合专家架构,每次推论只启动部分参数,运算成本比同规模密集模型低很多。但要私有部署完整版本,硬体门槛仍高,个人多半会透过 API 或云端服务使用。
台湾企业适合导入吗?
开放权重的最大好处是可私有部署、资料不必外送,对合规敏感的产业有吸引力。但「中国模型」在资安与供应链信任上仍需各自评估,建议先小范围试点再决定。