Kimi K3 开源震撼:2.8 兆参数挑战前段班,中国绕过算力封锁再进一步

月之暗面 7 月 16 日丢出 2.8 兆参数的开源权重模型 Kimi K3,综合评测只输 Claude Fable 5。对台湾开发者来说,这代表一件事:能自己抱回家跑的模型,离最强梯队只剩一步。

周四深夜,台北一位独立接案的工程师还在改客户的后端。他顺手把手上的一段 SQL 丢给刚下载的 Kimi K3 权重跑跑看,结果让他愣了一下——回答的细致度,跟他平常付费用的云端模型几乎没差。而这个模型,是他自己抱回家、跑在自己租的机器上的。

这就是月之暗面(Moonshot AI)在 7 月 16 日发表 Kimi K3 之后,不少开发者的第一反应。一个 2.8 兆参数、开放权重的模型,把「开源」和「前段班」这两个原本有点距离的词,硬是拉近了。

事件背景

Kimi K3 是目前参数量最大的开放权重模型,采稀疏混合专家(sparse MoE)架构——2.8 兆参数不会全部启动,每次推论只唤醒其中一小部分,因此运算成本远低于同规模的密集模型。它支援 100 万 token 的上下文,摆明是冲着长流程的程式开发与 AI Agent 工作而来。

技术上,月之暗面端出两个新设计:Kimi Delta Attention(KDA)与 Attention Residuals(AttnRes),官方说法是同时改善效率与推理品质。这些名词对一般使用者很遥远,但背后的意义很直接:在被限制买不到最顶级 GPU 的情况下,中国团队还是把架构效率榨了出来。

本次重点

  • 综合评测挤进前段:在 Artificial Analysis 的综合排行榜上,K3 拿到 1,547 的 Elo,比上一代 Kimi K2.6 一口气跳了 732 分,整体只落后 Claude Fable 5。
  • 月之暗面自己的评测更猛:官方说 K3 在自家的程式与 Agent 测试组里,赢过包含 Claude Opus 4.8、GPT-5.5 在内的所有对手,只承认整体仍不及 Claude Fable 5 与 GPT-5.6 Sol。
  • 定价策略很有企图:API 收费每百万输入 token 3 美元、输出 15 美元,是中国各家 AI 实验室里最贵的,但换算下来每个任务的成本大约只有 Anthropic Opus 4.8 的一半。
  • 完整权重 7 月 27 日释出:也就是说,真正能自己下载、微调、私有部署的日子,就在几天之后。

市场影响分析

对台湾使用者:最实际的好处是「选择变多、价格被压」。当一个能自架的开源模型都逼近顶级闭源模型,云端 API 的订价自然更难硬撑。想省钱、又在意资料不外流的个人与小团队,多了一个很有份量的备案。

对台湾企业:开放权重意味着可以私有部署、资料不必送出公司,这对金融、医疗、法务这类对合规敏感的产业特别有吸引力。过去要嘛用贵的闭源 API、要嘛用能力差一截的小开源模型,现在中间地带被填起来了。当然,「中国模型」在资安与供应链信任上仍是需要各自评估的议题,不能因为便宜就照单全收。

对开发者:100 万 token 上下文加上主打 Agent 场景,让它很适合塞进 CursorClineWindsurf 这类 AI 编程工具的工作流。等 7 月 27 日权重全开,自己微调一个垂直领域的程式助手,门槛会比想像中低。

未来发展趋势

这几年美国对 GPU、对曝光机等先进制程设备一路加码管制,原本的剧本是要拉开差距。但 Kimi K3 又一次证明:限制没有让中国实验室停在原地,反而逼出更极致的架构效率。开源与闭源的能力差距正在缩小,而「最强的模型能不能被一般人抱回家」这个问题,答案愈来愈接近「可以」。

接下来值得盯的,是完整权重释出后社群的实测——官方数字漂亮归漂亮,真正的考验是丢进真实专案里会不会现形。这也是 DeepSeek 当年走过的路。

TheAI学院 总结与评语

老实说,我对「官方自评赢过谁谁谁」一向保留,那本来就是各家最会挑的战场。真正让我在意的是它的开放成本结构:一个逼近前段班、又能私有部署、每任务成本砍半的模型,对台湾一堆算力和预算都很拮据的小团队,是实打实的杠杆。

别急着换,先等 7 月 27 日权重全开、社群实测出炉再说;但这条开源逼近闭源的曲线,已经值得每个做 AI 应用的人重新盘算自己的技术栈。

给台湾读者的具体建议:如果你现在重度依赖某一家闭源 API,不妨趁这波把「开源自架」列进评估清单,至少拿它当议价和备援的筹码。想动手的话,可以先看我们整理的 AI 应用情境提示词范本 热身。

资料来源

  • Moonshot AI 官方 Kimi K3 发表资讯(2026-07-16)
  • VentureBeat、Tom's Hardware、Axios 相关报导(2026-07-16~17)

(本文依公开资讯整理、以官方公告为准;模型评测数据随版本更新,实际表现请以自身测试为据。)

常见问题

Kimi K3 是免费的吗?

Kimi K3 是「开放权重」模型,月之暗面预计在 2026 年 7 月 27 日释出完整权重,届时可自行下载部署;而透过官方 API 使用则采计量收费(约每百万输入 token 3 美元、输出 15 美元)。自架与 API 是两种不同的使用与计费方式。

Kimi K3 真的比 Claude、GPT 强吗?

依 Artificial Analysis 综合排行,K3 整体只落后 Claude Fable 5,并在月之暗面自家评测中赢过 Claude Opus 4.8 与 GPT-5.5。但官方也承认整体仍不及 Claude Fable 5 与 GPT-5.6 Sol。各家自评都会挑对自己有利的项目,建议以自身实测为准。

2.8 兆参数会不会很难跑?

K3 采稀疏混合专家架构,每次推论只启动部分参数,运算成本比同规模密集模型低很多。但要私有部署完整版本,硬体门槛仍高,个人多半会透过 API 或云端服务使用。

台湾企业适合导入吗?

开放权重的最大好处是可私有部署、资料不必外送,对合规敏感的产业有吸引力。但「中国模型」在资安与供应链信任上仍需各自评估,建议先小范围试点再决定。

繁體中文版 →