Kimi K3 開源震撼:2.8 兆參數挑戰前段班,中國繞過算力封鎖再進一步
2026年7月18日
月之暗面 7 月 16 日丟出 2.8 兆參數的開源權重模型 Kimi K3,綜合評測只輸 Claude Fable 5。對台灣開發者來說,這代表一件事:能自己抱回家跑的模型,離最強梯隊只剩一步。
週四深夜,台北一位獨立接案的工程師還在改客戶的後端。他順手把手上的一段 SQL 丟給剛下載的 Kimi K3 權重跑跑看,結果讓他愣了一下——回答的細緻度,跟他平常付費用的雲端模型幾乎沒差。而這個模型,是他自己抱回家、跑在自己租的機器上的。
這就是月之暗面(Moonshot AI)在 7 月 16 日發表 Kimi K3 之後,不少開發者的第一反應。一個 2.8 兆參數、開放權重的模型,把「開源」和「前段班」這兩個原本有點距離的詞,硬是拉近了。
事件背景
Kimi K3 是目前參數量最大的開放權重模型,採稀疏混合專家(sparse MoE)架構——2.8 兆參數不會全部啟動,每次推論只喚醒其中一小部分,因此運算成本遠低於同規模的密集模型。它支援 100 萬 token 的上下文,擺明是衝著長流程的程式開發與 AI Agent 工作而來。
技術上,月之暗面端出兩個新設計:Kimi Delta Attention(KDA)與 Attention Residuals(AttnRes),官方說法是同時改善效率與推理品質。這些名詞對一般使用者很遙遠,但背後的意義很直接:在被限制買不到最頂級 GPU 的情況下,中國團隊還是把架構效率榨了出來。
本次重點
- 綜合評測擠進前段:在 Artificial Analysis 的綜合排行榜上,K3 拿到 1,547 的 Elo,比上一代 Kimi K2.6 一口氣跳了 732 分,整體只落後 Claude Fable 5。
- 月之暗面自己的評測更猛:官方說 K3 在自家的程式與 Agent 測試組裡,贏過包含 Claude Opus 4.8、GPT-5.5 在內的所有對手,只承認整體仍不及 Claude Fable 5 與 GPT-5.6 Sol。
- 定價策略很有企圖:API 收費每百萬輸入 token 3 美元、輸出 15 美元,是中國各家 AI 實驗室裡最貴的,但換算下來每個任務的成本大約只有 Anthropic Opus 4.8 的一半。
- 完整權重 7 月 27 日釋出:也就是說,真正能自己下載、微調、私有部署的日子,就在幾天之後。
市場影響分析
對台灣使用者:最實際的好處是「選擇變多、價格被壓」。當一個能自架的開源模型都逼近頂級閉源模型,雲端 API 的訂價自然更難硬撐。想省錢、又在意資料不外流的個人與小團隊,多了一個很有份量的備案。
對台灣企業:開放權重意味著可以私有部署、資料不必送出公司,這對金融、醫療、法務這類對合規敏感的產業特別有吸引力。過去要嘛用貴的閉源 API、要嘛用能力差一截的小開源模型,現在中間地帶被填起來了。當然,「中國模型」在資安與供應鏈信任上仍是需要各自評估的議題,不能因為便宜就照單全收。
對開發者:100 萬 token 上下文加上主打 Agent 場景,讓它很適合塞進 Cursor、Cline、Windsurf 這類 AI 編程工具的工作流。等 7 月 27 日權重全開,自己微調一個垂直領域的程式助手,門檻會比想像中低。
未來發展趨勢
這幾年美國對 GPU、對曝光機等先進製程設備一路加碼管制,原本的劇本是要拉開差距。但 Kimi K3 又一次證明:限制沒有讓中國實驗室停在原地,反而逼出更極致的架構效率。開源與閉源的能力差距正在縮小,而「最強的模型能不能被一般人抱回家」這個問題,答案愈來愈接近「可以」。
接下來值得盯的,是完整權重釋出後社群的實測——官方數字漂亮歸漂亮,真正的考驗是丟進真實專案裡會不會現形。這也是 DeepSeek 當年走過的路。
TheAI學院 總結與評語
老實說,我對「官方自評贏過誰誰誰」一向保留,那本來就是各家最會挑的戰場。真正讓我在意的是它的開放與成本結構:一個逼近前段班、又能私有部署、每任務成本砍半的模型,對台灣一堆算力和預算都很拮据的小團隊,是實打實的槓桿。
別急著換,先等 7 月 27 日權重全開、社群實測出爐再說;但這條開源逼近閉源的曲線,已經值得每個做 AI 應用的人重新盤算自己的技術棧。
給台灣讀者的具體建議:如果你現在重度依賴某一家閉源 API,不妨趁這波把「開源自架」列進評估清單,至少拿它當議價和備援的籌碼。想動手的話,可以先看我們整理的 AI 應用情境 與 提示詞範本 熱身。
資料來源
- Moonshot AI 官方 Kimi K3 發表資訊(2026-07-16)
- VentureBeat、Tom's Hardware、Axios 相關報導(2026-07-16~17)
(本文依公開資訊整理、以官方公告為準;模型評測數據隨版本更新,實際表現請以自身測試為據。)
常見問題
Kimi K3 是免費的嗎?
Kimi K3 是「開放權重」模型,月之暗面預計在 2026 年 7 月 27 日釋出完整權重,屆時可自行下載部署;而透過官方 API 使用則採計量收費(約每百萬輸入 token 3 美元、輸出 15 美元)。自架與 API 是兩種不同的使用與計費方式。
Kimi K3 真的比 Claude、GPT 強嗎?
依 Artificial Analysis 綜合排行,K3 整體只落後 Claude Fable 5,並在月之暗面自家評測中贏過 Claude Opus 4.8 與 GPT-5.5。但官方也承認整體仍不及 Claude Fable 5 與 GPT-5.6 Sol。各家自評都會挑對自己有利的項目,建議以自身實測為準。
2.8 兆參數會不會很難跑?
K3 採稀疏混合專家架構,每次推論只啟動部分參數,運算成本比同規模密集模型低很多。但要私有部署完整版本,硬體門檻仍高,個人多半會透過 API 或雲端服務使用。
台灣企業適合導入嗎?
開放權重的最大好處是可私有部署、資料不必外送,對合規敏感的產業有吸引力。但「中國模型」在資安與供應鏈信任上仍需各自評估,建議先小範圍試點再決定。