用 AI 的人,上星期都聽到同一聲巨響:一個免費開源的模型,把付費旗艦從單項榜首拉了下來。
7 月 16 日,Moonshot AI(月之暗面)開源發布 Kimi K3。上線數小時,它在 Frontend Code Arena 的排名由第 18 位跳上第 1,得分 1679,壓過 Claude Fable 5;七個分項贏了六個,只有 Gaming 一項屈居第二。開源模型在單項榜壓過美系頂級閉源旗艦,這是第一次。
K3 是什麼
三個數字看懂這個模型:
- 約 2.8 萬億參數,MoE(mixture of experts)架構,號稱史上最大的開源模型;
- 1M token 的 context window,長文件與長任務是設計重點;
- 權重免費下載,可自行部署;kimi.com 免費檔每日限量可用,API 按用量收費,定價約為 Fable 級旗艦的三分之一。
「開源」在這裡的意思:模型的權重檔案公開,任何人可以下載、研究、部署到自己的機器。好比餐廳把整本食譜連配方公開——照著做不收錢,上門吃他煮的才收錢。
冷靜看:單項登頂,不是全面超越
兩件事要分開。
第一,Frontend Code Arena 是「前端網頁生成」的單項對戰榜,名次由使用者投票決定。K3 在這個單項確實登頂,但綜合能力榜上它排第 3,仍在 Claude Fable 5 與 GPT-5.6 Sol 之後,大致與 Claude Opus 4.8 同級。百米跑贏了,不等於十項全能冠軍。
第二,榜單本身有局限。對戰式榜單量度的是「觀感上誰做得好」,與你手上任務的實際要求未必重疊;模型也可以剛好在榜單擅長的題型上特別強。榜單值得參考,但判準永遠是你自己的任務。
即使打了這兩個折扣,趨勢仍然清楚:開源與閉源的差距,縮到了史上最窄。一年前「免費模型只是玩具」的說法,已經不成立。
選模型進入「按任務」時代
「一個模型通吃所有工作」的時代結束了。往後的理性用法,是按任務選模型:
| 任務 | 合理選擇 |
|---|---|
| 前端頁面、快速原型 | K3 這類開源新貴值得一試 |
| 長文推理、嚴謹寫作、複雜多步任務 | 頂級閉源模型仍然明顯領先 |
| 大批量、要求不高的機械工序 | 便宜檔模型或開源自部署,成本最低 |
這個轉變對香港與中國用戶反而有利。開源模型不設地區門檻,官方入口與自行部署都用得上;至於 Claude、GPT 系列這些頂級閉源模型,官方雖然不支援香港與中國,經穩定直連網關同樣可以一個帳戶按用量使用——萃靈 Essevin 做的正是這件事:多個頂級模型一個帳戶,用多少付多少。開源的歸開源,閉源的歸閉源,各取所長,成本各自算得清清楚楚。
收尾
榜單每個月都在變,K3 不會是最後一個攪局者。與其追著榜單換工具,不如記住兩條:判準是你的任務,不是排名;成本按用量算,不按品牌算。
*本文資料截至發稿日(2026 年 7 月 20 日),僅供一般參考,不構成任何建議;第三方產品之功能、價格與政策,以其官方最新公布為準;Essevin 服務詳情以官網與 console 實際顯示為準。