
中國人工智能初創月之暗面(Moonshot AI)27日兌現咗早前承諾,喺Hugging Face平台公開旗艦模型Kimi K3嘅完整權重,供全球免費下載,數據量達1.56TB。呢個2.8萬億參數嘅混合專家(MoE)模型,係歷來規模最大嘅開放權重模型,支援100萬token上下文窗口,並可原生處理圖像同影片,7月16日先以API同應用程式形式面世,事隔11日就全面開放權重,震動業界。
多項基準測試顯示,Kimi K3表現拋離Anthropic同OpenAI較早一代嘅Claude Opus 4.8同GPT-5.5,緊追現時最強嘅Claude Fable 5同GPT-5.6 Sol,運行成本平約兩至三倍。獨立評測機構Artificial Analysis嘅智能指數,K3得分約57,僅次於Fable 5約60分同Sol約59分,而喺前端編碼競技場(Frontend Code Arena)更以1,679分排名第一,壓過Fable 5。不過要留意,大部分成績出自月之暗面自家評測,各模型用唔同工具鏈運行,比較上有局限;另有獨立測試指,K3喺事實可靠性測試嘅幻覺率由上一代嘅39.3%升至50.9%。
價格先係K3最大殺傷力。官方定價每百萬輸入token收3美元(約23.4港元)、輸出15美元(117港元),遠低於GPT-5.6 Sol嘅5美元(39港元)同Claude Fable 5嘅10美元(78港元),即Fable 5整體貴約3.3倍;喺編碼工作負載,K3快取(cache)命中率超過九成,命中價更低至0.3美元(約2.3港元)。效率源於多項設計:權重採用MXFP4、激活值採用MXFP8等低精度格式,節省顯示記憶體;2.8萬億參數每次僅啟動約1,042億,896個專家每次只調用16個,並以固定大小嘅Kimi Delta Attention(KDA)取代不斷膨脹嘅KV緩存。官方文件亦披露部分編碼評測以Nvidia低階H20晶片運行,呢款出口管制下嘅特供晶片並唔原生支援MX浮點格式,有分析推測若改用原生支援MXFP4嘅Blackwell架構晶片,成本效益或者更高,有待實測驗證。不過自行部署門檻絕對唔低,官方建議用64張或以上加速卡組成嘅超節點。
今次發布正值華府高度戒備。白宮科技政策辦公室主任克拉齊奧斯(Michael Kratsios)上周指控月之暗面用受禁Nvidia晶片訓練K3,並對包括Anthropic Fable在內嘅美國模型進行大規模「蒸餾」(distillation),月之暗面至今未有回應。另外,開放權重(open-weight)唔等於開源,訓練數據同代碼仍然係月之暗面嘅商業機密;Kimi K3 License訂明,經營「模型即服務」業務、集團喺任何連續12個月總收入超過2,000萬美元(約1.56億港元)嘅機構,必須同月之暗面另簽協議先可以作商業用途,而月活用戶超過1億或月收入超過2,000萬美元嘅產品,亦須喺介面展示「Kimi K3」字樣。創辦人楊植麟(Yang Zhilin)表明要以開放策略擴大用戶群,正面挑戰美國閉源陣營。