中國AI模型花48小時跑通晶片設計,美國EDA巨頭股價暴跌!Kimi K3搭載2.8兆參數開源挑戰GPT、Claude雙雄

AI速讀
月之暗面推出全球最大開源大模型 Kimi K3,憑藉 2.8 兆參數與卓越的長程編碼能力(可獨立設計晶片),在第三方評測中表現亮眼並獲馬斯克稱讚。此舉震動金融市場,導致美股科技股與 EDA 巨頭大跌。目前 AI 行業重心已轉向商業化,Kimi 採取 API 漲價與跨界聯名信用卡(Amex/農行)策略積極獲客。儘管 K3 在使用者體驗上仍略遜於頂級閉源模型,但月之暗面估值已迅速攀升至 315 億美元,顯示資本市場對其商業潛力的極高預期。

7月17日凌晨,Kimi K3正式亮相。據官方披露,Kimi K3搭載2.8兆參數規模,配備100萬Token(詞元)超長上下文窗口,原生相容視覺理解能力,是當前全球參數體量最大的開源大模型,直接將開源陣營的技術門檻抬升至3兆等級。

Kimi K3發佈後,第三方評測資料顯示,Arena AI的Code Arena榜單上Kimi K3得分1679,位列第一,超過行業雙雄Claude Fable 5和GPT-5.6 Sol。本次Kimi新模型的發佈還得到特斯拉CEO(首席執行長)馬斯克的關注,他在評論區留言道:“Impressive(令人印象深刻)。”

伴隨中國大模型在全球AI賽道話語權的持續提升,行業競爭重心已從參數比拚轉向商業價值兌現。

Kimi K3系統架構

圖片來源:月之暗面官網

來自華爾街的消息稱,市場擔憂,如果中國高性能AI模型獲得更多採用,可能影響美國AI企業資本開支預期及高端晶片需求。

昨夜美股大型科技股普跌,輝達、Meta、Google跌超2%;費城半導體指數跌1.63%,較6月22日創下的歷史高點下跌20.2%,進入技術性熊市。全球EDA(電子設計自動化)巨頭新思科技、鏗騰電子均一度大跌超12%,新思科技收跌7.85%,鏗騰電子收跌9.47%。

消息面上,月之暗面表示在連續48小時的自主 Agent(智能體) 運行中,K3基於開源EDA工具和Nangate 45nm工藝庫,獨立完成了晶片的建構、最佳化與驗證

01. 48小時跑通晶片設計Kimi瞄準長程程式設計能力

具體到模型的測試表現,在編碼(coding)專項測評中,Kimi K3呈現出較突出的競爭力。在測試超長程軟體工程任務能力的SWE Marathon測評中,Kimi K3以42.0分位列第一;而在AI終端操作能力基準測試的Terminal Bench 2.1和評估AI模型軟體工程能力的FrontierSWE兩項測評及其自研內部程式碼測試集Kimi Code Bench 2.0中,Kimi K3則略有落後排在第二。

通用智能體賽道下,Kimi K3在自動化操作、網頁深度檢索、辦公類實操任務測試中優勢明顯。從Kimi披露的測試結果綜合來看,Kimi K3整體表現雖未能超越閉源模型Claude Fable 5和GPT-5.6 Sol,但與頭部兩款閉源模型差距較小。

值得一提的是,本次Kimi在介紹中也特別提到了架構層面變化帶來的效率提升。Kimi K3基於Kimi Delta Attention(KDA)混合線性注意力機制和Attention Residuals(AttnRes)注意力殘差技術建構。MoE(混合專家)層面,模型在896個專家中啟動16個。而上述結構性改進讓Kimi K3 相比K2的整體擴展效率提升約2.5倍。

Kimi重點突破的長程編碼能力在案例上也有具體體現。Kimi具體介紹了Kernel最佳化、創作數字作品、晶片設計等幾項涉及側重不同能力需求的應用場景。

其中Kimi K3設計了一款晶片,用於運行一個基於自身架構建構的nano模型。官方表示在連續48小時的自主 Agent(智能體) 運行中,K3基於開源EDA工具和Nangate 45nm工藝庫,獨立完成了晶片的建構、最佳化與驗證。該晶片能夠在100 MHz下完成時序收斂,模擬解碼吞吐持續超過每秒8700個Token。

K3不是孤立的產品。月之暗面於6月中旬發佈的K2.7 Code、Kimi Work也已經在做垂直方向的嘗試。

K2.7 Code專攻程式設計場景,Token消耗比前代降低30%,後來又追加了高速版。Kimi Work則把Agent能力搬到桌面端,支援本地檔案操作、瀏覽器自動化和定時任務,並提供可連續工作24小時的目標模式,以及接入飛書、WPS、釘釘等第三方應用的外掛中心。

桌面Agent正在成為各家大模型研發企業落地的共同選擇。百度、阿里等把Agent整合進辦公套件,6月底豆包也開啟了付費功能,重點覆蓋辦公和Agent場景,月費從68元到500元分了三檔。行業整體轉向讓AI直接在工作流裡幹活,而不是停留在聊天框。

K3的發佈,給應用提供了更強的模型底座,Kimi Work也同步新增了小元件和看板兩項功能,把對話輸出變成可持續查看的可視化介面。

值得一提的是,官方主動列出三點模型目前存在的侷限:一是對歷史思考內容敏感,中途切換模型或框架不相容可能導致上下文干擾,導致內容生成質量不穩定;二是訓練側重長程高難任務,簡單場景下模型可能“過於主動”,替使用者做非預期判斷。而對於這兩點Kimi官方也都給出了簡單的使用指南;三是“儘管Kimi K3總體上是一個非常有競爭力的模型,但與Claude Fable 5和GPT-5.6 Sol相比,在使用者體驗上仍有一定差距”。

目前,Kimi K3的完整模型權重尚未發佈,月之暗面表示將於今年7月27日前發佈。更多技術細節將隨技術報告一併公佈。

02. 行業漲價潮來襲大模型商業化進入兌現期

與模型能力一同走高的還有模型價格。

Kimi K3的API(應用程式程式設計介面)定價為:輸入每百萬Token 2元(命中快取)和20元(未命中),輸出每百萬Token100元。官方稱程式設計場景快取率超過90%,折算下來實際輸入成本低不少。

據第三方機構Artificial Analysis測算,Kimi K3單任務成本約0.94美元,與GPT-5.6 Sol的1.04美元接近,約為Claude Opus 4.8(1.80美元)的一半。

整體來看,漲價已是全行業的主旋律。智譜GLM-5系列已經分三輪上調價格。DeepSeek宣佈V4正式版上線後實行峰谷定價,高峰時段價格翻倍。此前,Kimi的價格也有所上漲,從K2的每百萬Token 4元漲到K2.7 Code的6.5元,漲幅約60%。

月之暗面B端(商家端)負責人黃震昕近期公開表示,供需兩端擠壓下,API漲價是必然趨勢。使用者願意為高性能支付溢價,廠商則通過快取最佳化、推理效率提升來避險成本。目前Kimi原廠服務的快取命中率超過90%。

在漲價之外,各家企業在商業化路徑上分化明顯。有的押注企業私有化部署,有的深耕開發者生態拓展付費使用者。而Kimi的選擇是B端和C端(消費者端)同時發力。黃震昕提到,網際網路、金融、製造、教育、醫療是目前主要的企業客戶來源。海外市場增長更快,付費使用者和API收入都增長了400%,產品進入200多個國家和地區。

C端最有話題性的嘗試是Kimi信用卡,這款聯名卡已於7月10日正式發行,合作方是美國運通和農業銀行。通過這張卡,使用者可以把消費積分換成Kimi算力額度和Agent使用權,相當於用金融權益做C端獲客和留存。項目從4月醞釀到7月落地,3個月走完流程,知情人士稱雙方“一拍即合”。然而類似的跨界合作在行業裡不多見,效果如何還需要時間驗證。

商業化探索背後,是估值火箭般的攀升。過去半年,月之暗面完成三級跳:2025年12月估值43億美元,今年5月D輪後躍至200億美元,6月又被曝出新一輪融資投前估值達315億美元,半年增長超6倍。

當前,大模型頭部梯隊的資本化競速全面鋪開,智譜、MiniMax已先後登陸港股,在股價高點時市值分別衝到兆港元、千億港元等級。月之暗面此刻的每一步商業化試探,也都承載著資本市場的高預期。

而在閉源模型持續領跑、國產同行加速追趕的格局下,K3能給月之暗面帶來多大的實際優勢?面對定價的抬升,Kimi K3能否呈現出與價格匹配的良好表現?這些都還需要進一步檢驗。 (每日經濟新聞)