近日,北京人工智慧企業月之暗面發佈了目前全球參數最大的開源模型Kimi K3,參數規模達2.8兆;同樣誕生在北京的智譜GLM-5.2也登上全球多份評測榜單的榜首,吸引了海外大量開發者使用——北京大模型領域的“雙子星”,正通過不斷迭代挑戰技術極限,具備處理更複雜任務的能力,讓AI世界裡的生產力加速“變現”。
超大模型背後更考驗訓練能力
目前北京備案上線的大模型達到259款。除了數量居全國首位,模型能力是否也更勝一籌?
參數規模達2.8兆的Kimi K3是個代表——北京不斷上線和迭代的模型,正顯露出越來越多超大模型。“大模型”與“超大模型”一字之差,但模型能力實現跨越式升級。Kimi K3具備100萬詞元上下文窗口。形象地說,這相當於整面書架的書籍一次性裝進大腦,即使後面處理再複雜的任務,也不會忘記開篇的設定。