登入
關鍵字
#開源模型
官方認證
RexAA
2026/09/24
•
重磅!開源版Jev本地部署教學來了!
平時我們搭 Agent 工作流或者客服系統,經常會遇到這類需求:判斷使用者想幹嘛、工單分到哪個部門、該調哪個具體工具。這類事情沒有開放式創作的要求,可如果每次都扔給幾十億參數的自回歸大模型,哪怕只吐一個詞,也得乾等幾百毫秒,輸出偶爾還夾帶解釋廢話或者殘缺的 JSON。 前段時間 TypeSafe 推出 Jev 專門做這類判斷,單次前向幾毫秒就能搞定,但目前只有雲端付費 API,權重沒有開放。開源社區很快做出了完整復刻,Laya 用 Apache-2.0 協議放出了全部模型權重,可以拉回本地自己跑。 這篇文章給大家簡單介紹 Laya 是什麼,然後介紹四步流程把它的部署跑通。指定模型、視訊記憶體最佳化、實驗倉庫這些內容統一放在教學後面,不打斷上手過程。文中的延遲和視訊記憶體資料,都在 aarch64 架構的 GB10 算力卡(20 核 CPU,121 GB 統一記憶體,PyTorch 2.14.0+cu130)上測出。 文中用到的安裝命令、最小指令碼和全部實測日誌都放在這個倉庫裡,可以直接 clone 下來跟著跑,如果視訊記憶體不足的讀者,想要看看運行結果可以去下面的地址,直接看執行日誌,這樣就不用下載模型運行了:https://github.com/li-xiu-qi/XiaokeAILabs/tree/main/experiments/test_jev_open_source/laya(https://github.com/li-xiu-qi/XiaokeAILabs/tree/main/experiments/test_jev_open_source/laya)
科技
#AI Agent
#Jev
#Laya
106人
讚
留言
分享
官方認證
北風窗
2026/09/24
•
小米 MiMo-V2.6 發佈並開源:Pro 與 Flash 雙版本,API 價格與前代持平
小米於9月22日發佈並開源Xiaomi MiMo-V2.6系列全模態模型(包含Pro與Flash)。MiMo-V2.6-Pro在AA綜合智能指數v4.3.2中獲46分,超過Kimi K3(44分)和GLM-5.3(45分),成為該指數排名最高的開源權重模型。Pro與Flash訓練歷時不到6天,成本分別為約262萬美元與85萬美元,累計約75萬條軌跡。 DeepSWE v1.1評測得分分別從48.8提升至65.7及58.4提升至72.6。該系列支援100萬上下文長度,小米同步開源模型權重、技術報告及7k+高品質RL任務環境。 (firemail)
科技
#小米
#MiMo-V2.6
#開源模型
150人
讚
留言
分享
官方認證
RexAA
2026/09/22
•
OpenAI和Anthropic營收面臨威脅:成本壓力下,更多AI初創企業轉向開源模型
隨著OpenAI和Anthropic的API費用攀升與開源模型性能的提升,Harvey、Abridge、Decagon等橫跨法律、醫療、金融賽道的初創AI企業,相繼宣佈自研模型的計劃,部分企業已將八成流量切換至自有模型。此舉對OpenAI和Anthropic構成直接壓力,應用層客戶的流失可能蠶食其最重要的收入來源。 法律AI獨角獸Harvey今年毛利率一度跌至-50%,成為一個縮影——隨著OpenAI和Anthropic的API費用持續攀升,越來越多的AI應用初創企業開始擁抱開源權重模型,重奪成本控制權。 這一趨勢正在加速。Harvey、Abridge、Decagon、Ramp等橫跨法律、醫療、金融和客服賽道的初創企業,相繼宣佈自研或定製模型的計劃,部分企業已將八成流量切換至自有模型。 Sequoia Capital和General Catalyst等頭部投資機構亦在背後助推。
科技
#OpenAI
#Anthropic
#開源模型
191人
讚
留言
分享
官方認證
美股艾大叔
2026/09/19
•
美國指責中國AI企業“蒸餾美模型”,自己卻偷偷用上了中國AI模型,被發現後緊急下線
據路透社報導,美國國家檔案館營運的《聯邦公報》官網(Federal Register)被發現部署了基於阿里通義千問Qwen模型的AI搜尋功能,用於幫助使用者搜尋擬議中的聯邦法規。 《聯邦公報》官網是美國聯邦政府的“官方公告欄”,政府新出的法規、行政命令、部門通知都會先登在這上面。 根據路透社查閱的截圖和該網站原始碼的存檔版本,使用千問模型的搜尋工具在16日被下線。目前,美國國家檔案和記錄管理局以及白宮均未公開解釋千問何時被部署、具體如何運行。 然而,就在此前,美國FBI等機構剛剛把矛頭指向包括阿里巴巴在內的中國AI公司,指責其對美開展“工業規模”蒸餾,獲取美前沿模型能力。中方則否認相關指控。
美股
#美國
#中國AI企業
#中國AI模型
241人
讚
留言
分享
官方認證
北風窗
2026/09/18
•
AGI最難一戰,竟在醫院!中國AI登上Science,醫生不怕失業還催著上線
AI正在橫掃一切,但有塊硬骨頭,遲遲攻不下來,讓無數人希望落空。 2016年,Hinton老爺子就預言:“人們現在就應該停止培養放射科醫生。”他甚至認為,五年內,AI就會在醫療影像識別上超過放射科醫生。 老爺子一生謹慎,但歷史和他開了個玩笑。十年過去了,人們離AGI已經越來越近,但在醫療場景裡,即使圖像識別這樣的AI新手村任務,依然是hard模式。 如果從IBM的Watson算起,在醫療上遭遇滑鐵盧的AI專家數不勝數。
科技
#中國
#醫療AI
#開源模型
201人
讚
留言
分享
官方認證
美股艾大叔
2026/09/14
•
美股半導體暗盤集體下挫,如何看待Anthropic的放緩觀點?
Anthropic CEO的觀點大家應該都看到了,主張放慢前沿 AI 的能力提升速度,讓安全測試、運行監控和第三方評估有時間跟上。這裡的“放慢”並不是停止訓練模型,而是希望模型能力的增長不要超過安全體系的承受能力。 隨後,Sam Altman 和 Elon Musk 很快表示支援,Google DeepMind 負責人 Demis Hassabis 也認為這個方向值得推進。Sam 還承諾,OpenAI 會像 Anthropic 一樣,引入具有員工級存取權的外部評估者。 但這也導致了市場的看空觀點。 為什麼Dario要發表這樣的言論?
科技
#Anthropic
#AI安全
#中美AI競爭
270人
讚
留言
分享
官方認證
北風窗
2026/09/12
•
宇樹開源人形機器人 “大腦”:6B 參數、64 項任務,把具身智能的門檻打下來了
9 月 10 日,宇樹科技正式開源新一代通用人形機器人基礎模型 UnifoLM-WLA-1.0,直接把行業卡了好幾年的 “具身智能通用性” 死穴給干穿了。6B 參數、2500 小時真機訓練資料、單模型統籌 64 項複雜任務,程式碼、模型、資料集同步開放 —— 這不是一次普通的技術發佈,而是把人形機器人 “通用大腦” 的門檻,直接拉到了行業前所未有的高度。 一、行業痛點:人形機器人的 “大腦”,一直是拼出來的補丁 過去人形機器人的軟體體系,更像 “拼裝怪”:走路用一套強化學習模型,抓取用另一套擴散模型,末端執行器換個夾爪,前面的演算法幾乎全部報廢。 桌面操作模型只管桌面,全身移動模型只管導航,兩者割裂,跨場景就 “卡殼”;
A股
#宇樹科技
#人形機器人
#開源模型
263人
讚
留言
分享
官方認證
北風窗
2026/09/10
•
這個新開放原始碼的世界模型只有1.3B,單卡就能即時跑!
大火的世界模型,真的不能拿一張消費級顯示卡跑嗎? 有的,家人們,真的有的。 因為就在剛剛,一個國產的、開源的世界模型,做到了! 來,先來看一下第一人稱射擊效果:
科技
#螞蟻靈波
#世界模型
#開源模型
254人
讚
留言
分享