#商湯
人形機器人呼喚“知行合一”
在2026世界機器人大會(WRC)的展館現場,一台台人形機器人輪番登場,奔跑、舞蹈、靈巧操作,各類炫酷演示不斷刷新觀眾的感官體驗。WRC集中展現了中國人形機器人產業的高速擴容態勢。當前行業硬體迭代提速,整機產品突破400款、年產量有望衝擊10萬台規模,各類行走、作業、展演樣機層出不窮,技術可視化成果亮眼。但透過行業熱鬧表象可見,產業正陷入明顯的“軟硬失衡”格局:硬體產能快速爬坡、樣機性能持續迭代,而適配真實物理場景的機器人大腦尚未形成成熟方案。行業普遍存在,搭載頂尖大語言模型的人形機器人,可實現流暢人機對話,卻難以勝任收拾桌面、規整物品等基礎生活化、工業化任務的痛點。人形機器人想要從“展演”走向規模化產業落地,核心突破口在於打造具備“物理直覺”的具身智能大腦。 人形機器人走進生活場景 “能說”不等於“會做”,物理直覺成關鍵瓶頸 “現在很多人有一個認識誤區,以為把大語言模型接到機器人身上,就能造出通用人形機器人。現實是,語言模型只解決‘會說’,人形機器人核心訴求是‘會做’。”宇樹科技創始人、董事長王興興表示,通用語言模型並不等同於具身模型,二者訓練目標、資料來源、輸出範式完全不同。語言模型輸出是文字,人形機器人大模型最終輸出的是每一個關節的運動指令,要兼顧力、速度、空間位置、環境動態變化,“整套系統必須跑在毫秒級的即時閉環之內”。
商湯發佈多模態“效率怪獸”,開源即SOTA!最小僅8B,比肩商用
實測:15秒出高密度資訊圖,還能圖文一步到位。當GPT images 2.0又再一次搶佔頭條,人們對多模態模型的關注也在悄然變化:“畫得好”已經不再是問題了,我們還想要“速度快、效率高、成本低”。過去很長一段時間裡,視覺理解與圖像生成,往往被拆分為兩套體系:前者負責“看懂”,後者負責“畫出”,中間通過不同模組進行銜接。這種在底層邏輯上的割裂,是阻礙模型效率的核心。商湯這次的思路,是從架構層面直接處理這個問題。他們剛剛開源了原生理解生成統一模型SenseNova U1,便基於自研的NEO-unify架構,將圖像與文字的理解與生成能力統一到同一體系中,沒有了“中間商”之後,效率得到大幅提升。在圖像理解與生成的多項基準測試中,SenseNova U1 Lite在同量級開源模型中達到SOTA水平,並在多項指標上逼近商業閉源模型表現。以8B參數規模,實現接近更大模型的能力,得到“以小搏大”的表現。▲高密度資訊圖(en)▲高密度資訊圖(zh)目前,使用者可以在Hugging Face、GitHub獲取開源模型。同時,商湯AI辦公智能體“辦公小浣熊3.0”也即將接入SenseNova U1,使用者可直接體驗相關能力。01. 不堆參數,靠效率取勝:8B模型拿下開源SOTA本次開源包含兩個版本:SenseNova-U1-8B-MoT與SenseNova-U1-A3B-MoT,均基於統一的多模態理解、推理與生成架構,面向圖文理解、生成及複雜互動任務。如果從測評結果來看,SenseNova U1最突出的優勢,在於整體效率——在理解、生成、推理與圖文交錯多個維度上,用更小的模型規模,跑出了接近甚至逼近商業閉源模型的表現。在理解側,SenseNova-U1-8B-MoT在AI2D、IFBench等基準上均取得領先表現,例如在AI2D上達到91.7分。結合空間理解相關測試,可以看到模型在複雜結構與關係判斷等任務中表現穩定,具備一定的邏輯推理能力。在生成側,模型在GenEval、OneIG、LongTextBench等任務中表現穩定,能夠同時兼顧複雜結構生成與文字一致性。尤其是在資訊圖生成(Infographics)任務中,平均得分達到50.7,是開源模型最強,媲美部分閉源商業模型。進一步看編輯與圖文交錯能力,在Editing、Visual Reasoning等任務中,SenseNova U1在WISE、VBVR、OpenING、GEdit-Bench等測試中表現突出。例如在OpenING相關任務中達到91分,在視覺推理任務中也明顯優於傳統圖像生成模型。但相比這些分項成績,更關鍵的是它的“性能—效率比”。從對比結果來看,在資訊圖生成與長文字等任務中,SenseNova U1在約15秒延遲下即可取得接近60分的平均成績,整體屬於“高性能、低延遲”。對比Qwen-Image 2.0 Pro、Seedream 4.5等模型,其在生成質量接近商業閉源模型的同時,響應速度更快。▲Generation Latency vs. Averaging Performance on Infographic Benchmarks, i.e., BizGenEval (Easy, Hard), and IGenBench▲Generation Latency vs. Averaging Performance on OneIG (EN, ZH), LongText (EN, ZH), BizGenEval (Easy, Hard), CVTG and IGenBench這些性能表現背後,主要還是來自底層架構的優勢。SenseNova U1基於商湯自研的NEO-unify原生統一架構,在設計上減少了中間環節帶來的資訊損耗,因此在資料利用效率和推理開銷上更有優勢。最終呈現出來的,才得以是“以小搏大”的優勢:僅用8B參數規模,在多個維度達到同量級開源模型SOTA,並在部分任務上逼近商業閉源模型。從測評結果來看,這種優勢已經比較清晰。至於落到真實使用場景中,SenseNova U1是否同樣穩定、好用,我們來實測一番。02. 一手實測揭秘:從立體排版到“言出法隨”智東西選取了多個不同類型的任務進行測試,覆蓋高密度資訊圖、趣味創意圖以及技術流程圖等典型場景。創作資訊圖可以說是最能“精準擊中”職場人的能力。使用者只需要輸入文章、資料或文字說明,模型就能將其中的關鍵資訊提煉出來,並生成一張具備結構、層級和視覺重點的資訊圖。在“蘇超出圈之路”這一案例中,模型就生成了一張多層蛋糕式資訊圖。不同階段以立體分層形式呈現,文字隨著結構自然分佈在不同空間層級中,而不是簡單平鋪。這背後其實反映的是模型對結構的理解能力。更關鍵的是,在這種複雜排版下,整張圖沒有出現明顯的文字錯位、遮擋或渲染錯誤,整體可讀性很高。換一個更複雜的文字場景來看,模型對富文字結構的理解能力,體現得更明顯:那些資訊需要突出,那些適合做流程,那些更適合用圖表表達,那些需要用圖示輔助理解。“龍蝦使用指南”這個案例,就更能體現細節處理能力。這一任務中包含大量中英文混排、不同字號文字以及情緒化表達。模型不僅把“禁止模糊指令”“禁止無限重試”這些核心文案寫對了,還自動匹配了對應的圖示和帶情緒的畫面,比如龍蝦被“壓榨”、被“投喂指令”等。不同模組之間的文字大小、間距和佈局都處理得較為合理,沒有擠在一起,已經達到直接商用的水準了。在人物與指令理解方面,“馬斯克vs奧特曼”這一案例更具代表性。在提示詞中僅輸入“奧特曼”這一暱稱,模型直接生成了一個穿西裝的“奧特曼形象”,與旁邊的馬斯克形成對比,既符合語義又帶有明顯的趣味性。與此同時,馬斯克的表情、動作以及整個對峙氛圍也都比較到位,可見模型在人物理解和場景建構上具備較強的語義對齊能力。到了技術表達這一步,難度其實更高。在“SenseNova U1技術解讀”這一案例中,模型需要生成的是一張邏輯清晰的技術流程圖。從結果來看,整體結構層級清晰,資訊分區明確、表達直觀,對於非技術讀者也較為友好。一輪實測下來,另一個比較直觀的感受是速度。這類圖像的生成基本都在十幾秒內完成,有點接近“言出法隨”的感覺。在這樣的生成效率下,各種應用場景也不在話下。目前,SenseNova U1可生成資訊圖譜、專業簡歷、生活指南、產品說明、百科知識、漫畫創作等多種內容。對行銷、辦公、設計、商業分析等場景來說,這類能力直接對應的是內容生產效率提升。03. 告別“縫合”,NEO-unify架構如何成為理解與生成的“通才”?測評整合績有優勢,實測效果也毫不遜色,這個原生框架究竟好在那裡,我們來拆解一下。過去,多模態模型的工作方式更像是“分工協作”:視覺編碼器負責理解圖像,變分自編碼器負責生成圖像。前者看圖,後者畫圖,中間再通過不同模組完成銜接。理解與生成更像兩條平行的流程,能配合,但很難真正融合,所以SenseNova U1這次選擇直接推倒重建,從底層架構上直接改掉這套“拼接式”體系。其採用的自研NEO-unify架構,不再把語言和視覺當作需要中間轉換的兩種訊號,而是從一開始就把它們當作同一類資訊來建模。換句話說,語言與視覺不再各走各路,在同一套表徵體系裡共同參與理解、推理和生成。這種設計本質上回到了“多模態AI第一性原理”:不同模態之間本來就是內在關聯的。在具體實現上,模型儘量減少中間壓縮與轉換環節,直接從接近原始的像素和文字資訊中學習,讓資訊在傳遞過程中損耗更小。同時,它的資料和推理效率也更高。這也是SenseNova U1值得關注的地方:並不是單純靠堆參數規模換效果,而是在底層架構上重新處理多模態模型的協作方式。04. 當AI學會“帶圖思考”展開空間智能更多想像不同於GPT-image2單純圖像上的“卷王體質”,SenseNova U1也展示了另一種可能:讓圖像成為邏輯的一部分,並在推理過程中引入對空間結構的理解。這也是其“連續性圖文創作輸出”的能力核心。SenseNova U1是業內首個能夠在單一模型上進行連貫圖文交錯生成的模型。這意味著,在處理複雜任務時,模型可以一邊解釋邏輯,一邊生成對應的示意圖、流程圖、草圖或設計圖。例如在教學、在繪本故事等場景中,它可以讓文字敘事、插圖風格、人物事件等保持一致性與連貫。同時,SenseNova U1並不是先生成一段完整文字,再去“補圖”,而是從材料準備或構圖草稿開始,一步步輸出關鍵操作,並同步生成對應畫面。整個生成過程是連續的:步驟之間有承接關係,圖像之間保持風格一致,文字和視覺內容也始終圍繞同一上下文展開。這種連貫性,在過去依賴多模型串聯的方案中很難穩定實現,往往會出現風格漂移或資訊斷裂。本質上,這得益於SenseNova U1所具備的原生圖文理解生成能力,能天然將圖像和文字底層融合訊號完整的保留上下文中,在統一表徵空間進行高效連貫思考。這也讓它和空間智能產生了更直接的聯絡。空間智能關注的是模型如何理解位置、方向、佈局、關係和結構,而這些能力恰恰會在圖像生成、高密度資訊圖排版、流程圖建構和場景示意中反覆出現。如果繼續往後看,這類能力也可能成為具身智能的重要基礎。機器人要在真實環境中完成任務,不僅要“看見”物體,還要理解物體之間的關係、判斷行動路徑,並根據任務目標做出連續決策。從這個角度看,SenseNova U1的意義不只是生成更好看的圖,而是在單一模型中嘗試打通理解、推理和視覺表達。它距離真正成為機器人的“具身大腦”還有距離,但這類統一架構,至少提供了一條更接近多模態閉環的技術路徑。05. 結語:理解與生成走向統一多模態模型進入分岔口從底層架構的NEO-unify創新,到應用層面的原生圖文交錯與高密度資訊圖生成,商湯的全面開源,不僅是參數規模上的“以小搏大”,更是對多模態第一性原理的深度回歸。當行業還在討論生圖模型的真實邊界時,SenseNova U1已經通過理解與生成的統一,為AGI的到來鋪就了一條更具效率的路徑。開放原始碼的力量將讓這種原生多模態能力迅速滲透進每一個垂直行業,我們正在見證的是一個“圖文同構、思畫合一”的全新時代的開啟。在大模型全球競賽的下半場,國產模型正在輸出屬於自己的硬核解法。 (智東西)
商湯自研車規AI晶片,發佈!
芯向智行!商湯自研車規晶片破局,領跑智能汽車AI算力新賽道在智能汽車產業全速邁向高階智駕的關鍵階段,車規級AI晶片作為核心“大腦”,成為行業競爭的核心制高點。近期,商湯憑藉多年技術深耕與全端自研實力,迎來重磅產業化突破——商湯科技自研的「STPU 3.0車規級AI晶片」正式實現規模化量產,憑藉頂尖能效比與高性價比優勢,成功打入長城、比亞迪等主流車企供應鏈,鎖定超120萬套域控製器訂單,成為商湯近期最具份量的硬核成就,也徹底打破海外晶片在國內智駕算力領域的長期壟斷,為國產智能汽車產業築牢自主算力底座。這款由商湯完全自主研發的STPU 3.0晶片,核心性能指標堪稱行業標竿,尤其在能效比層面實現跨越式突破,達到400TOPS/W,大幅領先業內主流的輝達Orin晶片,徹底解決傳統智駕晶片算力強、功耗高、成本高的行業痛點。商湯針對智能汽車場景專屬最佳化晶片架構,兼顧高階輔助駕駛、智能座艙、車內外感知等多重需求,在保證極致算力的同時,大幅降低整車能耗與硬體成本,相比海外同類晶片,商湯這款自研晶片具備近40%的成本優勢,既能滿足車企規模化量產需求,又能有效下沉至更多主流車型,讓高階AI算力普惠更多消費者。商湯STPU 3.0晶片的量產落地,並非單純的硬體突破,而是商湯科技全端式AI技術閉環的集中體現。商湯依託自身深耕多年的電腦視覺、多模態大模型與智駕演算法優勢,實現晶片、演算法、域控製器的深度協同最佳化,打破“晶片+演算法”分離的行業常規,打造出一體化智能汽車解決方案。不同於單純的晶片設計廠商,商湯從底層晶片架構到上層智駕應用全程自主把控,晶片可完美適配商湯自研的城區NOA、高速領航、自動泊車等全套智駕方案,感知精度、響應速度與系統穩定性遠超行業通用方案,這也是商湯能夠快速拿下頭部車企大額訂單的核心競爭力。產業化落地層面,商湯這款自研晶片已進入批次裝車階段,相關智能座艙與智駕域控製器產品,逐步搭載於多款熱門量產車型,上半年智能汽車業務收入同比激增213%,成為商湯業績增長的核心新引擎。截至目前,商湯視覺AI與晶片方案累計賦能車型出貨量突破100萬輛,在中國汽車座艙視覺AI軟體市場連續多年穩居份額第一,隨著STPU 3.0晶片的持續放量,商湯在智能汽車領域的市場份額將進一步提升,穩固行業頭部地位。商湯用實打實的量產成果,證明了國產AI晶片完全具備比肩國際頂尖水平的實力,更走出了一條“演算法+晶片”深度融合的差異化賽道。此次商湯自研車規晶片的成功量產,不僅是商湯自身技術實力的重大跨越,更為整個國產智能汽車產業注入強大信心。長期以來,高端車規級AI晶片市場被海外廠商壟斷,國內車企面臨供應鏈受限、成本居高不下的困境,商湯的突破直接填補了國產自主車規AI晶片的高端空白,助力國內車企擺脫海外晶片依賴,實現核心零部件自主可控。同時,商湯依託晶片量產優勢,持續完善智能汽車生態佈局,聯動上下游產業鏈夥伴,推動智駕技術快速迭代,助力中國智能汽車產業邁向全球價值鏈高端。從實驗室研發到規模化量產,從技術突破到產業賦能,商湯始終堅持長期主義與原創初心,一步步攻克核心技術難關。商湯科技此次車規晶片的重磅落地,是商湯深耕智能汽車領域多年的成果結晶,更是商湯從AI演算法廠商向全端式硬科技企業轉型的關鍵里程碑。未來,商湯將持續迭代升級車規級AI晶片,深化與主流車企的合作,拓展更多智駕場景應用,以更硬核的晶片技術、更完善的解決方案,持續領跑智能汽車AI賽道,書寫屬於商湯的硬科技高品質發展新篇章。 (芯榜)一張圖直觀展現商湯2025年度業績:創新高!商湯2025年收入超50億元,半年EBITDA轉正
商湯閃崩8%!國泰君安證實有人被帶走,被涉及內幕交易的到底是那家公司
3月12日消息,3月10日,據彭博援引知情人士報導,香港有關當局突擊搜查了中信證券香港子公司以及國泰君安國際香港辦公室。據悉,香港當局突擊搜查了兩家公司負責股票資本市場(ECM)業務的部門,並帶走至少一名高級主管協助調查。由於ECM主要負責股權融資,比如新股發行、配股、供股、可轉債等股權融資業務。彼時金石雜談分析,本次突擊檢查兩家中資券商或和當前的港股新股發行亂像有關。而隨著資訊進一步求證,該事件並不涉及新股發行,而是配股引發的內幕交易。3月12日早間,國泰君安國際發佈公告,證實了相關事件。港證監和廉政公署到訪公司香港主要營業地點執行搜查令,並帶走部分檔案,公司一名非董事會成員的僱員被廉署拘留。到了中午,廉政公署和港證監官宣,3月10日及11日展開聯合行動,代號是“熔斷(Fuse)”,主要是打擊內幕交易及貪污行為,搜尋了14處地點,逮捕了6男2女,年齡介乎35歲至60歲之間,被捕人員包括兩家持牌證券公司及一家持牌避險基金管理公司的高階管理人員,以及一名中間人。(金石ps:再度證實,除了國泰君安國際還有中信證券香港子公司或中信里昂)根據公告,持牌證券公司的高級行政人員涉嫌接受持牌避險基金超過400萬元的賄賂,以獲取香港上市公司進行股份配售前的內幕消息,而避險基金則在資本市場賣空相關股票或訂立空頭頭存。隨著配股消息落地,相應股價下跌,避險基金通過做空獲利3.15億港元。另據香港知情人士對金石雜談表示,該案所涉避險基金是Infini Capital Management Ltd.,陳倩雯也被捲入了這場清剿行動中。這是一家專注於泛亞市場的另類投資機構,托尼·陳(Tony Chin,錢濤)是Infini Capital的創始人,曾任職於摩根士丹利和匯豐銀行,2011年起開始在中國內地開展交易,2015年進軍離岸市場,23年迎來了外部資金。托尼還是多家科技傳媒與電信(TMT)初創企業的大股東和董事會成員,這些企業後來成長為行業領軍者。其實,大家最為關心的還是,中信證券或國泰君安到底參與配股了那家公司,而被避險基金Infini Capital提前做空,實現非法獲利。金石雜談統計wind資料發現,近1年時間,由中信證券和國泰君安都參與的上市公司配售有商湯、佑駕創新、晶泰控股、一脈陽光、優必選,其中,兩家券商都參與的上市公司中,優必選和一脈陽光都是兩次。國泰君安和招銀國際還在9月參與商湯的配售。(以下是中信和國泰君安都參與承銷的配股公司)這6隻股票中,近60日跌幅較大的只有一脈陽光,跌幅高達52%;而年初至今,佑駕創新跌17%,優必選跌15%。此外,2025年以來,無極資本以獨家認購方式參與了多家港股上市公司的H股配售,投資對象包括黑芝麻智能、範式智能、微盟集團、協鑫科技、商湯、中國儒意等。對此,有香港分析師對金石雜談表示,無極資本應該通過做空某隻股票,然後通過配股的方式參與回購。(以下圖片來源活報告)在這其中,商湯和微盟的主承銷商是中信里昂和國泰君安,受此消息影響,商湯科技今日暴跌8%,2月23日以來已暴跌23.8%,微盟則跌幅有限。這是否商湯科技就是那隻被內幕交易的股票?金石雜談查詢發現,商湯7月配股之前,商湯股價長期在低位徘徊,配股以後,股價漲幅近乎翻倍,本次配股消息發出前下跌的不夠明顯,仍有待求證。但是,12月18日,商湯再度配股,在配股前1個月半月股價暴跌35%以上,但是本次承配人具體名單並未公佈。不少於6名承配人,17.5億股,對應市值33.08億港元。佑駕創新、晶泰控股、一脈陽光、優必選等股票走勢又如何呢?其中,1)佑駕創新11月25日配股前股價是跌了,但配股後也是一路下行,如果無極資本參與,是很難賺到錢的(6名配股人名單未公佈)。2)晶泰控股在8月29日配股之前股價一直在漲,配股後也是一直在漲,同樣不符合。3)一脈陽光同樣不符合,這種股價跌跌不休、沒有盈利空間的股票,相信無極資本是不會參與認購的。4)優必選7月22日這波不符合,前期一直在陰跌調整;而11月25日這波則恰到好處,在配股前一個半月跌幅超30%,同樣做空利潤豐厚。6名承配人共計認購3146.8萬股,對應當時市值34.8億。5)微盟集團9月18日配股前股價還在拉升中,配股後沒多久就經歷了暴跌,無極資本若參與是很難賺到錢的。6)國泰君安保薦的範式智能在7月17日配股前股價拉升,配股後也拉升,也不符合做空套利的情況。7)中信證券保薦的中國儒意,同時有無極資本參與,是否符合呢?8月1日配股,前期漲幅驚人,配股後一直陰跌,同樣不符合前期做空賺錢,後期認購賺錢的情況。綜上所述,金石雜談分析發現,商湯科技和優必選都存在因Infini Capital 通過內幕交易做空而實現違規盈利的可能,而無論商湯(12月配股)還是優必選(11月配股),都無法敲定是否有無極資本的參與。我們一起讓子彈飛一會,靜待市場開盲盒。 (金石雜談)