登入
關鍵字
#NEXT
官方認證
RexAA
前天 12:26
•
突發!Claude Opus 5.2(Opus-Next)疑似全端灰測回歸
突然,Anthropic 拔網線了! 剛剛,AI圈發生了一件堪稱「午夜驚魂」的大事件:Anthropic 直接拔掉了新一代 Opus(內部代號 Opus-Next)的灰度測試網線! 之後,一天之內 Opus-Next 又回來了。 Opus 5.2 這次說不準馬上就來了。
科技
#Claude Opus 5.2
#Opus-Next
#Anthropic
66人
讚
留言
分享
品觀點
2026/09/07
•
《徐欣瑩出席竹仁國小校園音樂會 提「講客新竹」願景 帶動客家文化傳承》 立法委員徐欣瑩7日應邀出席新竹縣竹仁國小校園音樂會,與師生一同感受客語流行音樂的活力。徐欣瑩表示,語言傳承的核心在於口說,而展現語言真正的生命力則是「有多少人願意在生活中使用」。她提出未來新竹縣客語政策應從「學客語」進一步走向「用客語生活」,讓客語重新回到家庭、校園、社區、公共服務與年輕世代的創作之中。 徐欣瑩表示,校園客語音樂會最珍貴的地方,在於讓孩子發現,客語不只是課本裡的一種語言,也可以是流行音樂、舞台表演、創作與日常生活的一部分。她說,文化傳承如果只剩下「保存」,就容易和下一代產生距離;真正有生命力的文化,應該讓孩子願意使用、願意喜歡,也願意用自己的方式繼續創造。 徐欣瑩說,竹仁國小過去曾參與客語新校歌創作,校友音樂人也曾以校園、地方生活與共同記憶為素材,為學校創作客語歌曲《記得》。她表示,「記得」這兩個字本身就很有意義,文化是一種記得,記得自己的語言、土地、家鄉與上一代的聲音;但真正的傳承,不只是記得過去,更要讓下一代願意唱出自己的未來。
其他
#徐欣瑩
#新竹縣長參選人
#Hakka Next新竹客語新聲計畫
229人
讚
留言
分享
官方認證
美股艾大叔
2026/06/18
•
被蘋果踢出去的12年,賈伯斯學到了什麼?
商業思維 筆記君說: 1976年,賈伯斯在一個車庫裡創辦了蘋果。9年後,他被自己創辦的公司趕走。接下來的12年,他幾乎從公眾視野中消失了。 大多數人以為那只是一段短暫的過渡期,2026年5月出版的新書《Steve Jobs in Exile》(賈伯斯流亡記)告訴我們,事實遠比傳說殘酷。
理財
#蘋果
#賈伯斯
#NeXT電腦
233人
讚
留言
分享
官方認證
北風窗
2026/04/29
•
0.9秒破百!追覓的“火箭超跑”讓特斯拉都沉默了...
在追覓科技DREAME NEXT全球發佈會上,追覓星空計畫全球首發全新一代產品Nebula NEXT 01 JET Edition。據官方介紹,該車搭載專屬定製的雙固體火箭助推系統,可實現150毫秒響應、100千牛最大推力,零百加速0.9秒。該車還配備了專為其開發的雷射雷達DHX1。該雷達基於6D全彩千線雷射雷達平台,支援最高4320線全彩4K感知,最遠測距600米,在10%反射率下測距為400米,可識別300米內的水馬、280米內的小動物等目標。底盤方面採用全線控架構,整合14自由度非線性控制,支援橫向泊車、原地掉頭等高機動功能。據介面新聞報導,追覓星空計畫總裁馬俊野在採訪時透露,未來這款車將定向量產,定價或將在千萬元以上。(TechWeb)
汽車
#追覓科技
#全球發佈會
#DREAME NEXT
223人
讚
留言
分享
官方認證
美股探路客
2026/04/20
•
美股財經週報 2026.4.19伊朗再關閉霍姆茲海峽,4/21 美東晚間為美伊停火協議截止時間,週日巴基斯坦徵用上次舉辦美伊首次會談的酒店,預期第二輪談判舉辦在即,週二參議院銀行委員會將進行 Fed 新任主席提名人 Warsh 的聽證會,谷歌將在週三~五舉辦 Google Cloud Next 大會 ...週二 Fed 主席提名人 Warsh 聽證會除聚焦降息利率政策外,其主張結合大幅縮減 Fed 資產負債表與降息的方式將是觀察重點 ...Bloomberg 報導蓋洛普 2 月下旬的調查顯示,美國 Z 世代對 AI 越來越不感興趣,對 AI 憤怒的情緒攀升 …債券投資人已將戰爭風險拋諸腦後,JPMorgan 統計 4 月上半月投資人淨買入 5 億美元最低投資等級債券 ...FactSet 統計,華爾街預測科技 7 巨頭 Q1 EPS 年增率為 22.8%,但排除 Nvidia 後大幅下降至 6.4% …財報季開始一週,S&P 500 成分股已有 40 家下調業績指引,創下 2025 年 Q2 對等關稅以來最高水平 ...散戶強勢回歸,巴克萊散戶資金流監測指標自 4 月初觸底後急遽攀升,高盛最受散戶青睞的股票指數自 3 月底大幅反彈 22% ...
meiguinfo.com
美股財經週報 2026/4/19
2026/4/19~2026/4/24 美股探路客每週透過美股財經週報提供美股投資需知的重要財經資訊、投資觀察重點及未來一週的重要事件,幫助投資人瞭解投資美股需要的資訊,掌握市場脈動,幫助投資人輕鬆投資美股資訊。
美股
#Fed主席任命
#Google Cloud Next
#科技巨頭盈利增長
301人
讚
留言
分享
官方認證
北風窗
2026/01/11
•
已編輯
當姚順雨的巨臉降臨中國AGI
1月10日,AGI-NEXT前沿峰會的主會場大廳裡擠滿了人。這是由清華大學基礎模型北京市重點實驗室發起的前沿峰會。三個小時的議程,四個演講和一個pannel,總計六個嘉賓,幾乎每一個都是時下關注的熱門人物:比如,剛剛登陸港股的智譜創始人唐傑、不太愛出門參加活動的Kimi創始人楊植麟、正在向C端Super App發起衝鋒的阿里巴巴Qwen負責人林俊暘,以及近期在官宣加入騰訊後首次露面的前OpenAI研究員姚順雨。其中前三位分別做了技術報告分享,而姚順雨則參加了隨後的AGI-Next圓桌對話。在會議邀請函裡,姚順雨的名字出現在了一個不那麼起眼的角落裡:沒有主題報告,名字被悄悄放在了楊強、唐傑和林俊暘後面。但很快許多人都立刻意識到,這將是這位剛剛官宣加盟騰訊的前OpenAI研究員、網傳各種版本天價薪酬的合肥天才少年,作為中國估值最高的網際網路公司的AI一號位,在回國後的首次公開露面。從一開始,會場上的觀眾席裡彷彿就有一種默契。主持人開始介紹嘉賓,在一眾領導之後,不少人都伸長了脖子張望,但都沒有聽到那個期待中的名字。有人開始疑惑,但好像有些嘉賓的名字也沒有被提及,所以懷疑他可能是和其他人一同待在貴賓室裡。當然,或者可能乾脆未必真的會來——畢竟誰沒見過在活動當天爽約的“大佬”呢?這種懷疑在圓桌開始的那一刻幾乎被坐實了。圓桌原本有五個人,但舞台只搬上了四張沙發。LED大螢幕上還打出了姚順雨的銘牌,但他的頭像下卻空空如也。加拿大皇家科學院院士和工程院院士楊強、智譜創始人唐傑、Qwen負責人林俊暘和主持人、拾象科技創始人李廣密在台上一一落座。然後主持人開始對嘉賓講話。坐在我側前方的中年大哥說了一句,“哦,沒來啊。”主持人還沒提完問題,姚順雨巨大的騰訊會議頭像框就突然“閃現”在了三個嘉賓大佬的頭頂。那是滿滿一整屏的LED,把他的頭塑造得如此之大,以至於沒有一個嘉賓的高度能超過他的鼻尖。唐傑、楊強、林俊暘我上一次看到這樣的“奇景”,還是在《1984》。沒有觀眾能接受這樣戲劇性的一幕,於是會場爆發出了一陣熱烈的笑聲。剛才那位扼腕的大哥又說,“果然是YaoShunYu啊。”姚順雨似乎在視訊裡比照片更好看。他臉上堆滿了1998年生年輕人該有的膠原蛋白,發量充沛,笑起來很有鄰家大男孩的親和力——尤其在小紅書裡,大量的女性使用者湧入評論區稱讚他是“Hot Nerd”、“理想型之理想型”、“像許嵩”、“大臥蠶狗狗眼”,並為其“英年早婚”而深感惋惜。可能是看到了現場的情況,姚順雨頭顱左右轉動、眼神裡夾雜著一些迷茫。我當時看著那場面,心想那簡直就是過去半年時間裡,他本人在中國AGI江湖傳說的最佳側寫:這個年輕人以不置可否的網路傳聞方式,猝不及防地出現在了AI江湖裡,掌控了一家市值約等於字節跳動(3500億美金)和阿里巴巴(3600億美金)之和的超級網際網路公司(5.5兆港幣)的AI部門,最後無意間將那些年齡上能做他爺爺輩的研究者置於一種略顯尷尬的場面裡。而這背後巨大的故事張力,又在AI圈外塑造了一種遠遠超出技術與商業本身的爽文敘事。至於他本人的反應——他的理性非常清楚地知道自己的形象將處在一個巨大的會議廳裡,但身體的反應卻完全沒有處於嘈雜人群中的實感。面對身後的龐然大物,主持人選擇話頭扔給姚順雨。姚順雨此時像是反應過來,然後笑著問所有人,“我現在是不是一張巨大的臉在(螢幕上)”。所有人聽完又再笑。而這就是1998年出生的騰訊AI一號位,在中國頂級舞台首發亮相的第一分鐘。其樂融融。姚順雨講了麼?人們對姚順雨充滿好奇,除了對於年齡和網傳誇張年薪的反差感外,自然還包含了對騰訊接下來AI動向的好奇。正如Qwen林俊暘在回答主持人問題時,拿姚順雨打趣說:“一代一代的人塑造了這些公司,比如說今天順雨到騰訊之後,可能騰訊變成一個有著順雨基因的公司。”姚順雨在回答問題時,有時顯得很謹慎,說話比任何人都慢,會字斟句酌地吐出幾個同義詞。但我想,我們依然能夠通過這次對談,瞥見未來姚順雨乃至騰訊AI未來的審美偏好和發力方向。以下是對姚順雨相關表態的整理和分析:(一)“騰訊肯定還是一家To C基因更強的公司。”(1)我們會思考,怎麼樣能夠讓今天的大模型或者說AI的發展給使用者提供更多價值——很多時候是額外的Context。比如,今天我想去吃什麼?這個事情不需要更大的模型能力,而是需要額外的Context,比如今天特別冷,需要吃暖和的。我和老婆聊了很多天,可以把聊天記錄轉發給元寶。(2)對於To C來說,大部分人大部分時候不需要用到這麼強的智能,可能今天用ChatGPT和去年相比,寫成交代數和伽羅瓦理論的能力變強的,但是大部分人大部分時候感受不到。To C的問題是DAU等指標和模型智能不相關,甚至相反。(二)“ToB 在中國很難。”(1)生產力的革命,包括很多中國的公司做Coding Agent,需要打很多海外市場。我們會思考怎麼把自己先服務好。大公司本身就已經有各種各樣的應用場景、各種各樣需要生產力變得更好的地方。(2)“To B 的智能越高,代表生產力越高,值錢的也越來越多,大部分時候很多人就願意用最強的模型——強的模型和稍微差點,或者弱的模型它的分化會越來越明顯。(3)to B 的垂直整合未必成立,因為模型層和應用層需要的能力還是挺不一樣(比如ChatGPT Agent 相比於Manus);但 to C 的垂直可能還是成立的,無論是ChatGPT還是豆包,模型和產品是非常強耦合去緊密迭代的。(4)Anthropic不做什麼創新,老老實實把事情做好,就會有價值;(5)即便所有的模型訓練全部停止,to B也可以有很大的空間,為GDP提供5-10%的(正面)影響。(三)“自主學習在矽谷是一個共識”(回答下一個範式的問題)(1)自主學習不是一種方法論,而是資料或者任務,本質是討論基於什麼樣的獎勵函數;(2)ChatGPT在利用使用者的資料不斷彌合人聊天的風格;Claude 寫了Claude 項目95%的程式碼,這可能都是一種自我學習;(四)“中國對於刷榜和數字看得更重一些”(1)DeepSeek做得比較好;Claude在榜單不是很高,但是大家都知道這個東西好用。(五)“對於中國從跟隨者變引領者,我還是挺樂觀的”(1)任何一個事情一旦被發現,中國就很快會復現;(2)核心(變數之一)在於光刻機能否突破來解決算力優勢;林俊暘疑似對姚順雨部分觀點的不同意見:(一)關於自學習範式:人類不能通過互動讓AI變得更厲害,只會讓它上下文變得越來越長,AI變得越來越笨。自動化AI未必需要自主學習,AI訓練AI就會很強,但持續理解使用者會很重要。AI自主性可能導致安全風險,“比如說今天主動產生一些想法,往會場裡面扔一顆炸彈”。拿我們自己獻醜,我們自己的Memory看起來知道我過去幹了什麼,但是只是記起來過去事情,每次叫一遍我的名字,其實並不顯得你很聰明(未來是否實現還要看更多時間和技術觀測)(二)關於to B“垂直整合”邏輯未必成立:當然Manus確實很成功,套殼是不是未來,這本身也是個話題。今天到這個環節,我比較同意“模型即產品”。我們現在Agent已經變的託管式的Agent,而不是我要不斷給你來來回回互動的那種形式。從這個角度來說,它對模型的要求是很高的——模型就是這是這個Agent本身,Agent就是這個產品本身,如果它們都是一體化的話,今天做基礎模型本身,其實也就是在做產品。總結如果從姚順雨的發言,可以(不負責任地)大概猜到騰訊接下來的AI戰略:第一,騰訊會發力圍繞社交應用做Agent,重視上下文工程和自進化的主打C端市場。第二,B端市場繼續保守。第三,不會太去沖榜。姚順雨被官宣是他在騰訊漫長Landing的一個里程碑。但在如何把他的基因放進騰訊之前,可能先要想好,如何把騰訊的基因融進自己的身體裡。而相比於姚順雨的降臨,我們大概更期待他能給騰訊龐大生態帶來嶄新的變化。用姚順雨那篇知名的部落格的話說,我們正處在AI的中場休息——所以,“歡迎來到下半場”。姚順雨和他的騰訊AI會成為那個開球人嗎? (矽星人Pro)
科技
#姚順雨
#中國AGI
#AGI-NEXT
213人
讚
留言
分享
官方認證
鏈情局
2025/09/23
•
中國最大企業比特幣持有者擬募資5億美元增持比特幣
中國持有比特幣的最大上市公司——Next Technology Holding(以下簡稱“Next科技”)宣佈,計畫發售至多5億美元的普通股。此次募資所得資金將用於購買更多比特幣,並為公司營運提供支援。目前,該公司持有5,833枚比特幣,市值約6.718億美元,躋身全球企業比特幣庫儲存備量前20名。若此次新增資金的大部分用於增持比特幣,其持倉量有望突破8,000枚。在向美國證券交易委員會(SEC)提交的檔案中,Next科技表示,股票發行所獲淨收益將用於一般企業用途,其中包括收購比特幣。不過該公司也澄清說,尚未設定比特幣增持的固定目標,後續將根據市場情況評估後再決定是否進一步購買。這一舉措與當前的大趨勢相符——越來越多上市公司將比特幣視為戰略性儲備資產。資料顯示,2025年持有比特幣的上市公司數量已接近翻倍。目前這些公司持有的比特幣總量超過100萬枚,佔比特幣總供應量的5%以上。儘管有著長期佈局,但短期內Next科技的股價卻出現負面反應。該公司股票以“NXTT”為交易程式碼,在提交檔案當日的常規交易時段下跌約4.76%,盤後交易時段又進一步下跌7.43%。不過,該公司仍處於有利地位,因為其持有的大部分比特幣是在遠低於當前的價格水平購入的。從Next科技的增持歷史來看,該公司曾在2023年12月購入833枚比特幣,隨後在2025年3月又以每枚31,386美元的平均價格額外購入5,000枚。2025年9月,比特幣交易價格接近每枚11.5萬美元,該公司因此獲得了超過266%的帳面收益。儘管Next科技尚未披露比特幣儲備的長期目標,但其最新舉措凸顯出全球企業對在資產負債表中持有數位資產的信心正不斷增強。分析師認為,隨著更多企業採用這一策略,企業需求可能會對本就有限的比特幣供應量形成進一步上行壓力,進而影響加密貨幣市場的未來走向。 (Blockwind)
區塊鏈
#比特幣
#Next科技
#募資
227人
讚
留言
分享
官方認證
北風窗
2025/09/13
•
阿里Qwen3-Next商用:開啟mamba架構時代,訓練便宜10倍推理快10倍!
底層架構換代升級大模型開始彎道超車9月12日,阿里通義千問發表了全新大模型Qwen3-Next系列以及系列首款模型Qwen3-Next-80B-A3B。這是一款開放原始碼的超稀疏MoE模型,也是全球第一款將mamba線性注意力架構從科學研究領域帶入大眾市場的大模型,可望直接開啟大模型底層架構市場的全面變革。新模型最突出的就是在長上下文應用中的極高效率和速度,Qwen3-Next-80B-A3B總共擁有80B參數,但每個token僅啟動3.9B參數,相比Qwen3-32B這種更小的模型,訓練便宜10倍,推理快10倍。尤其是在32K+上下文中,這種成本和效率價值更加突出。千問官方表示:Qwen3-Next-80B-A3B-Instruct接近自家235B參數旗艦模型產品。 Qwen3-Next-80B-A3B-Thinking表現優於Gemini-2.5-Flash-Thinking。目前使用者可在anycoder平台體驗兩款模型的Vibe Coding能力,也可在Qwen Chat中直接使用。不過由於是全新大模型底層框架,與Transformer長期累積下來的技術堆疊相容性未知,需要開源社區進一步運作,才能真正形成技術變革。架構基礎資訊根據官方資訊,Qwen3-Next-80B-A3B 採用了混合Transformer-Mamba 架構,結合了以下關鍵技術創新:混合注意力機制(Hybrid Attention):模型將傳統Transformer 的注意力機制取代為3個Gated DeltaNet全新mamba線性注意力層(平行)與1個Gated Attention傳統softmax指數注意力層的組合。這種混合機制解決了大模型隨著輸入資料量增加算力消耗呈指數型增長的問題,最佳化了超長上下文建模的效率,支援高達256K 令牌的上下文長度,相對於傳統Transformer 模型在處理長序列時的高計算複雜度,顯著降低了計算成本。這也是新模型框架中「線性」和「指數性」的含義。高稀疏性混合專家(MoE)架構:Qwen3-Next-80B-A3B 使用了高稀疏性的Mixture-of-Experts(MoE)架構,512名專家,10名路由+1名共享,總計80B 參數,但每次推理僅啟動3.9B 參數。這種設計透過選擇性地啟動部分專家網路,極大地減少了每token的計算量(FLOPs),從而提升推理速度和效率。例如,在處理超過32K 令牌的上下文時,推理吞吐量是Qwen3-32B-Base 的10 倍,同時訓練成本僅為後者的10%。穩定性最佳化:模型引入了零中心化和權重衰減的層歸一化(LayerNorm)等技術,以增強預訓練和後訓練的穩定性。此外,多token預測(Multi-Token Prediction, MTP)技術進一步提升了預訓練效能與推理速度。支援多語言和複雜任務:Qwen3-Next-80B-A3B 支援119 種語言,擅長工具呼叫和複雜推理任務,效能在某些基準測試中可媲美Qwen3-235B-A22B-Instruct-2507。什麼是Mamba線性架構?Qwen3-Next-80B-A3B明確採用了Mamba 架構,作為其混合Transformer-Mamba 架構的一部分。具體來說:Mamba 架構簡介:Mamba 是一種基於狀態空間模型(State Space Models, SSMs)的架構,最初由Gu 和Dao 等人提出(參考arXiv:2312.00752)。與Transformer 的二次複雜度(O(n²))注意力機制不同,Mamba 使用線性複雜度(O(n))的計算方式,透過結構化狀態空間序列(Structured State Space Sequence, S4)來高效處理長序列資料。 Mamba 的核心優勢在於其高效的上下文建模能力和較低的記憶體佔用,特別適合超長上下文任務。但容易遺失海量資料中的長期關係,因此主流操作都是與Transformer混合使用。這也是未來大模型底層架構技術的重要發展方向。Qwen3-Next-80B-A3B 中的Mamba 實現:根據官方描述,Qwen3-Next-80B-A3B 的混合注意力機制中,Gated DeltaNet是Mamba 架構的關鍵組成部分。 Gated DeltaNet 結合了門控機制(Gating)和Mamba 的狀態空間模型,透過動態選擇性地處理輸入序列,最佳化了長上下文的建模效率。這種機制與傳統Transformer 的全域注意力不同,Mamba 的線性複雜度使得模型在處理長序列時能顯著減少計算資源需求。在具體實現上,Gated DeltaNet 和Gated Attention 的結合可能透過以下方式實現:Gated DeltaNet:基於Mamba 的狀態空間模型,使用門控機制動態調整狀態轉移的權重,以更好地捕捉序列中的長期依賴關係。Gated Attention:在局部或特定場景下補充Transformer 風格的注意力機制,增強模型在短距離依賴或複雜推理任務中的表現。這種混合設計允許模型在保持Mamba 高效性的同時,保留Transformer 在某些任務上的優勢。Mamba 在MoE 架構中的作用:Mamba 的線性複雜度與高稀疏性MoE 架構結合,進一步降低了計算量。 MoE 架構透過選擇性地啟動少量專家(3.9B 參數),而Mamba 的高效序列處理能力確保了即使在超長上下文下,模型也能快速完成推理。例如,官方資料表明,Qwen3-Next-80B-A3B 在處理32K 以上令牌時,推理吞吐量顯著優於傳統密集模型。如何實現Mamba 線性架構?Mamba 線性架構在Qwen3-Next-80B-A3B 中的實現可以從以下幾個方面進行推測和分析:狀態空間模型(SSM)核心:Mamba 的核心是基於狀態空間模型的序列建模,其數學形式可以簡化為:[h_t = A h_{t-1} + B x_t, \quad y_t = C h_t]其中( h_t ) 是隱狀態,( x_t ) 是輸入,( A )、( B ) 是可學習的參數、參數或可學習的參數。 Qwen3-Next-80B-A3B 的Gated DeltaNet 可能透過門控機制動態調整( A ) 和( B ),以增強模型對不同情境的適應性。門控機制增強:Gated DeltaNet 可能藉鑑了Mamba 的改進版本(如Mamba-2),透過引入門控單元(如類似LSTM 的門控結構)來控制資訊流,從而在保持線性複雜度的同時提升模型的表現力。與Transformer 的混合:混合架構的實現可能透過分層設計完成。例如,模型可能在較低層級使用Mamba 的Gated DeltaNet 處理長距離依賴,在較高層引入Gated Attention 進行局部精細化建模。這種分層策略平衡了效率和效能。穩定性最佳化:為確保Mamba 和MoE 的穩定性,Qwen3-Next-80B-A3B 可能採用了專門的訓練技巧,如GSPO(Gradient-based Sparse Parameter Optimization),以解決混合注意力機制和高稀疏性MoE 在強化學習(RL)訓練中的穩定性挑戰。性能與優勢透過結合Mamba 的線性架構和MoE 的稀疏性,Qwen3-Next-80B-A3B 實現了以下優勢:高效率的長上下文處理:支援256K token的上下文長度,推理吞吐量高,適合檔案總結、長對話等任務。低訓練和推理成本:相較於Qwen3-32B-Base,訓練成本降低至10%,推理效率提升10 倍。強大的任務表現:在複雜推理和工具呼叫任務中表現出色,與更大規模的模型(如Qwen3-235B)表現相當。 (AI頓悟湧現時)
科技
#阿里
#Qwen3-Next
#Mamba
280人
讚
留言
分享