登入
關鍵字
#視訊模型
官方認證
RexAA
2026/09/19
•
全球AI視訊模型“四強”會師,為什麼“理解世界”變得更加重要?
一年前,中國視訊模型在國際權威模型評測競技場上還只是零星出現。到2026年9月,字節Seedance2.0/2.5、MiniMax H3、阿里Wan 3.0和智象HiDream-O1-Video-1.0(下文簡稱HiDream V1)已相繼進入全球視訊生成模型頭部方陣。三個月內,四款模型密集上新,意味著中國力量正從單點突圍轉向叢集式上行。 但進入同一梯隊,並不意味著走的是同一條路。當畫質、時長和人物一致性逐漸成為基礎能力,競爭焦點開始從“生成得像不像”轉向“是否理解真實世界”。有人押注效率,有人依託規模與生態;智象選擇的切口,則是更懂物理規律與事件邏輯。HiDream V1由此成為觀察其“原生全模態世界模型”路線的一扇窗口。 四支力量,三種路線, 同一個梯隊
科技
#AI視訊模型
#字節
#Seedance2.0
225人
讚
留言
分享
官方認證
北風窗
2026/06/28
•
30秒直出!年賺20億美元!Seedance 2.5把對手甩開了一個時代!
今天AI圈最炸的一則新聞,就是在火山引擎FORCE大會上,字節官宣了全新AI視訊模型Seedance 2.5。 wuhu動畫人空間作為官方管道合作夥伴第一時間目睹了現場,你能想像一場AI大會超5萬人線下圍觀是一種什麼體驗? 早前業內都以為Seedance 2.0的下一個版本是2.1,畢竟2.0已經縱橫江湖無敵手了,沒想到一躍飛昇到了2.5,升級幅度遠超所有人預期。目前這款模型已經進入內測收尾,預計7月初就能對外開放使用。 那我們閒話少敘,直奔正題,看看這次Seedance 2.5到底給我們帶來了那些新的驚喜。
科技
#Seedance 2.5
#FORCE大會
#字節
250人
讚
留言
分享
官方認證
北風窗
2026/05/21
•
AI Coding之後,視訊模型正在跑通商業閉環
過去一年,AI行業最成功的賽道,非AI Coding莫屬。 從Cursor、GitHub Copilot,到Claude Code這類程式碼Agent,它們的價值非常直接:使用者每天都要寫程式碼,企業每天都要交付項目;只要AI能少寫幾行重複程式碼、少踩幾個bug、少花幾小時偵錯,價值就能被很快算出來。 但現在,另一個曾經被認為太燒錢、太炫技、太難賺錢的領域,也開始出現相同訊號。很可能是第二個有望跑通商業閉環的賽道。 它就是AI視訊模型。
科技
#AI Coding
#視訊模型
#商業閉環
240人
讚
留言
分享
官方認證
RexAA
2026/02/15
•
從Gemini到豆包:全球兩大AI巨頭為何走上同一條路?
視訊模型Seedance 2.0、圖像模型Seedream 5.0 Lite連續刷屏後,2月14日,字節跳動正式宣佈推出豆包大模型2.0(Doubao-Seed-2.0,簡稱豆包2.0)系列。自2023年,豆包大模型初始測試版上線,2024年正式對外發佈,豆包代際模型版本更新已經過去近一年半時間。其間持續在文字基礎、多模態強化、深度思考、Agent(智能體)執行等方面更新,直至此次版本,在2.0全能力升級。此次備受關注的2.0版本,具備全端模型矩陣 + 多模態理解 + 企業級 Agent + 極致成本四大差異化優勢,已躋身全球第一梯隊,成為 Agent 時代的關鍵玩家。在多項公開測試集上表現突出,接近Google Gemini3,和具備更高性價比。字節跳動官方明確表示,旗艦版豆包2.0 Pro“面向深度推理與長鏈路任務執行場景,全面對標GPT 5.2與Gemini 3 Pro”。從技術參數到產品定位,豆包2.0與Google Gemini的相似性正在從“對標”走向“一致”。而這種“一致”並非偶然的“撞車”,本質是全球頂尖AI實驗室在通往通用人工智慧(AGI)路徑上達成的戰略共識——AI最終需要為人類完成任務執行,而這需要對真實世界物理運行規律的理解。版本代際更新此次更新,豆包2.0 系列模型提供 Pro、Lite、Mini 三款不同尺寸的通用 Agent 模型。該系列通用模型的多模態理解能力實現全面升級,並強化了LLM 與Agent 能力,使模型在真實長鏈路任務中能夠穩定推進。同時進一步把能力邊界從競賽級推理擴展到研究級任務,在高經濟價值與科研價值任務評測中達到業界第一梯隊水平。據官方介紹,此次豆包2.0針對大規模生產環境的使用需求進行系統性最佳化,旨在更好地完成真實世界的複雜任務。其中,在語言模型基礎能力上,豆包2.0 Pro旗艦版取得IMO、CMO數學競賽和ICPC程式設計競賽金牌成績,數學和推理能力達到世界頂尖水平。另外,大模型執行長鏈路複雜任務,需要豐富的世界知識。豆包2.0加強了長尾領域知識覆蓋,在SuperGPQA等多項公開測試集上表現突出,科學領域知識測試成績與Gemini 3 Pro和GPT 5.2相當,在跨學科知識應用上也排名前列。在教育、娛樂、辦公等眾多場景中,大模型需要理解圖表、複雜文件、視訊等內容。對此,豆包2.0全面升級多模態理解能力,視覺推理、空間感知、長上下文理解等權威測試均取得業界最佳表現。面對動態場景,豆包2.0強化了對時間序列與運動感知的理解能力。以健身場景為例,接入豆包2.0的智能健身App可即時分析使用者動作視訊,一旦檢測到深蹲姿勢偏移,立即語音糾正——這正是環境感知與主動互動能力的落地。目前,這一能力已延伸至穿搭建議、老人看護等領域。Agent能力是大模型具備行動力的關鍵。測試成績顯示,豆包2.0 Pro在指令遵循、工具呼叫和Search Agent等評測中達到頂尖水平,在HLE-Text(人類的最後考試)上更是獲得54.2的最高分,大幅領先於其他模型。目前,豆包2.0 Pro已在豆包App、電腦客戶端和網頁版上線,使用者選擇專家模式即可對話體驗。火山引擎也已上線豆包2.0系列模型API服務。價格方面,豆包2.0 Pro按“輸入長度”區間定價,32k以內的輸入定價為3.2元/百萬tokens,輸出定價為16元/百萬tokens,相比Gemini 3 Pro和GPT 5.2有較大的成本優勢。豆包2.0 Lite更是極具性價比,綜合性能超越兩個月前發佈的上一代主力模型豆包1.8,百萬tokens輸入價格僅為0.6元。強化執行任務能力此次豆包2.0的全面升級,核心落點在“真實世界複雜任務的執行力”。而這一能力的根基,正是多模態理解層的突破——只有讓模型真正看懂物理世界的動態與邏輯,它才能從“答題者”進化為“執行者”。字節模型團隊觀察到一個典型失衡:語言模型已經可以順利解決競賽難題,但放在真實世界中,它們依然很難端到端地完成實際任務——比如一次性建構一個設計精良、功能完整的小程序。LLM 和 Agent 為什麼在處理現實問題時屢屢碰壁?團隊認為,原因主要來自兩點:真實世界任務往往跨越更長時間尺度、包含多個階段,而現有LLM Agent 難以自主建構高效工作流,並在長時間跨度中積累經驗;真實世界知識具有很強的領域壁壘且呈長尾分佈,各行業的經驗不在訓練語料的高頻區,導致即便模型擅長數學與程式碼,其在專業場景中往往價值有限。在提升了長程任務執行能力的同時,Seed2.0 還進一步降低了推理成本。其模型效果與業界頂尖大模型相當,同時 token 定價降低了約一個數量級。在現實世界的複雜任務中,由於大規模推理與長鏈路生成將消耗大量token,這一成本優勢將變得更為關鍵。另外在多模態理解能力方面,豆包2.0Pro在視覺推理、空間感知、運動理解、長視訊理解等維度,在大多數相關基準測試中取得最高分。此前刷屏AI視訊模型Seedance2.0正是多模態能力支撐的體現之一。Seedance 2.0核心升級主要體現在原聲音畫同步、多鏡頭長敘事、多模態可控生成。使用者輸入提示詞與參考圖,可一鍵生成帶完整原生音軌的多鏡頭視訊,模型自動解析敘事邏輯,確保角色、光影、風格與氛圍高度統一。此前馬斯克點評稱:模型發展非常迅速。據官方介紹,豆包2.0可以處理複雜視覺輸入,並完成即時互動和應用生成。無論是從圖像中提取結構化資訊,還是通過視覺輸入生成互動式內容,Seed2.0都能高效、穩定地完成任務。這正是Gemini一直強調的“原生多模態”能力——不是簡單拼接視覺與語言,而是在底層實現跨模態的深度對齊。豆包2.0的升級方向與Google的Gemini 3 Pro在視訊理解、空間推理上的優勢高度一致。而豆包2.0與Gemini在基礎模型層面均選擇死磕多模態,本質上是在進行一場 “世界模型”的軍備競賽。它們不再滿足於讓AI做一個“語言遊戲高手”,而是希望AI成為一個能看懂、聽懂、理解物理世界複雜性的“數字人類”。只有當模型真正理解了杯子為什麼會碎、人為什麼會笑、視訊裡的人在做什麼動作,它才能在現實世界中可靠地執行任務。 (第一財經)
科技
#Gemini
#豆包
#視訊模型
210人
讚
留言
分享
官方認證
北風窗
2026/02/13
•
馬斯克驚嘆“太快了”,字節3000億換AI下一個十年?
“發展太快了(It's happening fast)!”面對字節跳動視訊模型Seedance2.0在海外的病毒式刷屏,馬斯克在X上發出了這句感慨。2026年2月,字節跳動憑藉Seedance2.0再次在全球掀起歡呼。這款被《黑神話》創造者馮驥譽為“地表最強”的視訊生成AI,支援15秒、高品質、多鏡頭、音視訊的聯合生成,其帶給國內外的行業震撼,被譽為重現了視訊領域的“DeepSeek時刻”。軟體應用的突破之外,另一則消息炸裂行業:在底層硬體層面,字節正在就自研晶片項目SeedChip,與三星洽談代工。這些背後,是字節跳動長久的投入與決心。相較於去年1500億元投入AI,有消息稱,2026年字節跳動將繼續投入1600億元,支援AI發展。面對字節的狂飆突進,阿里巴巴、騰訊和DeepSeek個個摩拳擦掌,期望成為下一個十年定義者。01Seedance2.0:重構全球內容生態2月12日,字節跳動正式發佈視訊創作模型Seedance2.0,瞬間引爆行業。這款模型徹底擺脫了此前AI視訊炫技的套路,展現出了極具工業水準的導演感。它不僅支援文生視訊、圖生視訊,更實現了多模態“全能參考”——即打破了單一素材輸入的侷限,允許使用者同時上傳圖片、視訊、音訊等最多12個檔案。模型能精準理解這些素材,並按照指令參考其中的構圖、運鏡甚至音效特點。真正拉開差距的,是它對敘事邏輯的理解。Seedance2.0似乎知道什麼時候該切特寫,什麼時候該拉遠景,其分鏡設計具備明顯的角度切換。影視颶風創始人Tim在實測中發現,即便不提供音訊,模型竟然能自動匹配其個人聲音,並能腦補出建築物背面的景象。這種能力背後,是字節對視訊內容認知的降維打擊。全世界可能沒有第二家公司,比字節更懂什麼樣的畫面節奏、什麼樣的敘事能抓住眼球。Seedance2.0輸出的不是硬體,而是將字節積累了十年的視訊經驗,重構成了生成式AI的基因。Seedance2.0的出現,標誌著視訊生成賽道進入了精準可控時代。它模糊了專業技術的鴻溝,使得網文、短劇、廣告提案等環節可以實現24小時不間斷生產。中文線上、掌閱科技等公司在二級市場隨之暴漲,正是資本對這種生產力重構的直觀回應。對於國內外行業而言,Seedance2.0的影響是深遠的。它讓小型工作室和獨立創作者獲得了媲美專業團隊的能力。可以預見的是,AI將重構全球600億美元的內容生態市場。正如馬斯克所感,這股浪潮正在加速。它不只是字節秀肌肉的噱頭,而是一個關於講故事的權力如何被普惠的預告。過去一年時間中,字節在AI上取得的突破,遠不止Seedance。在C端,豆包App日活破億,登頂AI應用榜首;在B端,火山引擎在大模型雲服務市場份額位居第一;在硬體端,OlaFriend耳機等穿戴裝置已初具規模。字節的野心已昭然若揭:它要成為一家以AI為核心、軟硬一體的全球科技巨頭。與之對應的,字節跳動在AI領域的投入,同樣堪稱一場毫無保留的豪擲。據英國金融時報報導,2025年,字節的資本開支預算飆升至1500億元人民幣。2026年,這一數字被曝將達到1600億元。其中,超過一半的資金用於採購輝達晶片,和推進其高度機密的自研晶片項目SeedChip。021600億重塑AI底層長期以來,字節一直是輝達全球最大的客戶之一。2025年12月,豆包大模型的日均Token處理量已高達50兆,半年增長超200%。面對如此恐怖的算力黑洞,字節深知,光靠買卡是守不住護城河的。據路透社報導,字節正研發一款專為AI推理任務設計的晶片,已與三星電子洽談代工事宜,並計畫在2026年量產10-35萬片SeedChip。這一舉措的戰略意義不言而喻:它不僅是為了在HBM儲存晶片供應緊張的局面下尋求自保,更是為了實現從軟體演算法向軟硬一體的戰略升維。這種升級,體現在對算力成本的極致掌控,為視訊推薦、大模型推理這些算力怪獸定製最省錢、最高效的引擎。在字節內部,這種對基礎設施的死磕早已成了共識。2023年,字節跳動創始人張一鳴曾直言,當下這個時代的作業系統級機會就是AI +計算。為了抓住這個影響整個世界的機會,字節在基礎設施上幾乎不計代價,其2026年的AI資本開支甚至超過了一些科技巨頭去年投入的總和。這種飽和式的投入,目標極其明確:在自研晶片、大模型與雲服務之間建立起類似Google的全端式護城河。2025年,原Google DeepMind副總裁吳永輝加入字節,接管Seed部門,直接向梁汝波匯報。吳永輝上任後,主導打破了模型部門間的藩籬,實現了資料共享。字節的Infra(工程化能力)已達到國內頂尖水平,而自研晶片則是這條自主可控的最後一塊拼圖。當阿里推出真武晶片、百度讓崑崙芯籌備上市時,字節的入場意味著中國大廠正式進入了“自研晶片+大模型+雲服務”的全端競爭時代。這不再是簡單的修修補補,而是要從底層物理世界出發,重新定義AI時代的生產力成本與算力自主權。此外,媒體消息稱,字節在春節還將有大動作,將祭出了“全模態三件套”:豆包2.0、Seedream5.0和Seedance2.0。面對字節的步步緊逼,其它巨頭躍躍欲試,在春節期間同樣有大動作。阿里重新定義“通雲哥”敘事(AI、雲、晶片三位一體)的同時,正打通其最核心的電商、支付資產,試圖讓千問成為幫你點外賣、訂機票的全能助理。暫時落後的騰訊,在姚順雨入職後,騰訊混元大模型開始糾偏,從追逐榜單轉向真實場景。DeepSeek依然是那個最強變數。DeepSeekV4或將攜帶最強程式碼能力在春節前後突襲,挑戰所有巨頭。當字節的“全模態生成”、阿里的“生活代理”以及DeepSeek的“極致推理”全面落地,AI或將真正滲入人們的生活生產中去,成為下一個時代的“水電網”。而誰掌握終極入口,必定是兵家必爭之地。 (新質動能)
科技
#字節跳動
#視訊模型
#Seedance2.0
246人
讚
留言
分享
官方認證
RexAA
2026/02/10
•
視訊模型的兩條河流:字節跳動Seedance與OpenAI的分岔
誰擁有更多、更豐富的資料,誰的模型就越接近“全知”。圖片來源:AI生成當矽谷還在討論Sora的“世界模擬器”宏大敘事時,字節跳動用Seedance 2.0的發佈,悄然劃開了視訊生成領域的第二條河流。這兩條河流,一條向西,試圖窮盡物理世界的底層規律;一條向東,試圖解構人類內容的消費邏輯。2月9日凌晨,知名科技博主影視颶風Tim發佈了關於字節跳動Seedance 2.0的評測視訊,將其稱為“改變視訊行業的AI”。但這不僅僅是對字節跳動一家公司的評價,更像是對整個AI視訊生成賽道按下加速鍵。Seedance 2.0的發佈,以及Tim在評測中感受到的“恐怖”與“震撼”,標誌著這場戰爭已經從單純的參數競賽,進入了商業落地與倫理博弈的深水區。定義權之爭:物理引擎 vs 導演思維在OpenAI的敘事裡,Sora是“世界模擬器”,它試圖讓像素遵循牛頓定律,追求的是“模擬”。但在Seedance 2.0身上,字節跳動講了一個完全不同的故事。體驗過之後你會發現,它並不執著於做一個物理學家,它更像是一個極其成熟的“商業導演”,致力於讓鏡頭遵循視聽語言。Tim在視訊中透露了一個令人驚訝的細節:他在沒有上傳任何聲音檔案、任何提示的情況下,僅將自己的人臉照片上傳至模型,系統就能自動生成與他本人高度相似的聲音,甚至能精準匹配語氣特質。這種“無中生有”的匹配能力證明,Seedance 2.0掌握的Know-how不再是單純的視覺生成,而是對“人”的整體重構。它不需要你告訴它怎麼說話,因為它早就“認識”你。敘事的差異,最終投射在商業模式的殊途上。OpenAI依然沿襲著SaaS的精英主義邏輯,做“軍火商”,向專業人士販賣 API。而整合在字節生態中的Seedance 2.0,走的是“超級應用”(Super App)的邏輯,意在消滅專業門檻。當OpenAI還在思考如何讓好萊塢導演付費時,字節跳動似乎已經通過“造夢”,完成了對大眾創作者的一次技術平權。殊途同歸的“世界模型”競賽如果把視角拉得更遠,我們會發現字節跳動並不孤獨。在過去的一年裡,視訊生成模型顯得擁擠不堪,全球科技巨頭正集體奔赴同一個終極目標:建構一個能夠理解、模擬甚至預測現實世界的“世界模型”(World Model)。OpenAI(Sora)試圖用Transformer架構讓AI理解物理規律。Google(Veo/Lumiere)憑藉其在YouTube上的積累,試圖解決長視訊的一致性問題。NVIDIA則試圖在工業層面1:1還原物理世界,服務於機器人訓練。而在中國,快手可靈、阿里通義與騰訊混元也在瘋狂迭代,試圖在C端應用上搶佔先機。在這場軍備競賽中,資料是唯一的燃料。無論是OpenAI還是字節跳動,誰擁有更多、更豐富的資料,誰的模型就越接近“全知”。Tim在評測中提到了一個讓他倍感“恐怖”的瞬間,揭示了當前頂級模型的共同特徵:“最恐怖的一點是不只我的聲音,我們上傳的照片只有樓的正面,但是生成出來的運鏡,可以轉到樓的另一面,它知道我背後的東西是什麼,即便我沒有告訴它。”這棟樓的背面,可能出現在影視颶風過去的某個視訊裡,也可能出現在其他使用者的街拍中。AI將這些碎片化的資訊拼接,在神經網路中重建了這棟樓的3D結構。不僅僅是字節,OpenAI的Sora之所以能生成逼真的東京街頭,Google的模型之所以能生成流暢的動作,背後都是對海量公開網際網路資料的學習。技術倫理的邊界這引出了一個全行業都需要正視的命題:我們與平台之間,是否存在一份“隱形的契約”?過去,我們認為自己在免費使用平台發佈內容,換取流量和關注。但在AI時代,這份契約增加了新的條款:你的行為、你的影像、你的聲音,都將成為訓練“世界模型”的養料。Tim在測試中發現,Seedance 2.0對其他博主(比如何同學)的形象還原度極高。這意味著,在這個閉環裡,創作者不僅是內容的使用者,更是內容的“原材料”。 只要你在網際網路上留下了足夠的痕跡,你就在某種程度上被AI “數位化”了。這是一個中性的技術事實,但它帶來了不得不思考的後果。正如 Tim 在視訊末尾的警示:“你現在就能夠看到,如果一個人的資料,全部進入了AI的資料集,會發生什麼。它能夠100%模擬出你的任何形態,還有聲音,那請問這樣的內容你的家人分得出真假嗎?”這並非針對某一家公司的指責,而是技術發展到特定階段的必然拷問。當 Google、OpenAI、字節跳動和NVIDIA的模型都足夠強大時,“真實”的定義將被永久改寫。影視颶風Tim說:“改變視訊行業的AI,快來了。”但在我們看來,它其實已經到了。Seedance 2.0隻是全球“世界模型”浪潮中的一個縮影。在這場中美科技巨頭的集體衝鋒中,視訊生成正在從“炫技”走向“實用”,從“模擬物理”走向“重構現實”。對於身處其中的每一個創作者和使用者而言,我們既是這場技術革命的受益者,也是它最基礎的貢獻者。未來已來,只是分佈在每一個被AI記住的鏡頭裡。 (鈦媒體AGI)
科技
#視訊模型
#字節跳動
#Seedance
271人
讚
留言
分享
官方認證
北風窗
2026/02/10
•
Seedance 火了!
字節又一款AI產品火了!字節新 AI :Seedance2.0,60 秒齣電影級視訊逼瘋玩家!那麼,Seedance 是什麼?深科技馬上帶大家共同瞭解!炸圈暴擊!字節再出王炸,Seedance2.0刷屏!2026年開年第一瓜被字節拿捏!Seedance2.0 AI視訊模型猝不及防刷屏海內外,成為新年AI黑馬,風頭蓋過快手可靈(Kling)和Sora,網友直呼“字節藏大招”。不同於以往AI視訊模型的“雷聲大雨點小”,Seedance2.0憑文字或單張圖片,60秒內就能生成帶原生音訊的電影級多鏡頭視訊,其獨家雙分支架構可實現音視訊同步生成,無需後期拼接。圖源:影視颶風它出圈的兩大關鍵:一是獨有多鏡頭敘事功能,輸入一個提示詞就能生成關聯場景,保證角色、風格連貫,無需手動剪輯;二是廠商力挺,開源證券稱其在自運鏡、音畫同步等方面實現突破,堪稱AI影視“奇點時刻”。知名博主影視颶風的評測,更是將其推上頂峰。測評顯示,其分鏡切換、音畫匹配遠超預期,能像真人導演一樣調整機位,網友看完紛紛求內測資格。官方直言,其2K視訊生成速度比可靈快30%,精準避開Sora、可靈的短板,主打“人無我有”,網友笑稱“字節把同行卷哭了”。 (深科技)
科技
#Seedance
#字節
#電影級視訊
264人
讚
留言
分享
官方認證
RexAA
2025/10/17
•
Sora2,AI幫你賺錢的時候到了
真正改變遊戲規則的創新者,往往是在“無人區”中開闢新大陸的人。當OpenAI發佈其新一代AI視訊模型Sora2的演示視訊時,整個科技圈為之震動。視訊10秒出片,並且自帶高度逼真的物理邏輯、如電影運鏡般的多鏡頭切換……其能力已無限逼近人類專業創作者。東莞證券在隨後發佈的研報中稱“Sora2及其配套社交應用的發佈標誌著AI視訊生成與社互動動進入融合階段,有望重塑內容創作和分發生態,或迎來AI視訊生成的ChatGPT時刻。”這個比喻精準地戳中了行業的神經。因為,ChatGPT是人工智慧技術“量變”引發“質變”的代表,標誌了機器學習大模型、大訓練資料和大算力能夠到達的新高度。更令人震撼的是,Sora2不再是一個單純的視訊生成工具,而是一場徹頭徹尾的革命——與視訊緊密相連的影視劇、社交、電商等行業,也將迎來生態重構,甚至許多商業模式也被重塑。對普通人來講,一個更直接的問題是,Sora2將如何改變人們賺錢的方式?Sora App上線第四天,就拿下了蘋果美國應用程式商店App Store的免費應用榜第一名,超越了Gemini和ChatGPT,堪稱“出道即頂流”。據Appfigures估算,Sora iOS版上線僅兩天,總下載量高達16.4萬次,首發下載量達5.6萬次。圖註:App Store截圖Sora APP的爆火,一方面源自其自身提出的兩大顛覆性AIGC社交功能——客串(Cameo)和二次創作(Remix)。客串(Cameo)的核心工作原理源於OpenAI正在建構的世界模擬模型(world simulation models)。使用者只需提供一個簡單的視訊素材,就能將自己或朋友“傳送”到古羅馬鬥獸場、未來賽博朋克都市、遊戲裡的場景等等,或是任何能夠想像到的場景中,並讓他們在其中自然地活動和互動。二次創作(Remix)是Sora App的一個核心互動機制。當使用者看到一個喜歡的視訊時,可以點選Remix按鈕,在其基礎上進行二次創作。例如,看到鋼鐵人和蜘蛛俠的視訊,使用者可以輸入新的提示詞,如“把我的照片融入進去”,Sora就會生成一個全新的、與原作相關聯的視訊,展示出“我與蜘蛛俠互動”的內容。這個功能極大地降低了參與熱門趨勢和故事線的門檻,讓每個人可以輕鬆參與AIGC製作。另一方面,OpenAI首席執行官Sam Altman(山姆·奧特曼)親自下場,開放了個人肖像權,也加速了Sora的火爆。在國外的社交平台上,Sam Altman從商店偷GPU被抓包、在金字塔前熱舞、與李小龍對打、跟科比打籃球,細節逼真到以假亂真。在國內的小紅書上,一些“手快”的博主,已經讓Sam Altman參與直播帶貨,熟悉的“321,上連結!”從他嘴裡說出來也毫無違和感。圖源:小紅書基於成品視訊流暢的表現,Sora2也給更多行業帶來新的想像空間。以電商領域為例,目前,OpenAI形成以“內容平台激發需求(Sora)—支付管道保障(Stripe)—電商平台供給商品(Shopify/Etsy)”的商業模式閉環。隨著全球範圍內視訊種草、直播帶貨接受度越來越高,通過“代理商務協議”(Agentic Commerce Protocol,ACP),Sora有望開啟“端到端”的新電商模式。並且,OpenAI似乎也在逐步強化這種電商基因。幾天前,OpenAI宣佈推出全新的“Instant Checkout”即時結帳功能,允許使用者直接通過其AI聊天機器人ChatGPT內容完成商品購買,這也標誌著OpenAI與電商的融合進一步加速,ChatGPT也輕鬆實現了從“商品推薦”到“直接支付”的全鏈路閉環。未來如果由Sora一鍵生成的商品展示視訊、買家秀合集等內容也進入這一電商閉環,並與主流電商平台API打通,則有望形成一個區別於傳統電商平台的新的“人貨場”邏輯。與此同時,廣告行銷成本也大幅降低,過去,高昂的製作成本、漫長的周期與專業的門檻,是桎梏電商賣家進行大規模擴張的瓶頸,如今這不再是難題。Agent Platform廠商述信科技CEO彭聖才指出,Sora2這種工具型產品出現,會帶把一些以前不成立的商業模式變成現實、甚至直接創造一些新的模式出來。比如說一款產品出海,在以前需要找代理、找管道、做品牌行銷,一點點去鋪貨,各個環節都要考慮到。現在借助AI等新興技術,可以直接打通整個環節。目前,市面上已經出現一些新興公司,依託中國本土強大的供應鏈和生產能力,借助AI提供的行銷、投流、客服等功能,把貨帶到海外市場。這與傳統的出海模式截然不同,甚至是一些“一個人公司”也可以完成全套流程,對於這些企業來說,AI的出現就像是給業務插上了翅膀,讓以前不能做的生意好做了,讓本來打不開的市場打開了。但這種AI主導的電商模式,也對品牌提出了更高要求。彭聖才指出,以前做產品是“管道為王”,要儘可能多的去覆蓋管道,讓不同消費者能在不同管道上盡快找到我,平台扮演的角色十分重要。但是AI出來之後,消費者很可能只是用一句話來描述自己需要的產品或者服務,餘下的都靠AI來匹配,管道的價值就會衰減,而品牌的價值被放大。在這種模式下,唯一能爭取到AI帶來的消費位置的方式就是做好品牌。“以前,我們要花很多錢做市場、搞行銷、搞投放,但現在只需要把自己的商品和服務做好,然後通過MCP的方式散發給AI,AI就會根據使用者的指令精準找到這個商品,這對於整個行業幾乎是顛覆性的,但長遠來看有利於行業生態的健康發展。”彭聖才說道。(註:MCP,是Model Context Protocol的縮寫,即模型上下文協議,它是一個開源標準,用於將AI應用程式連接到外部系統。基於MCP協議,各大AI應用程式可以連接到資料來源,工具和工作流,使它們能夠訪問關鍵資訊並執行任務。)更顛覆的是,由Sora2驅動的Sora App對標TikTok的滑動操作模式,直接降低了C端使用者使用的門檻。外界一致認為,它“掀了短影片的桌子”,甚至對廣告、明星代言、影視劇、創意產業的商業模式都形成巨大威脅。今年9月,TVB上線了一部100%AI生成短劇——《在我心中,你是獨一無二》,劇中主角、群演、場景、配樂等等全部由AI生成。換句話說,在這部短劇的製作中,AI承擔了“編劇+導演+美術+剪輯+後期”的全部職責,甚至在末端的營運、投流環節中也發揮了巨大作用。從技術層面看,Sora已經可以生成時長25秒(普通使用者在App和網頁端15秒,Pro使用者網頁端可達25秒)、接近4K細節的短影片,畫面更加銳利,幀與幀之間延續性更好,甚至可以實現多語言同步翻譯。GoogleVeo2升級後,也可以提供4K電影級畫質、2分鐘以上的精美視訊。這些工具確實幫助實現了內容生產的質效飛躍。隨著AI深度參與短劇製作各關鍵環節,它成為降本增效的核心動能。在製作端,從AI生成劇本與分鏡,到虛擬製片與智能剪輯,大幅壓縮了創意到成片的時間;在營運端,AI可以智能生成海量行銷素材進行A/B測試,實現精準投放,同時通過使用者資料分析,進一步反哺創作,完成內容持續最佳化。傳統短劇製作需要2-3個月製作周期、50-200萬試錯成本,這已經是行業壓縮到極致的成本線。但是AI短劇已經進化到10-15天出片、6-15萬低成本試錯,單整合本最多可下降90%。這些都給蓬勃發展的短劇行業帶來新的想像力。另一方面,Sora的影響力還波及到社交領域。手指滑動的互動方式,讓它被稱為“AI版抖音”。使用者可通過上傳圖片結合文字提示創作,或使用客串功能,基於自己或朋友形象生成視訊,這種強互動性與親近感,使得Sora App擁有極強的社交屬性。“瀏覽-激發-創作-分享”的閉環一旦轉動,使用者便被牢牢吸附在平台內,每一次創作都在為生態貢獻新的素材和範本,形成內容自然生長的生態,即“使用者資料飛輪”。“AI+社交”可能會成為未來的主流形態。Sora2對廣告行業的影響也備受關注。但目前看,其衝擊力尚未呈現。彭聖才舉了個例子,在廣告行銷行業,文案、圖片、視訊等內容的生產其實是產業鏈的末端環節。而且這個末端通常也由一整個團隊負責,內部還分策劃、美術、編導、剪輯等等職責,Sora2可能只是對那個視訊製作者(或剪輯師)有一定影響,但是放在廣告行銷這個存在了百年的產業鏈條上,Sora2隻影響了末端的那個佔比不到1%的環節。所以他覺得“Sora2很難對整個鏈條產生那麼大的衝擊和影響”。但彭聖才也指出,Sora2的出現確實會帶來成本下降和效率提高,進而幫助一部分人吃到紅利。比如,在廣告主採購視訊廣告內容的採購價不變的前提下,AI用的好的人,可以借助Sora2等工具把視訊生產的效率提高十倍甚至百倍,售價相同但成本更低了,收益自然也會隨之擴大。“但這種紅利僅體現在短期內,因為後果是可以預見的,供給越來越多之後,大家自然而然就會開始卷,同樣的價格,有人能出10條視訊,後面就會有人敢出50條、100條視訊。所以在大部分人還沒能很熟練運用AI生成視訊的這段窗口期內,確實有些人可以賺到錢。只是這個窗口期不會太長,我預測可能也就半年左右。”彭聖才預測。Sora2更大的貢獻在於,它給整個行業提供了一種新的變現思路。過去幾年,全球頭部大模型產品以及垂直領域應用多數採用“訂閱付費”的模式進行變現,即通過按月或季度固定收費,提供一定量的API呼叫服務。而Sam Altman在部落格中公開宣佈,公司將引入“IP分成”收益機制。具體來看,這個機制包含兩步,一是賦予版權方更細粒度的控制權,IP擁有者可設定角色是否及如何被使用;二是探索收入分成模式,當使用者使用授權角色生成視訊並產生收益時,版權方可獲得相應分成。如此一來,思路一下就打開了。過去幾年,迪士尼、漫威、華納兄弟、任天堂等版權巨頭,一直在全球範圍內積極維權,努力避免自己的IP被AI工具使用者侵權。比如著名的文字生成圖片AI應用Midjourney,就在今年的6月至9月間,密集地被迪士尼、環球影業和華納兄弟三家公司送上“被告席”。而Sam Altman把雙方“敵對”的關係轉化為“共贏”,對於上述版權巨頭而言,如果自家IP能被更多垂直領域的創作者使用,無疑會進一步擴大自己的影響力,也可以順便從中獲得一定的分成;而對於活躍在網路上的內容創作者而言,能合法的使用經典IP形象,給他們提供了更豐富的創作靈感,也可以在一定程度上避免同質化的現象。參考YouTube的成功經驗來看,這種模式也有利於整個行業的健康發展。YouTube曾花費大量時間,建立了一套成熟的版權識別和收益共享系統。當博主在作品中使用了某段受版權保護的音樂或影視片段時,YouTube會自動識別並進行記錄,然後將這段視訊產生的廣告收入,按照約定的比例分配給創作者、平台以及版權所有者。多方共贏的方式,也幫助YouTube成為全球範圍內最具影響力的視訊網站之一。據預測,YouTube的全球月活躍使用者(MAU)將在2025年突破28.5億,覆蓋全球51%的網際網路使用者。而Sam Altman的設想,就是要建立一套類似的分成體系。使用者借助Sora2來製作視訊內容,平台對每一個內容進行記錄和追蹤,如果涉及到授權IP,則按照約定的比例完成收益分配。中研普華產業研究院公佈的《2025-2030年中國AI視訊行業全景調研與投資前景預測報告》顯示,2023年,全球AI視訊市場規模已達到420億美元。創作者成功、則平台成功,無論是AI生圖還是AI視訊,都已經被越來越多的創作者接受。如果Sam Altman的設想成真,Sora App將不再是簡單的工具,而是一個連接IP授權方與全球億萬創作者、直通百億美元大市場的全新數字經濟生態。但另一方面,“隔屏如隔山”,當AI生成的視訊足以“以假亂真”,當眼見不再為實成為常態,如何區分虛擬與現實將成為一個難題。一位從業者的觀點是,“不必刻意去區分真的假的,學會適應才是常態”。比如在直播電商領域,虛擬主播已經十分常見。根據市場調研機構QYResearch的統計及預測,2023年全球虛擬偶像與虛擬主播市場銷售額達到了10.83億美元,預計2030年將達到51.29億美元。“很多人已經不再去刻意區分主播是真人還是虛擬人,或者說是放棄了這個動作。畢竟我做消費決策不取決於螢幕裡的人像,而更多取決於我對他態度、語氣、氛圍的感覺,或者說取決於直播間裡產品品牌的信任程度。”該從業者表示。 (霞光社)
科技
#Sora2
#AI視訊模型
#OpenAI
222人
讚
留言
分享