9月16日,努比亞NaviX Ultra開售,這是首款搭載豆包手機助手消費者版的量產機型,由中興與字節跳動合作打造。豆包不是作為一個App裝進這台手機,而是與手機廠商在系統層面合作,可以接收使用者指令理解螢幕、檢索手機裡的資訊、呼叫系統工具,也能在使用者授權後操作其他App。
有媒體提前體驗了這台手機。鎖屏狀態下按住側面帶指紋辨識的AI鍵,用語音讓它去飛書群發會議邀請,全程不用解鎖;一句隨口說出的需求,就能讓它從相簿挑出短影片,參照一部電影開頭空鏡的風格剪成vlog。豆包方面稱,相比去年底的技術預覽版,這一代更強調穩定性和日常可用性。
兩天前,與豆包手機助手消費者版一同發佈的,還有一份看似不起眼的協議。
豆包手機助手稱其為螢幕自動化操作聲明協議(Screen Automation Execution Protocol,SAEP),針對的是豆包手機助手最受關注的能力:在圖形使用者介面(GUI)上像人一樣點選,幫使用者操作其他App。根據協議,第三方App可以自主聲明是否允許AI助手在本App內進行螢幕自動化操作,既可以整體拒絕,也可以只限制內容修改、最終發佈、刪除、簽到抽獎等具體操作。開發者可以接入協議聲明,也可以回覆官方郵件,兩種方式效力相同,拒絕隨時生效。
協議同步啟動30天公示。公示期內,助手只作業系統自帶App、字節跳動旗下App,以及明確同意接入的第三方App,其餘App一律不操作;公示期結束後,可操作範圍逐步擴大,明確拒絕的App始終不在範圍內。
使用者能否重新拿回「操作手機」的權利
這項能力並非首次亮相。2025年12月,豆包手機助手技術預覽版隨工程樣機推出,AI跨App自主操作的演示一度引發熱議。但驚豔很快轉為行業巨頭的警惕,多個頭部App隨即對其限制甚至封禁,也有使用者反饋帳號被異常退出或觸發風控。
衝突的根源在於,GUI技術不需要被操作的App配合。這一次,豆包手機助手沒有選擇繞開衝突,而是以一份公開協議的方式,重新回到談判桌。
爭議背後是一個客觀趨勢:智能體能力越來越強,輔助人們部分工作和生活不可避免。天津大學法學院講師高畫質純將其概括為,智能體經濟正從「資訊匹配」走向「自動化履約」。
PC是最先被改變的地方。2024年10月,Anthropic推出Computer Use,主流大模型第一次開放像人一樣看螢幕、移動滑鼠、敲擊鍵盤的能力;今年1月,Anthropic又發佈Claude Cowork,把這種能力延伸到普通知識工作;幾乎同時,開放原始碼專案OpenClaw迅速走紅,國內使用者把部署它戲稱為「養龍蝦」。這一撥爆發的關鍵,是AI可以自主操控電腦幹活,而不只是回答問題。
隨之而來的是一場AI辦公戰爭。字節的豆包工作、阿里的千問辦公、騰訊的WorkBuddy都已下場,各家宣傳語幾乎都落在同一件事上:一句話指揮AI把活幹完。9月初,OpenAI發佈GPT-6 Astra,更是給出了極具未來感的演示:發佈視訊裡,使用者只靠語音,就讓它把一個簡單的黃色圓圈改畫成火箭,再到三維建模軟體Blender裡做成模型,匯出可供3D列印的檔案,同時還讓它尋找午餐、預訂網球場。
不過,這些變化目前大多發生在PC上,並以辦公為主。生活同樣在等待被智能體服務,而手機是離這些需求最近的硬體。
使用者想要的是一句話點一份外賣、叫一輛車,或者讓AI在幾個平台之間比完價再下單。上海社科院法學所助理研究員屈然認為,消費者不僅有權選擇商品和服務,也有權選擇完成消費決策的工具。
但從PC到手機,差別在於控制權。使用者對PC有絕對的控制權,裝什麼軟體、讓AI操作什麼,自己說了算;在手機上卻沒有,想讓AI幫自己點一份外賣,還要看App答不答應。
手機上的兩條路
手機的封閉來自它的生態結構。網頁運行在開放標準之上,手機App則各自是封閉的系統,高頻生活服務集中在少數頭部App手裡。智能體進入這些App,大致有兩條路。
一條是許可制,以頭部App的生態為核心。App方為智能體專門開發介面,智能體只能在許可範圍內呼叫。今年6月,微信與華為、榮耀、小米等手機廠商合作推出A2A(Agent-to-Agent)能力,使用者用手機語音助手就能發微信、打視訊電話,但執行者是微信自己,開放那些功能、和誰合作,也由微信決定。GoogleAndroid的AppFunctions思路相同,與Gemini的整合仍在小範圍測試:App把部分功能登記為工具,獲授權的智能體才能呼叫。這種方式可控,但門檻高,App方要投入開發、雙方要談得攏,因此主要發生在頭部App與大廠之間。
另一條是聲明制,SAEP走的就是這條路。智能體一方公開規則,App方只需聲明允許、拒絕或限制那些具體操作,智能體通過GUI按聲明執行。兩者的區別在於,許可制要求App方做開發,聲明制只要求App方表態。SAEP希望覆蓋的正是許可制搆不著的大量中腰部App:它們沒有資源為AI開發介面,也不在任何談判名單上。有了標準化聲明管道,開發者一份聲明或一封郵件就能表態,持續有效,不必反覆溝通。
公示期是這套機制的關鍵。過去的衝突是事後發生的,使用者先用,平台再封;30天公示把它變成公開、事前、可以持續調整的規則協商。中國人民大學經濟學院講師李子碩主張,應鼓勵智能體平台與第三方平台通過商業協商解決問題,避免法律過早過快地釐定規則。
回到使用者這一端,頭一個月裡AI幫自己操作第三方App的範圍是縮小的,同一句指令在有些App裡能執行,在有些App裡不行。換來的是確定性:App方有了風控之外的表態管道。
本質上,這仍是一套需要多方協商的機制,網際網路上許多規則正是這樣誕生的。搜尋引擎時代的Robots協議,就是網站用一個檔案聲明那些內容不允許抓取,搜尋引擎據此執行。上海至融至澤律師事務所律師江國強指出,Robots協議並非監管強加,而是產業博弈出的默契,AI智能體時代也應允許類似默契生長,但司法須守住非歧視的底線。
Robots協議能成為共識,前提是主流搜尋引擎都願意遵守,網站也相信規則被一視同仁地執行。SAEP要走到那一步,還需要更多App方表態、更多助手廠商加入。接下來一個月有多少App願意表態、表了什麼態,會決定這台手機能幫使用者辦多少事。 (新皮層NewNewThing)
