當地時間9月8日,OpenAI推出圖像生成模型ChatGPT Images 2.5,在生成速度、畫面細節、局部編輯穩定性上完成多項核心升級,同步上線手繪草圖生成、圖片定點修改等互動功能。
相比上一代ChatGPT Images 2.0,新版本最直觀的變化是生成時延降低,官方資料顯示圖像生成延遲最高可減少50%,大幅縮短使用者等待圖片輸出的時間。
除速度最佳化外,模型在畫面細節、光影材質還原能力上得到強化,重點解決舊版本多輪編輯容易出現主體變形、構圖崩壞的痛點。當使用者對圖片進行局部修改指令時,模型可以精準鎖定需要調整的區域,保留原圖人物主體、產品外形、畫面構圖與整體風格,大幅降低創作者反覆偵錯提示詞的成本。
產品端配套新增多項創作工具,其中Sketch手繪功能是本次更新的亮點,使用者不需要具備專業繪畫功底,僅勾勒基礎構圖就能快速把構思轉化為成品圖。
ChatGPT Images 2.5現已面向所有ChatGPT、ChatGPT Work和Codex使用者開放,支援桌面端、移動端和網頁端。
此外,GPT-Image-2.5 Sunburst和GPT-Image-2.5 Flare模型已通過API提供。Flare作為通用版本,具有2.5系列速度、畫質與編輯能力,適合社交媒體素材、產品原型、大批次圖像生成場景;Sunburst主打高精度精細編輯,面向廣告大片、商業產品圖等專業生產級視覺內容,圖像可控性更強,但生成耗時更長。
在AI圖像生成賽道,ChatGPT Images 2.5的核心差異化優勢在於深度嵌入對話互動鏈路。當前市場中,Midjourney在藝術質感、電影感畫面輸出上仍保持優勢,但產品缺少原生對話互動與草圖輸入能力,上手門檻更高;Adobe Firefly 依託創意軟體生態,在商用版權保障方面更有競爭力,但獨立對話創作能力偏弱;Google Gemini 內建圖像模型在品牌一致性控制上仍存在短板。
據OpenAI 披露,ChatGPT Images系列模型及對應API每周圖像產出總量超過 30 億張。
本次圖像模型更新,是OpenAI近期密集產品迭代之一。就在9月3日,公司發佈旗艦大模型 GPT-6 Astra,強化自主電腦操作、複雜推理、程式設計與科研任務處理能力,支援直接識別螢幕像素並模擬鍵鼠操作,可直接操作各類軟體介面,被視作其推進智能體能力的重要一步。
OpenAI 聯合創始人兼總裁格雷格・布羅克曼在發佈電話會議上表示,“歡迎來到AGI時代”。
9月7日,黃仁勳在社交平台發文稱,OpenAI從發佈ChatGPT到o1再到Astra只用了4年。“AGI已經到來,恭喜OpenAI團隊。”
不過,9月6日,OpenAI首席科學家雅各布・帕喬基(Jakub Pachocki)在官網發佈萬字長文,稱人類已經創造出一套難以完整理解的智能體系,全人類尚未做好應對超級智能快速演進的準備,呼籲全球AI研發主動放緩全速擴張節奏。 (介面新聞)
