OpenAI發布ChatGPT Images 2.5:生成速度最高提升50%,AI修圖「指哪改哪」

華爾街見聞
09/09

美東時間9月8日周二,OpenAI正式推出ChatGPT Images 2.5,新一代圖像生成模型主打更快生成、更高保真度和更精準的多輪編輯。

OpenAI稱,相比上一代Images 2.0,Images 2.5的生成延遲最高降低50%,同時能夠更好地保留人物、寵物等參考對象的外貌特徵,並在連續多次修改後保持畫面細節和構圖的一致性。

這次升級的重點並不只是「生成一張更漂亮的圖片」,而是進一步降低AI圖像創作的操作門檻。

OpenAI新增名為Sketch的功能,用戶可以直接在ChatGPT中畫出草圖,讓AI據此生成完整圖片;新增的模板則可以幫助用戶快速製作海報、商品圖等常見視覺內容。此外,用戶現在可以直接在圖片上添加評論、圈出需要修改的位置,讓AI只改變指定部分,而無需反覆重寫提示詞。

OpenAI還同步面向開發者推出GPT-Image-2.5 Flare和GPT-Image-2.5 Sunburst兩款API模型。其中,Flare兼顧速度、質量和編輯能力,生成延遲較GPT-Image-2最高降低50%;Sunburst則針對需要更精細控制的專業創作場景,允許更長的生成時間換取更高精度。

不只是「畫得更好」:人物、寵物和細節保真度進一步提升

OpenAI此次首先強化的是圖像生成的「保真度」。

OpenAI表示,Images 2.5能夠更好地利用參考照片,將熟悉的人物、寵物等對象轉換到不同場景、視覺風格和構圖中,同時提高對光線、紋理以及人物獨特特徵的保留能力。對於需要持續製作系列素材的商業用戶,這意味着同一個人物、產品或品牌視覺元素在多次生成和修改後,更不容易「變臉」。

這一點也是此前AI圖像生成器的一大痛點:模型可能第一次生成得很好,但一旦用戶要求修改某個局部,人物五官、寵物外貌甚至整體構圖都可能發生變化。

OpenAI此次特別強調了「多輪編輯一致性」。在連續對話中,Images 2.5能夠更好地記住此前已經完成的修改,讓後續調整建立在上一版本基礎上,而不是每一次都重新生成一張「差不多」的圖片。

在提前體驗中,媒體Axios也觀察到了類似變化。該媒體測試了人物、寵物照片、紋身設計和Logo等任務,發現Images 2.5在保留人物和寵物特徵以及進行局部修改方面明顯改善。比如,Axios將一隻貓的照片轉換為電影黑色、彩色玻璃和文藝復興肖像等不同風格,模型仍能較好地抓住原照片中貓的特徵。

「圈哪裏、改哪裏」:AI修圖從改提示詞變成直接操作圖片

相比畫質提升,更值得關注的是Images 2.5對編輯方式的改變。

OpenAI新增了直接在圖片上添加評論的功能。用戶可以在畫面中指定一個位置,然後告訴AI「刪除這裏」「把這裏改成藍色」等,模型只針對指定區域進行修改,同時儘可能保持其餘部分不變。

Axios的實際測試顯示,這一方式尤其適合需要反覆調整的創作場景。例如,在紋身設計測試中,用戶上傳已有紋身照片,再要求AI增加新的元素,並通過圈選特定區域要求調整顏色和細節,模型可以根據這些局部指令繼續修改。

TechRadar則認為,這可能是Images 2.5最實用的升級之一。其測試發現,用戶過去需要不斷重新描述「把這裏變亮」「刪除背景中的人」等要求,而現在可以直接指出圖片中的具體位置再進行修改;編輯工具還包括刪除背景、擦除對象、調整尺寸等功能,並能夠回溯此前的不同版本。

這意味着AI修圖正在從「語言驅動」進一步走向「視覺交互」:用戶不必準確描述一個物體在圖片中的位置,只需直接指出它。

不會畫畫也能創作:Sketch把「草圖」變成成品

Images 2.5的另一個重要變化,是新增Sketch功能。

用戶可以直接在ChatGPT中畫一個非常粗略的草圖,例如畫出房間佈局、服裝輪廓或者一個簡單的物體,然後讓AI根據這張草圖生成完整圖片。OpenAI表示,用戶只需在ChatGPT中輸入「@Sketch」即可使用。

TechRadar實際測試認為,Sketch並不需要用戶具備繪畫能力,即便只是用鼠標或手指畫出簡單輪廓,也可以作為AI生成圖片的視覺參考。生成之後,用戶還可以繼續進入編輯模式進行調整。

Axios也將Sketch視為此次更新的重要變化之一。OpenAI圖像產品負責人Adele Li向Axios表示,Sketch和模板的設計目的之一,是讓用戶更多參與創作過程,而不是讓用戶成為一個完全被動的生成者。

她表示,OpenAI希望改變所謂的「單一AI審美」,並稱:「我不希望在現實世界裏一眼就能看出這是ChatGPT生成的東西,我希望人們能夠生成並表達自己的個性。」

這也透露出OpenAI對AI圖像產品定位的變化:AI不只是替用戶「做圖」,而是試圖成為創作過程中的工具,讓用戶保留更多控制權。

模板降低創作門檻,AI圖像開始瞄準「實際用途」

除了Sketch,OpenAI還加入了模板功能。

用戶可以從海報、商品圖等常見視覺格式開始,而不必面對一塊完全空白的畫布,再逐步補充文字、設計元素和風格。

TechRadar測試了商品圖模板:用戶上傳產品照片後,可以進一步選擇清潔攝影棚、編輯風格、生活方式等視覺風格,再選擇具體場景,由ChatGPT完成生成。該媒體認為,對於那些已經明確「想做什麼」但不知道如何開始的用戶,模板能夠明顯降低使用門檻。

OpenAI也在進一步加強圖像在商業工作流中的適用性。公司稱,Images 2.5不僅適用於個人創作,也針對營銷、零售、媒體等場景進行了優化,包括品牌素材、網站視覺、產品展示圖以及系列化內容生產等。

OpenAI官方數據顯示,目前用戶每周通過ChatGPT Images以及API中的GPT-Image系列模型生成超過30億張圖片。

API同步升級:Flare主打速度,Sunburst瞄準專業創作

在ChatGPT產品升級之外,OpenAI也在API端推出兩款新模型。

GPT-Image-2.5 Flare主打速度、質量和編輯能力,是面向大多數應用的默認選擇。OpenAI稱,Flare相比GPT-Image-2能夠提供更高質量的圖片,同時延遲降低50%,適合社交內容、創作者應用、商品體驗、視覺搜索以及大規模圖片生成等場景。

GPT-Image-2.5 Sunburst則定位更加專業。OpenAI表示,該模型針對需要更精細控制的高端視覺工作流設計,適用於廣告創意、生產級營銷素材和精細商品圖片等場景,以更長的生成時間換取更高的控制精度。

OpenAI披露,Higgsfield AI、Adobe和Manus已經開始使用新模型。其中,Manus表示,其評估顯示Flare的生成速度是GPT-Image-2的2至4倍,同時透明背景生成能力也有所提升。

「更像工具」而非「更像畫師」,OpenAI押注下一階段AI創作

從Images 2.0到2.5,OpenAI此次並沒有簡單追求模型「畫得更逼真」,而是把大量升級集中在控制、修改和連續創作上。

TechRadar在連續24小時測試後認為,這次升級雖然未必達到「Images 3.0」式的跨代變化,但改進已經足以改變日常使用方式;尤其是局部編輯、Sketch和模板,更可能成為用戶頻繁使用的功能。

Axios的體驗則顯示,隨着模型對人物特徵、局部細節和連續修改的掌控能力增強,AI生成圖片與傳統設計工具之間的界限正在進一步模糊。該媒體同時指出,AI生成圖像仍然存在明顯的倫理爭議,包括模型訓練所使用的藝術作品是否得到創作者授權和補償等問題。

而OpenAI顯然希望通過Sketch、模板和可視化編輯,把用戶重新拉回創作流程。

如果說早期AI圖像生成解決的是「我說一句話,你幫我畫出來」,那麼Images 2.5正在嘗試解決的是「我告訴你哪裏不對,你幫我把它改對」。

這或許纔是此次更新最值得關注的地方:AI圖像生成正在從一次性的「出圖工具」,進一步變成可以持續溝通、反覆修改並服務於真實創作流程的交互式設計工具

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10