OpenAI 正在推出 新版本 ChatGPT Images 承諾提供更好的後續操作、更準確的編輯以及高達 4 倍的圖像創建速度。
新模型稱為 GPT-Image-1.5,從周二開始通過應用程序編程接口 (API) 向所有 ChatGPT 用戶開放。自 OpenAI 首席執行官 Sam Altman 上個月在一份洩露的內部備忘錄中宣布“紅色代碼”之後,這是與穀歌 Gemini 競爭的最新升級。該備忘錄詳細介紹了在谷歌發布最新旗艦機型 Gemini 3 和最新版谷歌病毒圖像生成器 Nano Banana Pro 後,谷歌開始搶占市場份額後,OpenAI 計劃重新奪回人工智能領導者地位的計劃。 LMArena 排行榜 跨越多個標準。
儘管 OpenAI 上週推出了 GPT-5.2,使其成為迄今為止適合開發人員和日常專業使用的最先進模型,但谷歌仍保持領先地位。據報導,OpenAI 計劃在一月初發布一款新的圖像生成器,本週的公告加速了這些計劃的實施。該圖像模型最後一次發佈為 GPT-Image-1,於 4 月份發布。
GPT-Image-1.5 隨著圖像和視頻生成器的發展超越了原型設計並獲得了更多的生產就緒功能。與 Nano Banana Pro 一樣,ChatGPT Images 提供後期製作功能,提供更精細的編輯控制以保持視覺一致性,例如編輯過程中的面部形狀、燈光、構圖和色調。
大多數 GenAI 圖像工具在迭代方面表現不佳,因此這將是向前邁出的一大步。當向模特詢問特定的變化時,例如“調整面部表情”或“使燈光更酷”,模特通常會重新解釋整個圖像,從而導致不一致。
此次更新不僅限於新功能。 OpenAI 首席應用官 Fidji Simo 表示,現在還可以通過 ChatGPT 側邊欄中的專用入口點訪問 ChatGPT 圖像,該入口點“更像是一個創意工作室”。 圖書 在周二的博客文章中。
“新的圖像查看和編輯屏幕可以更輕鬆地創建符合您視覺的圖像或從流行提示和預製濾鏡中獲得靈感,”西莫寫道。
TechCrunch 活動
舊金山
|
2026年10月13-15日
除了新的圖像生成器之外,OpenAI 還引入了新方法,通過更多視覺元素來增強 ChatGPT 體驗。 Simo 表示,該計劃是讓搜索查詢顯示更多具有清晰來源的視覺效果,這對於轉換測量值或驗證數學結果等任務很有用。
“當你創作時,你需要能夠看到並塑造你正在製作的東西。當視覺效果比單獨的文字講述更好的故事時,ChatGPT 應該包括它們,”Simo 寫道。 “當您需要快速答案或下一步需要使用其他工具時,它就需要在那裡。當我們這樣做時,我們可以繼續彌合您的想法和將其變為現實的能力之間的距離。”










