AI 科技新聞站每日更新
AI 科技2026年8月13日

ChatGPT Images 2.0 怎麼用:從零開始的完整實測教學

A
AI 觀察家
專欄作者 · 2776 字
ChatGPT Images 2.0 怎麼用:從零開始的完整實測教學

做完這篇你能得到什麼

ChatGPT Images 2.0 在 2026 年中正式全面推出,相比舊版 DALL-E 整合,這次的升級幅度大到幾乎是換了一個底層邏輯——文字渲染準確多了、指令跟隨能力強了、連多輪對話修圖也變得可行。如果你上次試 AI 圖像生成是一兩年前的事,現在值得重開一局。

這篇會直接告訴你怎麼操作、怎麼寫提示詞、碰到什麼問題怎麼繞過去,讀完你應該能在 15 分鐘內跑完第一張圖到輸出成品的完整流程。


你需要準備什麼

  • ChatGPT 帳號,Plus、Pro 或 Team 方案都能用 Images 2.0;Free 方案目前有每日限制(約 2 張)
  • 瀏覽器或 ChatGPT 手機 app,功能一樣,手機端甚至支援相機直接上傳
  • 如果你要做品牌物料或有一致風格需求,先準備好 1~2 張參考圖

Step 1:進入圖像模式,確認你用的是 Images 2.0

登入 ChatGPT 之後,開一個新對話,在輸入框左側找到「+」或附件圖示旁邊的影像生成按鈕(2026 年的介面更新後,它被獨立拉到工具列上)。點進去之後,你會看到模型選項——確認顯示的是「Image generation (Latest)」,這就是 Images 2.0。

白話講就是:如果你只是在對話框打「幫我畫一張…」,系統也會自動觸發,但直接點圖像模式入口可以看到更多參數控制,包括解析度和風格預設。


Step 2:寫一個真正能用的提示詞

這是多數人卡關的地方。Images 2.0 的文字理解能力比舊版強很多,但「幫我畫一隻貓」這種提示詞還是會給你最平庸的結果。

實際有效的結構大概長這樣:

主體 + 環境 + 風格/媒材 + 光線/氛圍 + 技術參數(如有需要)

舉個具體例子:

  • ❌ 「一隻貓坐在窗邊」
  • ✅ 「一隻橘色短毛貓坐在木框老窗台上,窗外是下雨的東京街道,水彩插畫風格,暖黃室內光打在毛上,柔和暈染邊緣」

Images 2.0 現在對文字渲染的支援也大幅改善了——你可以要求圖裡出現特定英文或數字,成功率比以前高很多,但中文字仍然偶爾會跑掉,這點要注意。


Step 3:用多輪對話迭代修圖

這是 Images 2.0 最讓我覺得「對,這才是真正的工具」的功能。你不用每次重新寫完整提示詞,可以直接說:

  • 「把背景換成夜晚」
  • 「讓貓的表情更慵懶一點」
  • 「整體色調偏冷一些」

系統會保留上一張圖的核心元素去做修改。你可以把它想成 Photoshop 的圖層調整概念,只是你用說的。一般 3~5 輪迭代可以把一張圖收到你想要的狀態。

如果你需要在不同 AI 工具之間做比較、評估哪個更符合你的創作需求,可以參考 Claude vs ChatGPT 的實際比較,裡面有從幾個維度拆解兩個平台的差異。


Step 4:上傳參考圖做風格複製或圖像編輯

Images 2.0 支援 image-to-image 工作流——你可以上傳一張自己的照片或設計稿,然後指示系統按特定風格改造,或者保留構圖換掉風格。

幾個實際場景:

  • 把產品照轉成特定插畫風格做 IG 貼文
  • 上傳手繪草稿,讓 AI 生成精稿版本
  • 把人像照轉成動漫或漫畫風格(這個很熱門)

操作方式:點附件圖示上傳圖片,然後在提示詞裡說明你要做什麼改動,不需要另外切換模式。


Step 5:匯出與解析度設定

生成完成後,滑鼠停在圖片上會出現下載按鈕。預設輸出是 1024×1024,Plus 方案可以切換到 1792×1024(橫幅)或 1024×1792(直幅),適合不同平台的版位需求。

如果要做印刷用途,目前 AI 生成的解析度對大尺寸輸出還不夠用,建議先輸出後用 Topaz Gigapixel 或類似的 AI 放大工具補足解析度。


常見錯誤與怎麼避開

提示詞太模糊:「美麗的風景」這種形容詞對 AI 沒有實質意義,換成「黃昏的熔岩橘天空、前景是薰衣草田」這種具象描述。

一次要求太多:試著要求「一張圖裡有十個角色各做不同動作」——結果一定亂掉。先做主體,再迭代加入細節。

忽略內容政策限制:Images 2.0 對特定內容有過濾機制,包括名人肖像、暴力、版權角色等,碰到直接被拒就換描述方式而不是反覆嘗試同一個。生成式 AI 的使用邊界在 AI 資安風險那篇 有更完整的說明,包括圖像生成可能涉及的著作權風險。


進階用法:批量生成與 API 串接

如果你是做內容生產或產品的開發者,Images 2.0 同樣透過 OpenAI API 開放調用,端點是 /v1/images/generations,模型名稱指定 gpt-image-1。你可以把它直接串進你的發布流程,例如自動為每篇文章生成封面圖,或者做產品上架時的多角度圖片生成。

這個方向如果你已經在考慮,可以看看 OpenAI Codex 在 2026 年的 agent 整合方式,兩個工具結合起來在自動化創作流水線上有不少組合空間。


完成後的檢查點

跑完上面五個步驟,你應該已經:

  • ✅ 確認帳號方案有 Images 2.0 權限
  • ✅ 用結構化提示詞生成第一張圖
  • ✅ 用多輪對話把圖修到接近你要的版本
  • ✅ 了解上傳參考圖的工作流
  • ✅ 輸出正確尺寸的檔案

下一步:把它放進你的實際工作流程裡測試一週,不管是做簡報封面、社群貼圖還是品牌素材,實際使用才會知道哪個環節卡住了、哪個環節比你預期順很多。AI 圖像工具這兩年進步的速度是真的很快,值得定期重新評估你的工具組合。

常見問題

ChatGPT Images 2.0 免費方案可以用嗎?

可以用,但 Free 方案目前有每日生成限額(約 2 張),且部分進階參數(如高解析度輸出)僅限 Plus 以上方案。如果要大量生成或用於工作流程,升級 Plus 比較實際。

提示詞要用中文還是英文寫?

兩種都可以,Images 2.0 的中文理解能力已經相當不錯。但如果你要圖片裡出現特定文字,建議用英文,因為中文字的渲染準確率目前仍低於英文。

Images 2.0 跟 Midjourney 比起來哪個比較好?

各有強項。Images 2.0 的優勢在於直接整合在對話流程裡、多輪迭代修改方便、文字渲染能力強。Midjourney 在藝術風格的多樣性和一致性上仍有優勢。選哪個取決於你的工作流優先考量。

生成的圖片有版權問題嗎?

根據 OpenAI 的使用條款,你對自己生成的圖片擁有使用權,但請避免要求生成涉及已知版權角色或名人肖像的內容。商業用途前建議確認最新條款,版權法規因地區而異。

為什麼我的生成請求被拒絕了?

Images 2.0 內建內容過濾機制,涉及暴力、成人內容、特定名人或已知版權角色的提示詞會被拒絕。碰到這種情況建議換一種描述方式,而不是反覆提交相同內容。

分享這篇

同系列文章