ChatGPT Images 2.0 怎麼用:從零開始的完整實測教學

做完這篇你能得到什麼
ChatGPT Images 2.0 在 2026 年中正式全面推出,相比舊版 DALL-E 整合,這次的升級幅度大到幾乎是換了一個底層邏輯——文字渲染準確多了、指令跟隨能力強了、連多輪對話修圖也變得可行。如果你上次試 AI 圖像生成是一兩年前的事,現在值得重開一局。
這篇會直接告訴你怎麼操作、怎麼寫提示詞、碰到什麼問題怎麼繞過去,讀完你應該能在 15 分鐘內跑完第一張圖到輸出成品的完整流程。
你需要準備什麼
- ChatGPT 帳號,Plus、Pro 或 Team 方案都能用 Images 2.0;Free 方案目前有每日限制(約 2 張)
- 瀏覽器或 ChatGPT 手機 app,功能一樣,手機端甚至支援相機直接上傳
- 如果你要做品牌物料或有一致風格需求,先準備好 1~2 張參考圖
Step 1:進入圖像模式,確認你用的是 Images 2.0
登入 ChatGPT 之後,開一個新對話,在輸入框左側找到「+」或附件圖示旁邊的影像生成按鈕(2026 年的介面更新後,它被獨立拉到工具列上)。點進去之後,你會看到模型選項——確認顯示的是「Image generation (Latest)」,這就是 Images 2.0。
白話講就是:如果你只是在對話框打「幫我畫一張…」,系統也會自動觸發,但直接點圖像模式入口可以看到更多參數控制,包括解析度和風格預設。
Step 2:寫一個真正能用的提示詞
這是多數人卡關的地方。Images 2.0 的文字理解能力比舊版強很多,但「幫我畫一隻貓」這種提示詞還是會給你最平庸的結果。
實際有效的結構大概長這樣:
主體 + 環境 + 風格/媒材 + 光線/氛圍 + 技術參數(如有需要)
舉個具體例子:
- ❌ 「一隻貓坐在窗邊」
- ✅ 「一隻橘色短毛貓坐在木框老窗台上,窗外是下雨的東京街道,水彩插畫風格,暖黃室內光打在毛上,柔和暈染邊緣」
Images 2.0 現在對文字渲染的支援也大幅改善了——你可以要求圖裡出現特定英文或數字,成功率比以前高很多,但中文字仍然偶爾會跑掉,這點要注意。
Step 3:用多輪對話迭代修圖
這是 Images 2.0 最讓我覺得「對,這才是真正的工具」的功能。你不用每次重新寫完整提示詞,可以直接說:
- 「把背景換成夜晚」
- 「讓貓的表情更慵懶一點」
- 「整體色調偏冷一些」
系統會保留上一張圖的核心元素去做修改。你可以把它想成 Photoshop 的圖層調整概念,只是你用說的。一般 3~5 輪迭代可以把一張圖收到你想要的狀態。
如果你需要在不同 AI 工具之間做比較、評估哪個更符合你的創作需求,可以參考 Claude vs ChatGPT 的實際比較,裡面有從幾個維度拆解兩個平台的差異。
Step 4:上傳參考圖做風格複製或圖像編輯
Images 2.0 支援 image-to-image 工作流——你可以上傳一張自己的照片或設計稿,然後指示系統按特定風格改造,或者保留構圖換掉風格。
幾個實際場景:
- 把產品照轉成特定插畫風格做 IG 貼文
- 上傳手繪草稿,讓 AI 生成精稿版本
- 把人像照轉成動漫或漫畫風格(這個很熱門)
操作方式:點附件圖示上傳圖片,然後在提示詞裡說明你要做什麼改動,不需要另外切換模式。
Step 5:匯出與解析度設定
生成完成後,滑鼠停在圖片上會出現下載按鈕。預設輸出是 1024×1024,Plus 方案可以切換到 1792×1024(橫幅)或 1024×1792(直幅),適合不同平台的版位需求。
如果要做印刷用途,目前 AI 生成的解析度對大尺寸輸出還不夠用,建議先輸出後用 Topaz Gigapixel 或類似的 AI 放大工具補足解析度。
常見錯誤與怎麼避開
提示詞太模糊:「美麗的風景」這種形容詞對 AI 沒有實質意義,換成「黃昏的熔岩橘天空、前景是薰衣草田」這種具象描述。
一次要求太多:試著要求「一張圖裡有十個角色各做不同動作」——結果一定亂掉。先做主體,再迭代加入細節。
忽略內容政策限制:Images 2.0 對特定內容有過濾機制,包括名人肖像、暴力、版權角色等,碰到直接被拒就換描述方式而不是反覆嘗試同一個。生成式 AI 的使用邊界在 AI 資安風險那篇 有更完整的說明,包括圖像生成可能涉及的著作權風險。
進階用法:批量生成與 API 串接
如果你是做內容生產或產品的開發者,Images 2.0 同樣透過 OpenAI API 開放調用,端點是 /v1/images/generations,模型名稱指定 gpt-image-1。你可以把它直接串進你的發布流程,例如自動為每篇文章生成封面圖,或者做產品上架時的多角度圖片生成。
這個方向如果你已經在考慮,可以看看 OpenAI Codex 在 2026 年的 agent 整合方式,兩個工具結合起來在自動化創作流水線上有不少組合空間。
完成後的檢查點
跑完上面五個步驟,你應該已經:
- ✅ 確認帳號方案有 Images 2.0 權限
- ✅ 用結構化提示詞生成第一張圖
- ✅ 用多輪對話把圖修到接近你要的版本
- ✅ 了解上傳參考圖的工作流
- ✅ 輸出正確尺寸的檔案
下一步:把它放進你的實際工作流程裡測試一週,不管是做簡報封面、社群貼圖還是品牌素材,實際使用才會知道哪個環節卡住了、哪個環節比你預期順很多。AI 圖像工具這兩年進步的速度是真的很快,值得定期重新評估你的工具組合。
常見問題
ChatGPT Images 2.0 免費方案可以用嗎?
可以用,但 Free 方案目前有每日生成限額(約 2 張),且部分進階參數(如高解析度輸出)僅限 Plus 以上方案。如果要大量生成或用於工作流程,升級 Plus 比較實際。
提示詞要用中文還是英文寫?
兩種都可以,Images 2.0 的中文理解能力已經相當不錯。但如果你要圖片裡出現特定文字,建議用英文,因為中文字的渲染準確率目前仍低於英文。
Images 2.0 跟 Midjourney 比起來哪個比較好?
各有強項。Images 2.0 的優勢在於直接整合在對話流程裡、多輪迭代修改方便、文字渲染能力強。Midjourney 在藝術風格的多樣性和一致性上仍有優勢。選哪個取決於你的工作流優先考量。
生成的圖片有版權問題嗎?
根據 OpenAI 的使用條款,你對自己生成的圖片擁有使用權,但請避免要求生成涉及已知版權角色或名人肖像的內容。商業用途前建議確認最新條款,版權法規因地區而異。
為什麼我的生成請求被拒絕了?
Images 2.0 內建內容過濾機制,涉及暴力、成人內容、特定名人或已知版權角色的提示詞會被拒絕。碰到這種情況建議換一種描述方式,而不是反覆提交相同內容。
分享這篇



