ChatGPT 生成圖片教學:指令怎麼寫、修圖怎麼做
ChatGPT 內建的圖片生成功能能直接對話生成與修改圖片,指令結構和修圖句型直接決定成品品質。這篇說明基本用法、常見問題與免費額度限制。
本文重點
- 指令要包含主體、構圖、動作、場景、風格,越具體成品越接近你想要的畫面。
- 修圖時用「保留其他部分不變,只修改⋯⋯」的句型,比整段重寫更容易控制結果。
- 圖片裡的文字渲染仍不是百分之百準確,重要文字生成後務必逐字核對。
- 免費額度有次數上限,實際數字常調整,使用前先看官方頁面公告。
基本用法:直接在對話裡下指令
ChatGPT 的圖片生成功能整合在一般對話裡,不需要切換到另一個介面,直接用文字描述你要的圖片就會生成。
一個有效的指令通常包含五個元素:
- 主體:畫面裡的主角是誰、是什麼
- 構圖:主體在畫面裡的位置、鏡頭遠近
- 動作:主體在做什麼
- 場景:背景、環境、時間
- 風格:寫實、插畫、攝影風格、色調
修圖:保留句型是關鍵
ChatGPT 也能修改你上傳的既有圖片——換背景、加入或移除物件、調整局部細節。這種情況下最容易出錯的地方是整段重新描述整張圖,結果連你想保留的部分也被改掉。
上傳原圖
把要修改的圖片傳進對話裡。
只描述要改的部分
用「保留其他部分不變,把⋯⋯改成⋯⋯」的句型,而不是重新描述整張圖。
檢查沒被要求的部分
確認沒被要求修改的元素是否被意外改動,這是修圖最常出錯的地方。
分次微調
不滿意就針對還沒對的地方再下一次指令,不需要每次都從頭描述整張圖。
常見指令範例
一個極簡風格的白色陶瓷馬克杯,放在淺灰色大理石桌面上,俯視角度,柔和自然光,電商產品攝影風格,背景乾淨無雜物。
保留其他部分不變,把照片裡的天空換成夕陽時分的橘紅色調,其他元素(人物、建築、地面)都不要更動。
一張生日賀卡插畫,卡片正中央用手寫體寫著「生日快樂」四個字,周圍是彩色氣球與彩帶,卡通插畫風格,色彩明亮。
和 Gemini 圖片生成的差異
| 面向 | ChatGPT | Gemini(Nano Banana) |
|---|---|---|
| 介面整合方式 | 直接在一般對話裡生成 | 同樣整合在對話裡 |
| 修圖時的保留句型 | 同樣有效,建議明確使用 | 官方特別強調這個句型的效果 |
| 多張參考圖合成 | 支援程度依版本而異 | 進階版本支援多達十餘張參考圖 |
| 文字渲染準確度 | 持續改善中,仍非百分之百 | 新版模型已明顯改善,仍建議核對 |
兩者的核心操作邏輯相近:指令具體、修圖用保留句型、生成後核對文字內容,這三點掌握了,換平台使用時上手速度會快很多。
常見問題
- 用 ChatGPT 生成圖片要付費嗎?
- 免費帳號通常有每日或每月的生成次數限制,付費方案額度較高。實際數字依帳號類型與官方政策常有調整,使用前建議直接查 ChatGPT 官方頁面公告,不要憑印象假設。
- 生成的圖片可以商用嗎?
- 這牽涉到使用條款與各地法規,屬於容易變動、也因用途而異的問題,不在這篇展開細節。有商業用途的需求,務必直接查閱 OpenAI 官方最新的使用條款,必要時諮詢法律意見。
- 為什麼有時候同一句指令生成出來的圖差很多?
- 生成式圖片模型本身帶有隨機性,同樣的指令每次生成的結果不會完全相同,這是正常現象而非錯誤。指令寫得越具體,結果的變異範圍越小,但不會完全消失。
延伸閱讀
Gemini 生成圖片指令怎麼下?從基本語法到實用技巧
Gemini 用 Nano Banana 模型生成與編輯圖片,指令寫得好不好直接決定成品品質。這篇講指令的基本結構、修圖用語,以及免費額度的實際限制。
ChatGPT 免費版功能與限制:跟付費版差在哪、怎麼用最划算
ChatGPT 免費版能做到什麼程度?這篇整理免費版目前的功能與現狀、和付費方案的實際差異、常見的使用限制,以及如何在不付費的情況下把免費額度用到最好。
OpenAI Codex 完整介紹:終端機編碼代理是什麼、怎麼設定、和 Claude Code 怎麼選
OpenAI Codex 是在終端機裡直接讀寫程式碼、執行指令的編碼代理。這篇說明它的運作方式、兩種登入路徑的差異、核心功能、費用怎麼算,以及和 Claude Code 的實際比較。