文字生圖完全靠你寫下的描述來構圖;編輯模式則以你附上的圖片為起點,把提示詞當成一張修改清單來處理。兩者都在同一個生成器裡,所以你可以先做出一張底圖,再把它當參考圖丟回去繼續調整,整個過程都不必離開頁面。
IAllegro
GPT Image 2.5 AI 圖片生成與編輯器
GPT Image 2.5 是 OpenAI 開發的圖片模型。下方的生成器有兩種玩法:寫一段提示詞,從無到有產生一張圖;或是上傳最多 16 張參考圖,告訴模型哪裡要改。選好 1K、2K 或 4K 解析度和長寬比之後,送出前就能在「生成」按鈕上看到這次會用掉多少點數。
生成的圖片會顯示在這裡
Andante
規格速覽
以下是生成器本身設定的限制。開始之前先看過一遍,就能把每次任務安排好,不會把點數花在冤枉路上。
- 模型
- GPT Image 2.5,OpenAI 開發的圖片模型
- 兩種起點
- 文字生圖,或以你自己的參考圖進行圖片編輯/以圖生圖
- 參考圖
- 編輯模式最多 16 張
- 解析度
- 1K、2K、4K 三種
- 長寬比
- auto(自動)、1:1、3:2、2:3、4:3、3:4、16:9、9:16、21:9、27:16、16:27、9:8、8:9
- 只限 1K 的比例
- 27:16、16:27、9:8、8:9 無法搭配 2K 或 4K
- 提示詞長度
- 最多 5000 個字元,完整的創意需求和圖中文字的指定都寫得下
- 點數
- 依解析度而定,送出前會顯示在「生成」按鈕上;生成失敗會自動退還點數
- 帳號與儲存
- 需要登入;每張完成的圖片都會存進生成紀錄
Adagio
用 GPT Image 2.5 可以做到的事
這個頁面的重點在「掌控」:要放進什麼素材、輸出多大、還在摸索方向時要花多少點數,都由你決定。以下六點說明實際怎麼運用。
Scherzo
從登入到完成,六個步驟
一般的操作流程大致如下。順序可以彈性調整,但有個習慣很值得養成:先用小圖試,再用大圖收尾。
登入並確認點數
生成圖片需要登入 Sonata AI 帳號,而且帳戶裡要有點數。先登入,順便看一下剩餘點數;如果打算一次做好幾張 4K 完稿,建議先加值,免得一組圖做到一半停下來。
從文字開始,或加入參考圖
參考圖欄位留空,就是文字生圖。想修圖的話,加入 1 到 16 張圖片。只要有參考圖,提示詞就會被視為針對這些圖片的修改指令,而不是在描述一個全新的場景。
撰寫提示詞
要產生新圖,就描述你想看到的畫面;要修圖,就寫清楚哪裡要改、哪裡不能動。兩種情況都有 5000 字元可用,所以圖中要出現的文字、每個元素擺在畫面哪個位置,都能交代清楚。
選擇長寬比
還不確定圖片要用在哪裡時,維持 auto 就好;用途明確時就選固定比例:手機限時動態用 9:16,簡報或影片縮圖用 16:9,電商商品圖用 1:1,網站首頁橫幅用 21:9。
選擇解析度
摸索階段先用 1K,而且 27:16、16:27、9:8、8:9 也只能選 1K。構圖滿意後再提高到 2K 或 4K。「生成」按鈕上的點數會隨每次調整即時更新,花多少一看就知道。
按下生成,到紀錄裡查看
按下「生成」,等結果出來。每張完成的圖片都會進入生成紀錄,可以直接下載,也可以再次當成參考圖進行下一輪修改。萬一任務失敗,點數會自動退還。
Adagio
多張參考圖修圖最能派上用場的情境
有些案子需要一張全新的圖,有些則要在現有的圖上動手。以下整理出兩種模式各自比較適合的情況。
Adagio
生成新圖的提示詞 vs 修圖指令
同一句話,在某個模式下效果很好,換到另一個模式可能就不太靈。以下建議的核心只有一個:讓模型知道它這次在做哪一種工作。
Coda
GPT Image 2.5 常見問題
關於兩種模式、各項限制、點數,以及結果不如預期時該怎麼處理。
01什麼時候用文字生圖,什麼時候該加參考圖?
畫面還不存在、而且用文字就說得清楚時,用文字生圖就好。如果一定要出現某個具體的東西,像是你的商品、某個角色、Logo 或一個真實的房間,或是想修改一張現有的照片,就加入參考圖。有些風格很難用文字形容,直接給參考圖也是最省事的做法。
02最多能放幾張參考圖?一定要放滿 16 張嗎?
編輯模式最多可放 16 張,但很少需要放滿。幾張精挑細選的圖片搭配清楚的提示詞,比一堆關聯鬆散的圖片更能讓模型理解任務。只有當新加入的圖片能提供其他圖裡沒有的資訊時,才值得再多放一張。
03為什麼 2K、4K 選不到 27:16 或 9:8?
27:16、16:27、9:8、8:9 這四種比例只在 1K 提供。如果需要更大的檔案,可以改選最接近的標準比例,例如寬畫面用 16:9、接近正方形的用 1:1,以 2K 或 4K 生成後,再裁切成需要的精確比例。
04先用 1K 打草稿、再用 4K 完稿,這樣划算嗎?
大部分的案子都適合這樣做。點數會依解析度而不同,用較低的設定來測試文字、版面和比例最經濟。不過要記得,4K 是重新生成;想貼近某張草稿,就把它當參考圖附上,要求用更大的尺寸輸出同一張圖。
05生成一張圖要多少點數?
取決於你選的解析度。確切數字會在送出前顯示在「生成」按鈕上,在 1K、2K、4K 之間切換時也會同步更新。我們不在這個頁面寫死價格,因為按鈕上顯示的永遠是當下的數字。
06生成失敗的話,點數會怎樣?
點數會自動退回你的帳戶,不需要另外申請。退還的對象是失敗的任務;如果圖片順利完成、只是不夠理想,那就參考本頁關於把指令寫清楚的建議,讓下一次更接近目標。
07修圖時模型忽略了部分指令,該怎麼調整?
把修改範圍寫得更明確:點出要改的元素、描述怎麼改,並列出必須維持原樣的部分。如果附了多張參考圖,也要說明每個元素來自哪一張。改好後用 1K 再跑一次,和先前的結果比較,每次只調整一處。
08這個頁面和 GPT Image 2、GPT Image 1.5 頁面有什麼不同?
每個頁面執行的是各自的模型,可用的選項也不一樣。本頁提供的是 GPT Image 2.5:文字生圖、最多 16 張參考圖的修圖、1K 到 4K 輸出,以及 13 種長寬比。如果你也在用另外兩個,不妨拿同一段提示詞分別試試,哪個結果適合案子就用哪個。
09完成的圖片存在哪裡?
每張圖片都會存進本頁的生成紀錄,可以下載,也可以當成參考圖繼續修改。如果你要上傳的網站只收 JPG,而手上的檔案是 WebP,可以用上方連結的 WebP 轉 JPG 工具轉檔。
10Sonata AI 是 OpenAI 旗下的服務嗎?
不是。Sonata AI 是獨立營運的平台,與 OpenAI 沒有任何合作或隸屬關係,也未獲得其背書或贊助。GPT Image 是其所有者的商標,本頁使用這個名稱,只是為了說明生成器背後採用的是哪個模型。