GPT Image 1:完整規格、定價、API 接入與應用場景(2026)
什麼是 GPT Image 1?
GPT Image 1 是 OpenAI 原生多模態圖像生成模型,於 2025年4月23日宣布開放 API 接入,具備文本與圖像輸入能力,可用於圖像生成與編輯。官方尚未明確公布上下文視窗,OpenAI API 收費標準截至 2026年7月為:每 100 萬文本輸入 Token \$5.00,每 100 萬圖像輸出 Token \$40.00。OpenAI 將 GPT Image 1 定義為可接受文本與圖像輸入並生成圖像輸出的模型,目前在官方模型頁面被歸類為上一代圖像生成模型,而非最新的 OpenAI 圖像模型。
GPT Image 1 適合開發者與產品團隊打造圖像生成工具、視覺編輯流程、行銷創意系統、電商模擬流程、設計助理,以及需要可程式化圖像輸出的應用。此模型應以圖像生成與編輯模型進行評估,而非通用聊天或推理模型。
在 Gate.AI 模型百科中,GPT Image 1 的介紹需明確區分 OpenAI 官方模型細節與 Gate.AI 接入資訊。OpenAI 提供官方規格與定價,Gate.AI 文件則驗證可調用 gpt-image-1 的 OpenAI 相容圖像端點,用於圖像生成與參考圖像編輯。
GPT Image 1 的主要規格與定價有哪些?
| 欄位 | 已驗證數值 |
|---|---|
| 提供方 | OpenAI(截至 2026年7月) |
| 模型系列 | GPT Image 模型(截至 2026年7月) |
| 模型類型 | 原生多模態圖像生成與圖像編輯模型(截至 2026年7月) |
| API 宣布日期 | 2025年4月23日(截至 2026年7月) |
| 上下文視窗 | 官方文件未明確說明(截至 2026年7月) |
| 輸入定價 | 文本輸入:每 100 萬 Token \$5.00;圖像輸入:每 100 萬 Token \$10.00(截至 2026年7月) |
| 快取輸入定價 | 文本快取輸入:每 100 萬 Token \$1.25;圖像快取輸入:每 100 萬 Token \$2.50(截至 2026年7月) |
| 輸出定價 | 圖像輸出:每 100 萬 Token \$40.00(截至 2026年7月) |
| 單張圖像定價 | 低品質 1024×1024:\$0.011;中品質 1024×1024:\$0.042;高品質 1024×1024:\$0.167(截至 2026年7月) |
| 計價單位 | 每 100 萬文本或圖像 Token,依圖像尺寸與品質估算單張價格(截至 2026年7月) |
| 模態支援 | 支援文本輸入、圖像輸入與輸出;不支援音訊與影片(截至 2026年7月) |
| 支援的輸入類型 | 文本提示與圖像輸入(截至 2026年7月) |
| 支援的輸出類型 | 圖像(截至 2026年7月) |
| API 接入 | OpenAI Images API;Gate.AI OpenAI 相容圖像端點(截至 2026年7月) |
| OpenAI 模型 ID | gpt-image-1(截至 2026年7月) |
| Gate.AI Listing ID | openai/gpt-image-1,參考Gate.AI 列表詳情;Gate.AI 文件於圖像端點請求體中使用 gpt-image-1(截至 2026年7月) |
| Gate.AI Endpoint Model ID | 於圖像生成與圖像編輯請求體中使用 gpt-image-1(截至 2026年7月) |
| 可用性 | 透過已記錄的 API 路徑可用,但 OpenAI 目前將 GPT Image 1 標示為上一代圖像生成模型;新生產部署前需重新確認部署狀態(截至 2026年7月) |
| 知識截止 | 對該圖像模型而言不適用或未明確(截至 2026年7月) |
| OpenAI 速率限制 | OpenAI 依層級列出 TPM 與 IPM 限制;不支援免費層,Tier 1 起始為 100,000 TPM 與 5 IPM(截至 2026年7月) |
| 微調支援 | 不支援(截至 2026年7月) |
| 串流支援 | OpenAI 模型功能列表不支援串流;Gate.AI 目前圖像路徑為同步(截至 2026年7月) |
| 批次 API 支援 | OpenAI 模型頁面列出 Batch 端點類別,但 GPT Image 1 圖像批次生成行為截至 2026年7月未有明確來源確認 |
| 工具/函數調用 | 不支援(截至 2026年7月) |
| 結構化輸出/JSON 模式 | 不支援(截至 2026年7月) |
| 授權/使用限制 | 受 OpenAI API 政策及Gate.AI 平台條款約束;截至 2026年7月未發現單獨的公開模型授權 |
OpenAI 目前 GPT Image 1 模型頁面列出文本 Token、圖像 Token、快取輸入 Token,以及依尺寸與品質計算的單張圖像生成價格。輸入僅支援文本,圖像可作為輸入與輸出,音訊/影片不支援。
在成本規劃方面,最重要的差異在於 GPT Image 1 的計費同時涵蓋輸入端與輸出端的圖像 Token。應用若需傳送參考圖像、請求更大尺寸輸出或每次生成多張圖像,建議先測試實際用量再估算月支出。
GPT Image 1 在生產環境中有哪些實用功能?
GPT Image 1 可透過文本提示生成圖像,適用於需要創意草圖、概念藝術、社群媒體視覺、行銷模擬圖、產品圖片或基於自然語言快速視覺構思的應用。
GPT Image 1 亦支援圖像編輯與參考圖像流程。Gate.AI 文件記錄了圖像編輯端點,可透過 multipart 表單資料提交參考圖像與提示詞,並同步回傳生成圖像的 URL。這對於需要修改視覺素材的工具特別實用,而不僅僅是文本生成新圖像。
此模型支援透過 API 回應進行圖像相關計費。Gate.AI 回應範例包含用量欄位與 model_extend.cost 欄位,方便開發者檢查計費金額、Token 用量、服務商路徑及回應層級帳單。
當團隊需為現有 gpt-image-1 工作流程提供穩定整合路徑時,GPT Image 1 也具備價值。但由於 OpenAI 已將其標示為上一代圖像生成模型,建議新部署團隊優先評估最新 OpenAI 圖像模型,並於生產前確認可用性。
GPT Image 1 支援哪些模態?
| 模態 | 是否支援 | 說明 |
|---|---|---|
| 文本輸入 | 是 | 用於圖像提示與編輯指令。 |
| 圖像輸入 | 是 | 用於參考圖像與圖像編輯流程。 |
| 圖像輸出 | 是 | 生成或編輯後的圖像。 |
| 文本輸出 | 否 | GPT Image 1 僅用於圖像輸出,不支援聊天式文本輸出。 |
| 音訊輸入/輸出 | 否 | OpenAI 明確不支援音訊。 |
| 影片輸入/輸出 | 否 | OpenAI 明確不支援影片。 |
實務結論是,GPT Image 1 適合圖像生成與編輯流程,不應作為文本助理、語音模型、影片模型、函數調用模型或結構化輸出模型使用。OpenAI 功能列表顯示,串流、函數調用、結構化輸出、微調與預測輸出均不支援。
GPT Image 1 有哪些侷限?
截至 2026年7月,GPT Image 1 並非 OpenAI 最新圖像生成模型。OpenAI 目前模型頁面將 GPT Image 2 定位為新一代圖像生成模型,GPT Image 1 為上一代,因此新生產專案需評估 GPT Image 1 是否仍適合品質、延遲、支援週期與成本需求。
官方未明確上下文視窗。Gate.AI 文件記錄 gpt-image-1 文本到圖像請求支援 32,000 字元提示,但這是端點提示上限,不能作為模型上下文視窗描述。
根據 OpenAI 模型功能列表,GPT Image 1 不支援音訊、影片、串流、函數調用、結構化輸出或微調。這限制了其在代理應用、JSON 優先流程、工具調用系統、多模態影片管線與自訂訓練圖像生成場景中的適用性。
這是通用 AI 侷限,除非服務商特別聲明:生成圖像可能包含視覺瑕疵、細節不準確、文字扭曲、物件關係不一致或需人工審核。涉及身分、醫療、法律、金融、安全或受監管決策的高風險場景應引入專家審查與政策檢查。
OpenAI 亦指出 GPT Image 1 採用安全防護措施,生成圖像受使用政策約束,部分開發者可能需組織驗證後方可使用。這些控管對於部署規劃至關重要,但可能影響可用性、審核行為與流程設計。
GPT Image 1 最適合哪些應用場景?
| 應用場景 | 適用原因 | 重要侷限 |
|---|---|---|
| 行銷創意草圖 | 可根據提示生成活動視覺、落地頁概念、社群媒體圖像變體。 | 輸出需經品牌、事實、法律與合規審查後發布。 |
| 產品模擬圖 | 協助團隊探索包裝、週邊、應用場景或產品擺放的視覺方向。 | 不可取代最終生產攝影、CAD 或設計品管。 |
| 圖像編輯工具 | 支援參考圖像流程,透過已記錄的圖像編輯端點實現。 | 輸入格式、遮罩處理、提示長度與審核行為均可能影響結果。 |
| 電商視覺流程 | 可生成產品風格圖片、生活場景概念或背景變體。 | 產品準確性與政策合規需人工核查。 |
| 設計構思 | 快速探索視覺風格、版型與構圖。 | 生成設計需人工優化後再用於客戶或公開場合。 |
| 開發者圖像 API | 可透過 OpenAI 與Gate.AI API 路徑整合。 | 團隊需對比目前模型生命週期、成本及最新圖像模型選項。 |
GPT Image 1 最適合輸出為圖像,且工作流程受益於文本提示、參考圖像或圖像編輯的場景。不適用於長上下文文本分析、程式碼生成或推理密集任務、語音應用、影片生成流程或結構化資料提取。
GPT Image 1 與 GPT Image 2、DALL·E 3 有何對比?
| 對比維度 | GPT Image 1 | GPT Image 2 | DALL·E 3 | 場景適配 |
|---|---|---|---|---|
| 提供方 | OpenAI | OpenAI | OpenAI | 同一服務商生態,不同模型世代。 |
| 目前定位 | 上一代圖像生成模型 | 新一代 OpenAI 圖像生成模型 | 上一代圖像生成模型 | 新部署建議優先評估 GPT Image 2,現有工作流可繼續依賴 GPT Image 1。 |
| 輸入模態 | 文本與圖像輸入 | 文本與圖像輸入 | 文本輸入 | GPT Image 1 與 GPT Image 2 更適合參考圖像流程,DALL·E 3 僅適用於文本到圖像。 |
| 輸出模態 | 圖像輸出 | 圖像輸出 | 圖像輸出 | 三者均為圖像輸出模型。 |
| 圖像編輯 | 支援圖像編輯端點 | 支援圖像編輯端點 | 不適合參考圖像編輯 | GPT Image 系列更適合編輯流程。 |
| GPT Image 1 定價 | 文本輸入 \$5.00/100 萬;圖像輸入 \$10.00/100 萬;圖像輸出 \$40.00/100 萬 | 部署前需查閱 OpenAI 目前定價與模型頁面 | DALL·E 3 標準 1024×1024 圖像 \$0.04;1024×1536 和 1536×1024 \$0.08 | 成本對比取決於輸出尺寸、品質、端點與用量。 |
| 功能限制 | 不支援串流、函數調用、結構化輸出或微調 | 目前模型頁面不支援串流、函數調用、結構化輸出或微調 | 設計為文本到圖像生成 | 不應作為通用聊天或代理模型使用。 |
| 實用選擇 | 適用於現有 gpt-image-1 整合與Gate.AI 圖像端點工作流 | 新部署團隊優先選擇最新 OpenAI 圖像模型路徑 | 適合簡單文本到圖像場景 | 無絕對優劣,選擇需基於工作流、可用性、品質與成本測試。 |
OpenAI GPT Image 2 頁面將其描述為新一代圖像生成模型,支援文本與圖像輸入/輸出。DALL·E 3 則為上一代文本到圖像生成模型,僅支援文本輸入生成圖像輸出。
如何透過 Gate.AI 接入 GPT Image 1?
Gate.AI 文件記錄了 GPT Image 1 的 OpenAI 相容圖像端點,基於 URL https://api.gate.ai/openai/v1,採用 Bearer Token 認證,文本到圖像生成使用 JSON 請求體,參考圖像編輯使用 multipart 表單資料。文本到圖像端點為 POST /images/generations,參考圖像編輯端點為 POST /images/edits。
Gate.AI 文件中的文本到圖像請求體需指定 gpt-image-1 作為圖像模型 ID。依 Gate.AI 列表詳情,本模型頁面的目錄 Listing ID 為 openai/gpt-image-1,於可執行端點範例中,按 Gate.AI 文件請求體使用 gpt-image-1。
Python 範例:Gate.AI 文本到圖像生成
import osimport requestsapi_key = os.environ["GATEAI_API_KEY"]response = requests.post("https://api.gate.ai/openai/v1/images/generations",headers={"Authorization": f"Bearer {api_key}","Content-Type": "application/json",},json={"model": "gpt-image-1","prompt": "A clean product photo of a ceramic mug on a white desk, soft natural light","n": 1,"size": "1024x1024"},timeout=120)response.raise_for_status()result = response.json()print(result["data"][0]["url"])
curl 範例:Gate.AI 文本到圖像生成
curl -X POST "https://api.gate.ai/openai/v1/images/generations" \-H "Authorization: Bearer $GATEAI_API_KEY" \-H "Content-Type: application/json" \-d '{"model": "gpt-image-1","prompt": "A clean product photo of a ceramic mug on a white desk, soft natural light","n": 1,"size": "1024x1024"}'
curl 範例:Gate.AI 參考圖像編輯
curl -X POST "https://api.gate.ai/openai/v1/images/edits" \-H "Authorization: Bearer $GATEAI_API_KEY" \-F "model=gpt-image-1" \-F "prompt=Add a subtle yellow border and improve the product lighting" \-F "size=1024x1024" \-F "image=@./input.png"
Gate.AI 文件說明生成的圖像 URL 同步回傳,為短時效的 S3 預簽名 URL,需及時下載或保存。回應還包含用量與計費欄位,包括 usage、model_extend.cost、model_extend.line_items、model_extend.provider(如有)。
Gate.AI 定價頁面說明平台價格與官方模型服務商保持一致,多模態能力如圖像生成可能依生成次數、時長、解析度或任務規格計費。平台亦提供 API 金鑰管理、智慧路由、提示快取、用量洞察、組織權限與預算防護等功能。
常見問題解答
GPT Image 1 的上下文視窗是多少?
截至 2026年7月,OpenAI 官方文件未公開 GPT Image 1 的上下文視窗。Gate.AI 文件記錄 gpt-image-1 文本到圖像請求支援 32,000 字元提示,但這是端點提示上限,不是模型上下文視窗。
GPT Image 1 的費用是多少?
截至 2026年7月,OpenAI 列出 GPT Image 1 的費用為每 100 萬文本輸入 Token \$5.00、每 100 萬圖像輸入 Token \$10.00、每 100 萬圖像輸出 Token \$40.00,並依尺寸與品質列出單張圖像價格。
可以透過 Gate.AI 使用 GPT Image 1 嗎?
可以。Gate.AI 文件包含 OpenAI 相容的圖像生成與圖像編輯端點,請求體中使用 gpt-image-1。依 Gate.AI 列表詳情,目錄 Listing ID 為 openai/gpt-image-1,端點範例均採用 gpt-image-1。
GPT Image 1 與 DALL·E 3 有何不同?
GPT Image 1 支援文本與圖像輸入,圖像輸出,適用於生成與編輯工作流。DALL·E 3 主要為文本到圖像模型。具體選擇需依輸出品質、API 路徑、成本與工作流需求決定。


