在 AIReiter 上以精準編輯執行 Grok Imagine Image 2.0 API
Grok Imagine Image 2.0 是 xAI 的圖像生成與編輯模型,適用於依提示詞創作、參考圖引導修訂、排版與結構化版面。可使用 AIReiter playground 或 API 以 1K 或 2K、14 種長寬比選項進行生成。
文字轉圖像生成
將詳細提示詞轉化為海報、產品場景、社群創意、概念藝術及其他可直接用於製作的視覺內容。請描述主體、構圖、光線、風格,以及應該出現的任何文字。
參考圖引導編輯
附上 1 到 3 張參考圖並描述所需變更。模型可利用這些參考圖來引導主體辨識、風格、構圖或依提示詞進行修訂。
排版與版面配置
該模型專為結合視覺構圖、可讀標籤、標題與結構化圖像版面的圖片而設計,因此非常適合海報與資訊圖表。
彈性輸出控制
可透過主要模型模式選擇 1K 或 2K 解析度、Low 或 Medium 品質、14 種長寬比選項,以及每次請求 1 到 10 張輸出。
使用 Grok Imagine Image 2.0 進行創作與編輯
結合自然語言指令與可選參考圖,透過單一工作流程從初始概念走向精緻成果。
面向設計師的排版
在生成海報、菜單、標籤或資訊圖表時,請使用明確的文案、層級、位置與風格指示。清楚的提示有助於模型保留預期的視覺結構。
提示詞引導的精準編輯
提供最多 3 張參考圖,並明確說明哪些內容應保持一致、哪些內容需要變更。使用詳細指示可在保留重要主體、風格或構圖的同時進行聚焦修訂。
多參考圖一致性
使用多張輸入圖來引導共通的角色、產品、配色或視覺方向。每次請求中,對於每張附加圖片,參考圖費用只會計算一次。
批次生成
在單一任務中請求多個候選結果。主要模式支援 1 到 10 張輸出,而同一頁面的 Ext 模式支援 1 到 12 張輸出。
使用 Grok Imagine Image 2.0 可創作的內容
海報與資訊圖表
生成活動宣傳海報、活動圖像、菜單與資訊豐富的視覺內容。在提示詞中指定精確文案、版面層級與視覺風格,然後使用 2K Medium 進行最終品質檢查。
電商與商品攝影
創建商品場景、廣告變體以及類似使用者生成內容風格的圖片。當視覺識別必須在新背景或新構圖中保持一致時,請附上商品參考圖。
一致的角色與世界觀
使用參考圖在探索新場景時維持角色、服裝、配色或環境的一致性。生成多個候選結果,以便為後續影片工作建立連貫的視覺方向。
支援的 Grok Imagine Image 2.0 控制項
這些是目前 AIReiter playground 和 API 整合中提供的控制項。
參考圖片
主模式可選。最多可附加三張圖片。每張參考圖片每次請求會增加 0.95 點數,不論產生的輸出數量為何。
長寬比
在主模式中可選擇 Auto、1:1、4:3、3:4、3:2、2:3、16:9、9:16、2:1、1:2、19.5:9、9:19.5、20:9 或 9:20。
解析度與品質
主模式支援 1K 或 2K 輸出,並可選擇 Low 或 Medium 品質。需要更快出稿時請使用 Low;當細節更重要時請使用 Medium。
輸出數量
主模式每次請求支援一到十個輸出。Ext 子模式支援一到十二之間的任意整數,包括 3 這類值,而不僅限於預設批次大小。
Grok Imagine Image 2.0 收費
1K Low
每個輸出 3.8 點數。這是最快且成本最低的草稿與提示詞迭代方案。
1K Medium 或 2K Low
每個輸出 5.7 點數。選擇 1K Medium 可在標準解析度下獲得更多細節,或選擇 2K Low 以更快的品質設定生成較大圖片。
2K Medium
每個輸出 7.6 點數。這是主模式中最高等級,適合最終品質檢查與重視細節的工作。
參考圖片附加費
每張附加的參考圖片每次請求會增加 0.95 點數。此附加費不會隨 output_n 倍增。最多支援三張輸入圖片。
多重輸出
輸出費率會乘以 output_n。例如,三個 1K Low 輸出的費用為 3.8 x 3 點數,尚未計入任何參考圖片附加費。
Grok Imagine 2.0 Ext
Ext 子模式每張生成圖片收費 2 點數,並支援一到十二個輸出。總費用為 2 x output_n 點數。
使用 Grok Imagine Image 2.0 生成
先從 playground 開始,接著透過 OpenAPI endpoints 使用相同的模型與參數。
試用 playground
輸入提示詞、選擇模型類型,並設定長寬比、解析度、品質和輸出數量。使用主模型進行編輯工作流程時,可加入最多三張參考圖。
取得 API 存取權
建立 AIReiter API key,並將 grok_imagine_image_2_0 作為主要模型 ID 使用。請將金鑰保存在伺服器端,切勿在瀏覽器程式碼中暴露。
提交並查詢
將任務以唯一的 out_task_id 傳送至 POST /api/openapi/submit,然後使用相同的 ID 持續輪詢 POST /api/openapi/query,直到任務完成或失敗。
透過 AIReiter API 使用 Grok Imagine Image 2.0
AIReiter 為影像生成與結果擷取提供單一的非同步任務合約。
主要 model ID
將 grok_imagine_image_2_0 作為 model 值傳送,用於完整的 1K/2K、quality、multi-reference 與 one-to-ten-output 參數組合。
Ext model ID
當您選擇 Ext 子模式時,請傳送 grok_imagine_2_0_ext。它是 text-to-image,支援七種 aspect ratios,並接受一到十二個輸出。
提交端點
POST /api/openapi/submit 接受 model、params、可選附件,以及唯一的 out_task_id。回應包含任務狀態與預估 credit 成本。
查詢端點
POST /api/openapi/query 接受相同的 out_task_id。請持續輪詢直到完成或失敗;完成的回應會包含輸出 URLs 與最終 credits_used。
相關的 AI 影像與影片模型
Grok Imagine Image 2.0 常見問題
關於模型模式、參考圖片、支援的輸出設定、定價與 API 使用的說明。
/ 01什麼是 Grok Imagine Image 2.0?
Grok Imagine Image 2.0 是 xAI 的 text-to-image 生成與 prompt 引導影像編輯模型。在 AIReiter 上,主要模式支援可選參考圖片、1K 與 2K 輸出、Low 與 Medium quality,以及批次生成。
/ 02Grok Imagine Image 2.0 會生成圖片還是影片?
此頁面會生成靜態圖片。若需要動態輸出,請使用 /video/grok-imagine-1-5 的 Grok Imagine 1.5 Video。
/ 03我可以上傳多少張參考圖片?
目前的 AIReiter API 針對主要的 grok_imagine_image_2_0 模式最多接受三張參考圖片。Ext 子模式是 text-to-image,且不提供參考圖片輸入。
/ 04支援哪些 aspect ratios 與解析度?
主要模式提供 Auto 以及十三種明確比例:1:1、4:3、3:4、3:2、2:3、16:9、9:16、2:1、1:2、19.5:9、9:19.5、20:9 和 9:20。解析度可為 1K 或 2K。
/ 05Grok Imagine Image 2.0 的費用是多少?
主要模式的輸出費用為:1K Low 3.8 credits、1K Medium 或 2K Low 5.7 credits、2K Medium 7.6 credits。每張參考圖片每次請求加收 0.95 credits,且輸出費率會乘以 output_n。
/ 06什麼是 Grok Imagine 2.0 Ext?
Grok Imagine 2.0 Ext 是此頁面 Model Type 選擇器中的子模型。每個輸出收費 2 credits,每次請求支援一到十二張圖片,並使用較小的 text-to-image 參數組合。
/ 07它與 GPT-Image 2 相比如何?
兩者都支援一般影像生成。Grok Imagine Image 2.0 提供 Low 與 Medium quality 等級、公式化計價,以及最多三張參考圖;而 GPT-Image 2 則提供更多解析度與自訂尺寸選項,且可使用更多參考圖片。請根據您的工作流程所需控制項進行選擇。
/ 08我應該使用哪個 API model ID?
主要模式請使用 grok_imagine_image_2_0,Ext 請使用 grok_imagine_2_0_ext。請使用 POST /api/openapi/submit 提交,並以相同的 out_task_id 透過 POST /api/openapi/query 查詢結果。
