系列總覽
三個模型的參數面只差一個欄位:只有
grok-imagine-image-2.0 認 quality,
另外兩個會返回 unknown field——它們的品質是固定的,不給你調。
選型就看這一點:
grok-imagine-image-2.0是可調的那個。需要在成本和畫質之間權衡, 或者需要指定畫幅與解析度時用它。grok-imagine-image-quality品質固定在高檔,默認出豎圖。 畫質比控制力更重要時用它。grok-imagine-image比另兩個便宜一大截。草稿、縮圖、需要批次生成的場景用它。
參數
信封就是非同步任務 API 裡說的那三個鍵——model、input
和可選的 callback_url。下面這些都放在 input 裡。
input 內部是嚴格白名單校驗——不認識的鍵直接以 invalid_params 拒絕,
param 精確指出是哪個。拼錯欄位名會立刻報錯,不會被靜默丟掉。
解析度與品質
在grok-imagine-image-2.0 上這是兩個獨立維度,都會改變輸出。實測畫素,每檔一個樣本:
另外兩個模型只有
resolution 起作用。實測:grok-imagine-image 在 2k 下出
2816 × 1584,grok-imagine-image-quality 在 2k 下出 1776 × 2368。
具體畫素是模型自己定的,不是一張固定網格——同一個檔位在不同畫幅下落在不同數字上。
把這張表當量級看,真實尺寸從檔案裡讀。
畫幅比例
三個模型接受同一組 16 個取值:
不傳則各模型用自己的預設畫幅——
grok-imagine-image 與 grok-imagine-image-2.0
出橫圖,grok-imagine-image-quality 出豎圖。auto 讓模型自己從提示詞裡判斷。
參考圖
在input.images 裡最多放三張圖,用來編輯或合成。每一項是 https URL 或
base64 data URI:
input.images — must contain at most 3 items。
格式不對的那一項會帶上下標:input.images[0] —
must be an https URL or a base64 image data URI。
URL 是 WideRouter 在服務端取的,所以必須能從公網訪問到。域名解析不了、
或者返回的不是圖片,任務會在入隊之後失敗,而不是在提交時被拒。
計價
這幾個模型走Grok-Official 分組。WideRouter 的標價與 xAI 官方價完全一致——
折扣體現在分組倍率上,Grok-Official 的倍率是 0.8。所以實際扣費是:
兩條容易漏掉的規則:
- 參考圖另外收費,每張約 $0.01,加在出圖價之上。三圖合成按「一張輸出 + 三張輸入」計。
n是乘的。2k/medium出四張就是單張價的四倍,沒有批次折扣。
完成的任務裡帶一個
usage.cost_in_usd_ticks 欄位,10000000000 ticks 等於 $1。
這個數字是原價,還沒乘分組倍率。乘上你所在分組的倍率,才是實際從餘額里扣掉的數。時延
非同步介面上從提交到completed 的端到端實測,預設參數各一個樣本:
快到這個程度,非同步那一圈往返——提交,然後每兩三秒輪詢一次——花掉的牆鍾時間
往往比生成本身還多。典型結果是輪詢兩次就拿到了。
同步介面形態
三個模型同樣在POST /v1/images/generations 上應答,掛住連線直接把圖給你。
data 加 usage。data[0] 裡裝什麼取決於 response_format:
b64_json 直接給位元組,url 給一個連結。
同步鏈路對「只想立刻拿到位元組」的指令碼更簡單,代價是整個生成期間都要掛住連線——
2k 實測 19.4 秒。跑在 Serverless 函式、反向代理或移動端後面的場景應當走非同步。
下一步
Playground
在瀏覽器裡真實發一次請求,看著任務跑完。
Grok Imagine 影片
這個系列的影片那一半——生成、編輯與延長片段。