Grok 圖片轉影片是首幀的延續
與純文字生成不同,Grok 會從你提供的像素開始。首幀決定哪些內容需要保持可辨識,動作簡報則決定場景之後如何發展。
先鎖定主體,再設計動作
選擇一張臉部、產品輪廓、文字或主要道具都清楚可讀的圖片。穩定的視覺錨點能減少 Grok 需要自行判斷的內容。
描述下一個節拍
寫清楚隨時間發生的變化:視線、揭示、行走、光線變化或鏡頭運動。不要重複來源圖片已經明確呈現的細節。
分階段調整動作
如果結果出現偏移,先簡化動作或鏡頭方向。如果畫面過於靜止,先加入一個有目的的動作,再補充更多氛圍細節。

