我们最新的图像转视频模型 grok-imagine-video-1.5-preview 现已通过 xAI API 提供预览版。
grok-imagine-video-1.5-preview 能将单张静态图像转化为流畅、富有电影感的视频。只需提供起始帧和描述运动方式的提示词,它就能让场景动起来,包括镜头运动、氛围和物理效果,同时忠实于原始图像。你可以生成最高 720p 分辨率的视频片段。
使用自然语言提示词来指导镜头。描述镜头运动、节奏和声音设计,然后设置分辨率和片段长度。该模型会保留输入帧的细节和光照,因此生成的结果延续原始图像,而非重新诠释。
该模型在序列处理方面同样表现出色。逐帧构图、逐帧动画,然后将这些镜头串联成更长的场景,在整个项目中保持一致的视觉效果。
只需几行代码即可让图像动起来。
import os
import xai_sdk
client = xai_sdk.Client(api_key=os.getenv("XAI_API_KEY"))
response = client.video.generate(
prompt="Slow cinematic push-in as embers drift across the battlefield and the helmet's crest stirs in the wind",
model="grok-imagine-video-1.5-preview",
image_url="https://your-host.com/helmet.jpg",
duration=10,
resolution="720p",
)
print(response.url)