All models

grok-imagine-video

xAIVideo
Get your API key
grok-imagine-video

用文字构思镜头,让静态图片变成动态视频

grok-imagine-video 是 xAI Grok Imagine 系列的视频生成入口,适合把文字创意或已有图片转化为动态片段。它围绕文生视频与图生视频展开:前者从场景描述开始,后者以图片为视觉起点补充运动意图。通过本平台可提交生成任务、跟踪状态并取得视频链接,适合短视频素材和创意预演。

xAI模型品牌
视频模型类型
视频任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

创作方式
文本生成视频、图片生成视频
主要输入
prompt 文本;image_url 图片链接
视频控制
接口提供画幅、分辨率和时长设置
调用入口
POST /grok/videos;model 指定 grok-imagine-video
结果交付
JSON 任务结果与 video_url 视频链接
任务管理
异步提交、状态查询、完成回调

创作方式与任务管理说明对应本平台调用入口;画幅、时长和分辨率设置不等同于该型号的原生上限。

核心能力

了解 grok-imagine-video 能为你的工作带来什么。

从文字直接构思动态镜头

没有现成图片时,可用提示词描述主体、环境、动作与镜头意图,启动文生视频创作。适合先探索一个画面是否成立,再决定是否进入拍摄或后期制作。提示词宜围绕清晰的动作展开,避免把多个不相关的场景塞进同一段描述。

让已有图片获得运动表达

有产品图、人物插画或场景图时,可通过 image_url 提交图片,再用文字描述希望发生的动作,例如主体转身、镜头缓慢推进或环境产生变化。图片提供视觉起点,提示词补充运动方向,适合已有设计资产的动态化尝试。

把视频生成接入任务流程

生成任务可采用异步方式提交,不必让业务页面持续等待完整结果。应用保存 task_id 后查询进度,或使用完成回调接收结果,再根据状态展示视频链接。这样的流程适合素材工作台、创意审核页面和自动化内容生产程序。

适用场景

从具体任务出发,找到模型发挥作用的位置。

短视频创意预演

输入一段镜头构想,明确画面中的主体、动作和氛围,生成可供讨论的视频草案。团队可以围绕运动方向、构图意图与节奏选择继续细化的方案。交付物是动态预演素材,而不是已经完成字幕、配乐和剪辑的整条成片。

产品静态素材动态化

以现有产品图片作为输入,补充展示动作或镜头变化描述,制作动态素材候选。适合探索商品展示、活动视觉或品牌内容的表达方式。用于正式发布前,应逐项检查产品轮廓、标识和细节是否仍符合原始设计要求。

插画与场景的运动探索

提交人物插画或环境图片,用动作提示描述人物表情变化、姿态变化或场景运动,获得用于创作讨论的片段。可围绕同一输入调整描述,比较不同运动方案,再挑选适合的结果进入后续剪辑,而非要求一次完成复杂叙事。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

需要兼顾文字与图片起稿时选择

如果项目既有纯文字创意,也有现成图片需要动态化,grok-imagine-video 的两类创作方式更便于组织统一流程。与 grok-imagine-video-1.5:official 相比,后者明确要求图片输入,不适合作为纯文字起稿的直接替代。选择时先判断素材起点,而不是只看版本名称。

按具体入口区分相关版本

grok-imagine-video、带 :official 或 :reverse 的公开调用 ID,以及包含 1.5 的变体,应分别管理配置,不宜视为完全可互换的名称。需要复用现有工作流时,显式指定 model;迁移到相关版本时,重新测试输入模式与参数组合,不把新版本设置直接沿用到本型号。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • 本型号应按视频片段生成使用,不要把它当作 Grok 对话模型或完整剪辑软件。文字问答、网页搜索、视频延长、音轨制作和多镜头剪辑应作为独立需求安排,不能因同属 Grok 系列就默认包含在一次生成中。
  • 画幅、分辨率和时长是视频接口的配置维度,但不同型号的可用组合并不相同。为本型号保存独立的生成配置,先验证目标画幅与输出设置,再批量制作;不要将相关 1.5 变体的最高规格直接套用。
  • 图片输入用于引导视频创作,不应被当作逐帧锁定原图的编辑指令。人物外观、产品文字和细小图案应在结果中人工检查;需要连续叙事时,可先拆成独立镜头,再通过剪辑组织顺序与节奏。

常见问题

解答使用 grok-imagine-video 时的常见疑问。

没有图片能用 grok-imagine-video 吗?

可以从文本提示词开始文生视频创作。描述希望出现的主体、环境和动作即可,不必先准备静态图片。若已经有明确的视觉设计,则可改用图片输入,把提示词重点放在运动方式与镜头变化上。

图生视频时,提示词应该写什么?

优先写图片中接下来发生的变化,例如人物转身、物体移动或镜头推进,而不是只重复图片已有内容。通过 image_url 提交图片后,动作提示可帮助表达创作意图;结果仍需检查主体外观和画面细节。

它与 grok-imagine-video-1.5:official 有什么区别?

两者是不同的调用 ID。grok-imagine-video 面向文字与图片起稿的创作流程,而 grok-imagine-video-1.5:official 明确采用图生视频,必须提交 image_url。迁移时应根据输入素材重新选择,不要只替换名称。

能直接选择 fun、normal 或 spicy 吗?

不要将这些名称作为本型号的专用开关提交。创作时可在 prompt 中自然描述希望的氛围、动作和表现方式,例如轻松、克制或富有戏剧感;风格描述表达的是生成意图,并不是确定性的效果预设。

异步提交后怎样取得视频?

保存提交返回的 task_id,通过任务查询跟踪状态,或设置 callback_url 接收完成通知。结果中的 state 为 succeeded 且存在 video_url 时,再展示或获取视频;pending 表示仍在处理中,failed 应进入错误处理流程。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 grok-imagine-video 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。