xAI 已更新其 Imagine Video 1.5 模型,支持文本、图像和语音引用,使用户能够生成分辨率高达 1080p 的视频。此次更新通过锁定跨场景的面部和声音来实现角色一致性,并支持每次生成最多七个引用。

  • 图像和语音引用功能现已在美国地区的 SuperGrok Heavy、SuperGrok Plus 以及 iOS 上可用。
  • 文本转视频和图像转视频工作流均支持原生 1080p 生成。
  • 文本转视频功能允许用户仅通过提示词生成视频,无需起始图像。
  • 该功能适用于 iOS 和 Android,可通过 grok-imagine-video-1.5 模型访问 API。

此更新通过允许用户在改变动作或场景的同时保持角色和设置的一致性,增强了创意控制能力。