xAI升级 Imagine Video1.5:新增图像语音参考与原生1080p视频生成

xAI 为视频生成模型 Imagine Video1.5推出重大升级,新增图像参考、语音参考、纯文本生成视频以及原生1080p输出能力,进一步提升AI视频创作中的角色一致性、场景控制和画面质量。目前,文本转视频和1080p视频生成功能已在 Grok Imagine 网页版、iOS版和Android版上线,图像与语音参考功能已率先向美国地区 SuperGrok Heavy 和 SuperGrok Plus 用户开放,并计划后续覆盖更多用户。

此次更新为用户提供了更灵活的视频生成流程。创作者既可以直接通过文字描述生成视频,也可以上传参考图像控制角色、产品或场景,还能够结合角色图片与语音样本,让AI在不同镜头中保持外观和声音一致。xAI 表示,Imagine Video1.5单次生成最多支持七个视觉参考,用于分别固定人物面部、产品特征或环境元素,从而实现更精细的内容控制。

在多重参考模式下,用户可以保留角色身份并替换背景,也可以保持场景不变更换角色,或仅调整动作而维持整体视觉设定。语音参考功能则进一步解决了AI视频制作中的角色连续性问题,使同一角色在多个片段中保持稳定的面部特征和声音表现。

面向开发者,xAI API 已支持通过 grok-imagine-video-1.5 模型调用图像引用、文本转视频和原生1080p视频生成能力。开发者可以通过API传入提示词、参考图像URL、视频时长、宽高比和分辨率等参数完成视频生成,语音参考功能则需要通过请求方式接入。

Imagine Video1.5于上月发布,xAI 曾表示该版本在运动表现、物理模拟和音频生成方面进行了优化。此次升级进一步强化了模型对身份、场景和产品细节的控制能力,使AI视频生成从简单的画面转换逐步迈向更接近专业影视制作流程的多模态创作工具。

via AI新闻资讯 (author: AI Base)
 
 
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]