H3 Max
多模态视频工具

参考图转视频 AI 生成器

换了场景,人还是同一个人

上传一到三张参考素材,画面里的主体会被带进镜头:面孔、服装、比例。然后你只需要说明他在哪里、发生了什么。身份由参考素材负责,提示词就不用管了。

创作工作区

参考图转视频 AI 生成器

50

参考图转视频 AI 生成器是什么?

参考图生视频,就是用示例图片来生成片段,而不是单靠文字。你提供角色、产品或风格的参考图,模型生成的每个镜头都会让它们保持可辨认。

模型的开发方是这样描述它的:

“fal's H3 Max is a post-trained variant of MiniMax H3, tuned for stronger prompt adherence and better aesthetics while co-optimized with our custom inference stack for higher throughput with no compromises on output quality”
MiniMax H3 Max on fal译自原文。

参考图转视频 AI 生成器 规格

你提供
1–3 张参考素材
参考决定
是谁、长什么样
提示词决定
在哪里、发生什么

用参考图转视频 AI 生成器可以创作什么

这些是大家真正拿 参考图转视频 AI 生成器 来做的事,以及每件事需要的设置。

01

同一个角色,很多场景

系列内容里反复出现的主播、吉祥物或主角,每条片子都得让人认出是同一个人。

02

同一件产品,很多场景

同一个瓶子、鞋子或设备,放进厨房、街头、影棚,不用每次重新布景。

03

几张静态图,一个镜头

主体取自一张图,场景取自另一张,中间的运动交给模型生成。

参考图转视频 AI 生成器

为模型量身设计的工作区

参考图转视频 AI 生成器 把最影响结果的那几个控制项放在你面前,其余的都收起来。

01

角度越多,越像

同一个主体给两三张,比给一张好。只给一张,模型只看见一个侧面,剩下的它自己编;多出来的视角就是用来堵住这一点的。

02

描述场景,而不是主体

身份已经由参考素材负责,提示词就可以整段用来写场景、动作、镜头和光线。

03

和图生视频不是一回事

图生视频是让你给的那张画面动起来,构图也一起保留。这里只把主体取出来,放到别的地方。

04

声音与画面一同生成

环境音、音效和对白与画面一同生成,而不是事后再配上去。

05

高度接近,但不是复制

相似度很高,但不做保证。最先出问题的是远景人脸、少见角度,以及 logo 上的小字这类细节。按「多跑一次」来安排,别等交付时才发现。

参考图转视频 AI 生成器

结合实际场景做选择

什么时候该用 参考图转视频 AI 生成器,什么时候换个模型更合适。

起点

一个你必须保住的主体

提示词决定

除了「是谁」以外的一切

什么时候用它

同一张脸或同一件产品还要再出现

如何让主体在多个镜头间保持一致

01

上传 1–3 张参考素材

同一个主体、不同角度、光线清楚。同一张脸的三个视角,比三张不同的脸有用。

02

围绕主体写场景

地点、动作、运镜、声音。不用写他长什么样,那是参考素材的事。

03

生成,然后再生成一次

每次生成的相似度都会有差异。跑两三次挑最好的一条,比反复改文字去凑更划算。

04

复用同一组参考

做系列内容时固定这组参考,只改提示词。第四集之所以还像第一集,靠的就是这个。

关于参考图转视频的常见问题

开始使用参考图转视频 AI 生成器

现在整理好简报,然后进入统一的 Studio 工作区。