Loading...
Loading...
参考图生成视频把一张或多张图片当作指引,而不是直接当作首帧。参考图告诉模型某个主体、某个角色或某种视觉风格应该是什么样子,提示词则描述要围绕它构建的片段。输出不必以你的图片开头,但必须看起来与它属于同一个世界。
当你需要在多段片段之间保持一致性时,这个区别就格外重要。反复出现的角色、形状特定的产品,或者一套固定的视觉调性,靠每次喂同一张参考图来贯穿各个镜头,远比每次用文字重新描述来得容易。干净的参考图效果最好:主体清晰可见、背景安静,因为杂乱的照片会给模型太多相互竞争的线索,让它分不清究竟该沿用什么。
在 E2X 上,这一分类由 Google 的 Veo 3.1 Fast 和 Omni Flash 提供服务。两者的调用形态与目录中其他模型完全相同:向 jobs 接口提交模型 slug 和输入对象,再轮询它返回的 job ID。请求按次单独计费、从预付余额扣减,因此用同一张参考图分别测试两个模型,也不过是两次请求。
图像转视频会把你的图片作为片段的首帧。参考图生成视频则把图片当作主体或风格的指引,片段不必从它开始。
一张清晰、光线充足的照片,主体没有遮挡,背景也不会喧宾夺主。参考图越干净,模型沿用它的结果就越可预期。
这正是这个分类的用途。跨多次生成复用同一张参考图,保持主体一致的效果远好于在每条提示词里重新描述一遍。
一次请求,从你的预付余额中扣减,价格即目录中该模型显示的单次请求价格。