AI 视频工作台

图片转视频 AI

上传一张静态图片,描述你想要的运动,即可生成一段可下载的短视频,同时让主体与构图锚定在你的画面上。

起始帧 · 必需(0/1)
尾帧 · 可选(0/1)

起始帧决定主体特征和画面比例。只有需要特定结束构图时,才添加尾帧。 上传前请先登录。

0 / 7,000
6 秒
4 秒15 秒
画面比例

继承自起始帧

如果需要其他画布,请在上传前裁剪。

需要账号138 积分 · 23 积分/秒
预览就绪

添加起始帧

请使用主体清晰、边缘干净的锐利原图。生成完成后,视频会替换这里的预览。

4–15 秒 · 原图比例 · 768P 或 2K
打开我的作品
直接回答

什么是图片转视频 AI?

图片转视频 AI 会把一张静态图片变成一段短视频。上传的画面会锁定主体、构图、配色和比例;你还可以用可编辑的提示词指定运动、镜头行为、氛围以及需要保持稳定的细节。可选的尾帧能引导视频结束时的构图。

系统是预测新的画面,而不是简单平移或缩放原图,因此物体、头发、水面、云层、光线和镜头都能真正动起来,但结果也带有随机性。人脸可能出现偏移,文字会变模糊,重复图案会抖动,物体前后遮挡时边缘也会变化。实用的做法是:用干净的原图、克制而明确的运动描述,并认真回看结果。

Banana Pro AI 需要一张起始图,可选尾帧,提示词最多 7,000 个字符,时长 4 到 15 秒,输出可选 768P 或 2K。比例来自起始图。生成以异步任务方式跟踪,刷新页面或稍后在“我的作品”中查看都不需要重新提交。

真实输入与输出案例

三组可复现设置的图片转视频测试

每个案例都配有一张自有原图、实际生成的 MP4、完整提示词、参数设置、积分消耗以及一份如实的点评。结果是这些运行中的证据,并不保证每次生成都完全一致。

深色石面上琥珀色化妆品瓶的棚拍原图
输入
输出

可控的产品环绕

6 秒 · 原图比例 · 768P · 138 积分

“Slow 120-degree orbit around the bottle, controlled push-in, warm reflections travel across the glass, background haze drifts gently, preserve the exact silhouette and cap geometry.”

观察结果:瓶身始终清晰可辨,光线也多了动感。标签上的细小纹理可能变柔和,因此正式的广告字体建议在后期软件中添加。

柔和窗光下的时尚人像原图
输入
输出

细微的人像运动

5 秒 · 原图比例 · 768P · 115 积分

“One natural blink and subtle breathing, a light breeze moves loose hair, window light shifts softly, locked camera, preserve facial structure, clothing, and background geometry.”

观察结果:小幅运动比夸张的转头更能保护人物特征。请逐帧检查眼睛、牙齿、发丝边缘、耳饰以及皮肤与背景的过渡。

带云层与前景草地的山湖原图
输入
输出

会呼吸的风景

8 秒 · 原图比例 · 2K · 296 积分

“Clouds drift slowly across the valley, water ripples toward the foreground, grasses sway in a mild breeze, gentle cinematic push-in, preserve the horizon, shoreline, and rock edges.”

观察结果:层次分明的运动效果最好。请留意岸边是否融化、植被是否被复制,以及倒影方向是否与水面一致。

实用工作流

如何把一张图片变成视频

先从你希望观众认得出的画面开始,只描述一个连贯的运动,并用第一次生成了解这张图片的具体表现。

1. 准备一张清晰的起始图

使用清晰、主体明确、构图有意的 JPG、PNG 或 WebP,并预留足够的运动空间。生成器会继承原图比例,因此请在官网上传前先裁成竖版、方形或横版,而不是期待隐藏的裁剪选项。

2. 描述看得见的运动

说明什么在动、动多少、什么要保持稳定以及镜头如何运动。“Hair moves in a light breeze while the camera stays locked” 比 “make this cinematic.” 更容易评估。把人物特征和几何约束放在动作描述之后。

3. 只在有用时添加尾帧

可选尾帧能引导揭晓、转场或前后对比镜头的结束构图。它同时也是一种额外约束,因此当自然的开放式运动比精确最终姿态更重要时,可以不加。

4. 选择时长和分辨率

生成 4–15 的整数秒视频。先用 768P 做短片段对比方案更省钱;当更大画面便于剪辑时再选 2K。提交前工作台会显示精确的积分总量。

5. 检查完整片段

用正常速度播放并检查关键帧。查看人物特征、形状、手部、文字、边缘、反光、遮挡关系和最终构图。可以直接下载满意的结果,或回到“我的作品”查看,都不会再次扣费。

写出保护原图的运动提示词

可靠的写法是:subject motion + environmental motion + camera behavior + pace + preservation constraints。例如:“the leaves move in a mild breeze, water ripples forward, slow push-in, preserve the bridge shape and horizon.” 具体动词能让预期的变化看得见、可验证。

运动的幅度要与原图匹配。近景人像通常适合眨眼、呼吸、头发或光线的细微变化。产品图可以环绕或推近,但大幅旋转会迫使系统凭空创造从未出现过的表面。风景图可以按景深分别描述云、水、植被和镜头运动。

说明哪些必须保持稳定:面部结构、产品轮廓、包装瓶盖、服装图案、固定镜头、水平线或不变的背景几何。约束能减少歧义,但无法保证逐像素一致。请在后期中添加精确的字体、标志、字幕、对白和法律文本。

输入、时长、分辨率与积分

  • 起始图:必需。上传完整的 JPG、PNG 或 WebP,最大 20 MB。它决定画布形状、人物初始特征和开场构图。
  • 尾帧:可选。用于指定结束姿态、揭晓、转场或镜头终点。如果一张原图加自然运动就够了,可以不加。
  • 时长:选择 4–15 的整数秒。片段越短动作越容易控制;片段越长越有发挥空间,也越容易出现偏移。
  • 分辨率与价格:768P 每秒 23 积分,2K 每秒 37 积分。一段 6 秒视频在 768P 下为 138 积分,2K 下为 222 积分。8 秒 2K 案例为 296 积分。
  • 音频与镜头:本工具没有独立的开关。请在提示词中描述相关声音或镜头运动,而不要依赖执行链路并不支持的控件。
适用场景与限制

图片动起来能创造价值的地方,以及需要复核的地方

当团队已经有一张值得保留的画面,又希望比重建整个场景更快地获得运动时,图片转视频最有用。

电商与创意团队可以为一句话产品渲染图、广告主视觉、包装概念、时尚人像、旅行摄影、建筑场景、插画和社交缩略图添加运动。结果可以用作付费社交短片、头图背景、提案影片镜头、音乐视觉、转场或预演参考。从已通过的画面出发,通常比只凭文字更容易让评审者有明确的评估目标。

原图越清晰、人脸或产品占据的像素越多、运动越克制,就越容易保持人物特征。大角度旋转、快速手部动作、明显表情变化、物体消失和复杂交互都需要模型补充更多隐藏信息。当镜头移动到原图之外时,构图也可能发生偏移。

头发、玻璃、首饰、辐条、植被、手指、花纹布料、文字和倒影附近尤其值得留意。水面和镜面应与场景一致地运动。对于可能被误认为真实证据的演示、安全说明、历史资料、医疗内容,请格外仔细地复核。

你有责任确保拥有上传并为其添加运动的权限,包括相关的著作权、商标、肖像、隐私和合同权利。请勿将本工具用于欺骗性冒充、剥削性图像或伪造证据。商用属于项目级决策:请保留原图记录、授权、提示词、选定结果以及形成最终交付物的编辑过程。

商业对比

图片转视频 AI vs 文字转视频 AI vs 传统视频制作

合适的工作流取决于已经通过了什么、需要多少人物特征控制,以及成片是否必须记录真实事件或表演。

决策点图片转视频 AI文字转视频 AI传统制作
起点一张已通过或选定的图片;可选尾帧一段文字场景,无需原图脚本、分镜、团队、演员、场地、设备与排期
视觉控制初始构图和人物特征有强锚点;新增运动仍可能偏移可自由创造完整场景;初始特征控制较弱规划得当即可获得最高的物理、表演和连戏控制
最适合产品图、人像、插画、风景、主视觉和转场概念探索、虚构场景、氛围短片和没有原图的镜头真人、访谈、演示、真实产品和复杂镜头覆盖
成本结构积分随时长和分辨率增长;前期需要准备原图积分随时长、分辨率和所选画幅增长预算随人员、场地、时间、设备、后期、保险和授权增长
主要复核原图权利、人物特征、边缘表现、凭空生成的表面、运动和结束画面构图、人物特征、事实、运动、文字和故事连贯性授权、安全、连戏、剪辑、音乐、声明、真实性与交付

当某张特定原图需要决定镜头时,请使用本页。如果场景应该从文字开始,请改用文字转视频 AI 生成器。当必须呈现真实证据、精确表演或完整物理控制时,传统制作仍是更负责任的选择。

常见问题

图片转视频 AI 常见问题

关于文件、控件、时长、比例、失败处理、下载和负责任商用的简明解答。

可以上传哪些图片格式?

本工具支持完整、大小不超过 20 MB 的 JPG/JPEG、PNG 和 WebP 图片。服务器会校验真实的文件字节和受信任的上传位置,而不仅仅依赖文件名或浏览器的 MIME 标签。

起始图是必需的吗?

是的。本产品刻意要求提供起始图,让生成的镜头有视觉锚点。尾帧是可选的,仅当最终构图重要时才使用。

可以选择画面比例吗?

视频会沿用起始图的比例。如果目标平台需要其他画幅,请在上传前裁剪或扩展图片。本页不提供比例选择器,因为底层的图片转视频链路并不支持。

生成的视频可以有多长?

可以选择 4 到 15 秒之间的任意整数时长。短视频通常更容易控制单一动作。更长的故事请拆成多个镜头,再把这些片段剪在一起。

如果生成失败会怎样?

确认失败或已取消的任务会走站内退款流程,预订的积分只退还一次。如果因网络中断而无法确认提交状态,同一个已跟踪任务会保持待处理,而不会再次提交并扣费。

AI 生成的视频可以商用吗?

商用是否合适取决于你的套餐、司法辖区、原图权利、出镜人物与品牌、音乐、声明和预期用途。请只使用你拥有或已获授权添加运动的素材,保留审批记录,并就重大法律问题咨询专业人士。

证据说明

来源与方法

上述控件和限制与实时生成契约及受信任上传边界保持一致。产品行为可能变化,发布前请核实重大活动与权利方面的要求。

由 Banana Pro AI 产品团队审核 ·

继续探索

相关视频工作流与模型指南

在选择合适的工作流之前,可以先对比更全面的生成器目录、以提示词为主的创作、后期工具和模型专属指南。

让你最好的图片拥有下一个瞬间

从一张你有权使用的画面开始,描述一个看得见的运动,生成一份可以认真回看的草稿。

打开生成器