一张人像
眨了一次眼、一个很淡的微笑、镜头缓慢推近。全程还是同一个人。
上传一张照片,拿回一条 4 秒的视频。什么都不用写——运动方式已经替你选好了。注册之后第一条免费,输出 480p,大约两分钟出片。
本页的真实输出,循环播放。进去的只有一张照片。
上方这个 AI 图片转视频工具收一张照片,给你一条 4 秒的片子:主体轻微动一下、镜头缓慢推近、背景里的东西轻轻飘。上传、点生成,大约两分钟后就在手上。没有任何东西要你写——这个照片变视频的工具跑的是一条固定的运动指令,所以它才能只是一个按钮。新账户注册送 20 credits,这里一条按列表价 20 credits,所以第一条免费;之后每生成一条按条计费,万一生成失败,credits 会自动退回。
想自己写运动方式,或者需要长于 4 秒? 用完整视频模型
一次上传,一个按钮。照片不一定要拍的是人。

人像、产品图、风景照——三种我们都实测过,都能跑。清楚的照片比又暗又糊的照片动得好。

480p、4 秒就是注册赠送的 credits 覆盖的那一档,而且已经选好了。720p 和 10 秒的档位需要订阅套餐——你点之前药丸上就写着。

片子在服务端渲染——我们自己跑的几次是 91 到 122 秒。你可以离开页面再回来,成片都会落进你的视频库。
大多数图片转视频的工具会给你一个文字框,让你描述想要什么运动。Google 对这个搜索给出的摘要也是这么讲的。这一页不是——而且这是刻意的,不是缺了一块:它跑的是一条由我们挑好、也实测过的运动指令,所以「把一张照片变成视频」是一个按钮,不是一次写作练习。
这条指令要的东西很小、也很真实:主体轻微动一下、镜头缓慢推近、背景里的东西轻轻飘,光线和人脸都待在原地。我们在两个更戏剧化的候选里选了它,理由只有一个——它不会在没有人的照片上崩。一条写着「让主体活起来」的指令,在人像上很好看,接到一张产品渲染图就会凭空编出一只生物。这一页只给你一条免费的片子,所以下限比上限重要。
代价是你没法指定某个具体的运镜、某个具体的动作、某种具体的情绪。想要这些,去视频页面用完整的模型阵容自己写提示词——同一个账号,不用另外注册。这一页是给「手上有张照片,现在就想看它动起来,一个字都不想写」的人用的。
这里每一条都是本页 480p、4 秒的真实输出——就是你第一条免费片子跑的那一档,不是拿更大的模型做的演示。
眨了一次眼、一个很淡的微笑、镜头缓慢推近。全程还是同一个人。
玻璃和水面起了涟漪,而产品本身跟拍摄时一模一样,没有凭空编出东西。
麦子随风起伏,远处那个人物在移动。安静,但确实在动。
更长、更清楚、由你自己写提示词的成片来自视频页面——这一条是 Seedance 2.0,不是本页跑的 mini 档。
下面全是我们自己跑出来的数字,因为这个搜索结果页上几乎没有一家把它们写出来。免费这一档给你的是:4 秒、480p——方形输入实测产物约 640×640——H.264 文件带一条音轨,1 到 2MB,端到端 91 到 122 秒,含排队时间。它带水印。
这足够让你看到一张照片动起来,也足够发给某个人看。它不够做成一件成品。4 秒装得下一个小动作,装不下一段过程:没有场景切换,没有故事,没有副歌进来的那一下。而 480p 在手机上还行,在笔记本上就偏软。这两件事都是「第一条免费」的诚实代价。
有些照片是怎么跑都不会好的。深阴影、明显的动态模糊、或者主体被裁得太紧、周围什么都不剩,模型能拿到的信息都太少。审核也会直接拒掉一部分人物照片。这两种情况发生时生成都会失败,credits 直接退回来,所以一次失败的尝试花掉的是时间,不是你那条免费的片子。
上传之前还有一条边界值得知道:成片会继承你照片的形状。方的照片出方的视频,手机竖着拍的出竖的。不会裁掉什么,但也不会补出什么——模型没法把一张竖构图撑成横构图。
在这个词上排前面的九个工具里,有七个把 free 写进了标题,而几乎没有一个说清那能换到什么。我们的口径是:注册送 20 credits,默认档位一条按列表价 20 credits,所以第一条视频免费——不用绑卡,也没有需要取消的订阅。之后就是按条计费。我们并没有一个长期免费的档位,把注册赠送的 credits 说成那个,你生成第二条的时候就会发现是假话。
有两件事让这句话不只是文字游戏。一是生成失败会自动退回 credits,所以模型用不了的照片不会悄悄吃掉你唯一那次免费机会。二是本页刻意跑便宜的那一档:720p 和 10 秒的档位要贵好几倍,这正是它们被标成「需要套餐」、而不是在你点下去时默默从账上扣钱的原因。
免费这一条带水印。无水印导出属于付费套餐——生成一条片子要真金白银的算力,这是我们能给出的诚实的交换。
在这个盘面上排前面的工具,大多把这件事叫 image to video ai,而不是 photo to video ai,它们指的是同一个操作:一张静止的画面进去,一条短片出来。如果你是搜「照片转视频 ai」「图片转视频」或者英文的 image to video ai generator 找过来的,这一页就是你要的东西——上面那个组件不在乎你是用哪个说法搜到它的。
名字确实有一点分岔,分岔在范围上。「image to video」也被用来指文字驱动的生成:你写一段提示词,模型照着造运动。那是视频页面在做的事,不是这一页。而免费的 image to video ai 在任何地方通常都意味着一条带水印的低分辨率片子,我们也一样;谁要是说高清不限量白给,那要么马上要你的卡,要么马上就没了。
在这里你能拿到的一个真实差别是:因为我们跑的是一条实测过的固定指令,而不是你的提示词,所以在不同类型的照片上结果是稳定的。对已经明确知道自己要什么运动的人,这不值钱;对只想让照片动起来的人,这很值钱。
上面那个组件跑的是又快又便宜的档位,这样第一条才可能免费。当这个天花板成为问题时,同一个账号在视频页面拿到的是完整的模型阵容。
| 你能拿到什么 | 本页 | Renoise 视频模型 (Recommended) |
|---|---|---|
| 分辨率 | 480p | 最高原生 4K |
| 片长 | 4 秒 | 4–30 秒 |
| 提示词自己写 | — | ✓ |
| 运镜自己选 | — | ✓ |
| 第一条免费 | ✓ | — |
| 水印 | 有 | 付费套餐可导出无水印 |
这一页动的是一张照片。它不会收下一整个文件夹的照片、再配上音乐串成一段回忆视频,而且没有任何办法让它这么做——一次上传,一条片子,每次都是。
如果你真正想要的是幻灯片,那是另一个工具,我们有一篇专门的指南。这个区别值得说清楚,因为这两件事最容易被混在一起:幻灯片让你的照片保持静止、在照片之间切换;而这一页只留一张照片,动的是照片里面的东西。
修老照片也是单独的一步,而且它该排在前面。一张有划痕、褪了色的扫描件动起来,划痕也一起动了——先把它修干净,再回到这里来。
用你自己的照片、已经同意出镜的人的照片,或者你自己拥有的东西的照片。让一个陌生人、一个名人、或者一个从没同意过的人在片子里动起来,属于未经同意的合成影像——别拿这个工具做那种事,在大多数地方它除了有害,还违法。永远不要用未成年人的照片。
人脸合规在每一次生成上自动执行,这也是为什么不需要你先去注册什么。但自动检查是底线,不是许可:它没办法知道照片里的人有没有同意,这个页面上的任何东西都做不到。那个判断是你的,做片子时是,分享时也是。
你上传的东西不是一个展览。登录之前不会存下任何内容,生成结果只属于你的账号,你上传的照片是用于这一次生成,而不会被放进一个公开的信息流。
一张照片传到这个页面之后会发生什么。
选择文件只会在你的设备上预览。登录并点击生成之前,不会存储任何字节。
上传内容进入你的私密资料库,绝不会出现在公开图库中;重复处理同一张照片不会产生新的存储。
你可以随时从资料库中删除上传内容和生成结果。
一个套餐解锁 Seedance、Kling 3.0 Omni 以及其它每一个视频模型。
第一条片子是免费的。新账户注册送 20 credits,默认的 480p、4 秒档位一条按列表价 20 credits,正好覆盖第一条。之后每生成一条按条计费——我们没有长期免费的档位,也没有试用期,就是「先给你一笔 credits,用完按条计费」。
要注册。这一点绕不开,我们宁可先说清楚,也不想让你传完照片才撞墙:免费的 credits 是挂在账号上的,不注册就没有可花的免费额度。注册只要一个邮箱,送 20 credits,正好是这里的一条片子。
本页不能。提示词是写死的——正是这一点让它是一个按钮而不是一个文字框——所以你没法指定某个运镜、某个动作或者某种情绪。想自己写提示词,去视频页面,同一个账号,完整的模型阵容,片子也能更长。
不能。一张照片进,一条片子出,每次都是——这个工具动的是一张照片里面的东西,不是在几张照片之间切换。要把多张照片配上音乐串成一段,看我们那篇做照片幻灯片的指南。
480p 下的 4 秒。上面 720p·4s 和 720p·10s 两档带着锁,因为注册赠送的 credits 覆盖不了;本页也完全没有 1080p 这一档。要更长的片子、更高的分辨率或者换个模型,带着套餐去视频页面。
不会。失败、取消、以及被审核拒掉的生成都会自动退回 credits,所以一张跑不出来的照片花掉的是时间,不是你那条免费的片子。这一条我们拿真实的失败验证过:扣费和退回是前后几秒钟的事。
有帮助,但不是决定性的。更要紧的是主体清楚可见:光线均匀、对焦正常、别裁得太紧以致周围什么都不剩。一张清楚的小图,比一张很大但很暗的图动得好。不管你传什么,输出都是 480p。
大体上会,而且比这个档位该有的表现要好——我们那条人像实测里,全程明显还是同一个人,只是多了一次眨眼和一个很淡的微笑。但这不是保证。侧脸、陷在深阴影里、或者人在画面里很小的照片,可参考的信息更少,四秒里就可能漂。
可以,而且这正是固定提示词少见地占优的地方。我们拿同一条指令跑过一张 3D 产品渲染图和一片麦田:产品本身跟拍摄时一模一样,而它周围的玻璃和水面起了涟漪;麦田则随风起伏。一条为人写的提示词,在这两种输入上都会凭空编出一个主体。
对这个工具来说是一回事——图片、画面、照片,说的都是「一张静止的画面进去,一条短片出来」,只是竞品大多用 image to video 这个说法。这个短语也被用来指由文字驱动的视频生成,也就是你自己写运动,那属于视频页面,不是这一页。
Seedance 2.0 Mini,480p、4 秒。它是我们跑的最便宜的视频档位,这也正是第一条能免费的原因。更强的模型——Seedance 2.0、Kling 3.0 Omni 以及其它——在视频页面,需要套餐。
这一档的免费片子带水印。无水印导出属于付费套餐,商用也归在那边。不管哪个套餐,consent 的规矩不变:拍到人的片子,需要那些人自己同意过。