视频 · 实测
Claude 能用你的照片做视频吗?Opus 5.5 对比 Seedance 2.5

如果你在网上卖产品,手里已经有照片,在商品页上放一段短视频就是顺理成章的下一步。Claude Opus 5.5 现在能返回 MP4,而 Seedance 2.5 这样的视频模型能把照片变成动态画面。面对同一张图,它们做的事情截然不同。
2026年9月28日,我们在 Ciyo 里为一袋虚构的咖啡豆做了三张产品照片,并用两种方式把它们做成视频:一次在 claude.ai 里用 Opus 5.5,一次在 Ciyo 里用 Seedance 2.5。Ciyo 不运行 Claude Opus 5.5;那一步是在 Anthropic 自家应用里完成的。
三张产品照片,同一个标签
我们的店是 Fernhollow Coffee,产品是一袋 250 g 的 House Blend 咖啡豆。我们请 Ciyo Agent(Ciyo 智能体)做三张 4:5 的照片:吧台上的咖啡袋、倒进碗里的咖啡豆,以及窗台上咖啡袋旁边放着一杯咖啡。
智能体先做了咖啡袋,然后把这张图作为另外两张的参考,让包装保持一致。三张照片里的标签都写着“Fernhollow”“House Blend”和“250 g”。每张照片都是 1792 × 2240 像素,这一轮智能体对话用了 51 个额度。

我们在店里和网上卖咖啡豆。请为我们的商品页做三张产品照片,每张 4:5:1) 一个 250 g 哑光牛皮纸咖啡袋的正面,深绿色标签上写着“Fernhollow”和“House Blend”,立在浅色橡木吧台上;2) 深烘咖啡豆从打开的袋子倒进一只小陶瓷碗的特写;3) 窗台上,柔和的晨光里,咖啡袋旁放着一杯黑咖啡。温暖的自然光,三张图里的袋子设计相同,没有人物。方式 1:Claude Opus 5.5 让照片动起来
我们在 claude.ai 里附上三张照片,要一段 10 秒的产品视频,最后一帧显示产品名称。Opus 5.5 工作了 2 分 1 秒,返回一个 1080 × 1350、每秒 30 帧的 MP4:10.0 秒,300 帧,4.5 MB,没有声音。
它直白地说明了自己的方法:每张照片缓慢推近、拉远,照片之间交叉淡化,最后是一张使用标签本身颜色的绿色片尾卡。用它的原话说:“Nothing was redrawn or generated.”(没有重绘或生成任何内容。)这正是这种方法的意义所在:视频里的标签就是你照片里的标签,一个像素都不差。

这是我们 Fernhollow House Blend 咖啡豆的三张产品照片。把它们做成一段 10 秒的产品视频,用于我们网店的商品页(4:5,1080 x 1350,30 fps)。先展示袋子,然后是倾倒的咖啡豆,然后是袋子和一杯咖啡,最后停在一个干净的画面上,写着“Fernhollow House Blend · 250 g”。袋子和标签要和照片里完全一样。给我一个 MP4。方式 2:Seedance 2.5 做出真正的运动
我们在 Ciyo 的画板上放了一个 Video Generator(视频生成器),选择 Seedance 2.5 和 Frames(首尾帧)模式,把倾倒咖啡豆的那张照片设为起始帧。这次运行花了 197 个额度,用时 12 分 4 秒。
结果是一段 5 秒、860 × 1076、每秒 24 帧的视频,带声音。这里的咖啡豆是真的在落下:豆流一直在动,碗逐渐装满,最后还有一颗豆子从碗沿弹开。无论怎么裁切一张静态照片,都做不到这一点。

为一家咖啡店的网店做产品视频。烘焙好的咖啡豆以慢动作不断从倾斜的袋子倒进陶瓷碗里,几颗豆子从碗沿弹开,晨光柔和。镜头几乎静止,只有非常缓慢的推近。袋子、绿色标签以及“Fernhollow”和“House Blend”这几个字要和照片里完全一样,每一帧都清晰、不变。不要新增文字,没有人物。标签发生了什么
Seedance 保留下来的字母依然清晰,但我们自己的措辞让品牌付出了代价。我们要求“非常缓慢的推近”,镜头却推得足够近,把标签推出了画面。按标签的深绿色像素计算,开头时标签 100% 在画面内,2.5 秒时是 93%,5 秒时是 65%。最后一帧只剩下“Fe”和“House B”。
如果名称必须保持可读,就告诉视频模型让镜头完全静止、让整个标签留在画面内;或者用视频片段表现动作,用静态照片展示名称。

该用哪一种
这两种方法回答的是不同的问题。标签、价格和名称必须准确时,用代码。产品需要做点什么时,比如倾倒、冒热气、旋转或打开,用视频模型。
| 对比项 | claude.ai 中的 Opus 5.5 | Ciyo 中的 Seedance 2.5 |
|---|---|---|
| 什么在动 | 镜头在静态照片上移动 | 照片里的东西 |
| 标签和文字 | 准确,一个像素都不差 | 清晰,但可能移出画面 |
| 我们得到的时长 | 10 秒,三张照片都用上 | 5 秒,一张照片 |
| 尺寸 | 1080 × 1350,30 fps,无声音 | 860 × 1076,24 fps,有声音 |
| 用时 | 2 分 1 秒 | 12 分 4 秒 |
| 最适合 | 必须和包装一致的商品页 | 必须抓住眼球的社交短片 |
在一条视频里两者并用
效果最好的做法是两者并用。把 Seedance 的倾倒片段放在中间,让动作吸引目光;开头和结尾用标签由你掌控的静态照片。你可以在 claude.ai 里附上这段片段和照片,让 Opus 按这个顺序把它们接起来;这一步我们没有测试。
不管选哪种,发布前都要看一眼最后一帧。视频停下时人们看到的就是这一帧,而在我们的测试里,它也最容易丢掉品牌。
用产品照片做视频
Claude 能用我的照片做视频吗?
能。2026年9月28日,claude.ai 里的 Claude Opus 5.5 用大约 2 分钟把我们的三张照片做成了一段 10 秒的 MP4。它移动并淡化的是照片本身;照片里面的东西没有动。
视频模型会改动我的标签吗?
在我们的 Seedance 2.5 测试中,字母保持清晰,但一个缓慢的推近镜头把标签移出了画面。如果名称必须保持可读,就要求镜头静止。
哪个更便宜?
Seedance 2.5 做 5 秒花了 197 个 Ciyo 额度。Opus 5.5 是在 claude.ai 的订阅计划上运行的,所以费用取决于你的 Anthropic 订阅。
两种都能在 Ciyo 里做吗?
Ciyo 可以做照片,也运行 Seedance 2.5。它不运行 Claude Opus 5.5;基于代码的视频请用 claude.ai 或 Claude Code。
在 Ciyo 里做照片,也做动态
生成一组风格统一的产品照片,再用 Seedance 2.5 让其中一张真正动起来。