使用场景

AI 视频生成器

Sky Studio 是一个 AI 视频生成器,把六个视频模型放在同一个工作区:Google 的 Veo 3.1 Fast、Veo 3.1 Pro 和 Gemini Omni 1.1 Flash,字节跳动的 Seedance 2.0 Pro,MiniMax H3(海螺 3),以及 xAI 的 Grok Imagine。可以从提示词、首尾帧或参考图开始,生成最长 15 秒、最高 4K 的片段,支持的模型还会带声音。

生成视频

你可以做什么

  • Google、字节跳动、MiniMax 和 xAI 的六个视频模型。
  • 文生视频、首尾帧和参考图三种方式。
  • 最长 15 秒、最高 4K(取决于模型)。
  • 大多数模型带声音,Seedance 可以选择开关。
  • 在影视画布里做分镜,保持角色一致。

怎么选

写实镜头,自带声音
Veo 3.1 Fast 或 Veo 3.1 Pro
用图片、视频或音频参考的较长镜头(最长 15 秒)
Seedance 2.0 Pro
多个镜头里保持同一个角色
Grok Imagine,或用参考图的 Seedance 2.0 Pro
动作表现生动,或用参考图做到 4K
MiniMax H3
低分辨率快速试稿,或延长已有片段
Gemini Omni 1.1 Flash

模型对比

模型分辨率片段时长声音输入方式适合
Veo 3.1 FastGoogle1080p–4K8 s有文字、首尾帧快速生成写实片段,自带声音
Veo 3.1 ProGoogle1080p–4K8 s有文字、首尾帧Veo 最高画质,自带声音
Seedance 2.0 ProByteDance480p–1080p4–15 s可选文字、首尾帧、参考图/视频/音频用多种参考素材生成较长镜头
MiniMax H3(海螺 3)MiniMax480p–4K5–15 s有文字、首尾帧、参考图动作表现生动;参考图模式最高 4K
Grok ImaginexAI480p–720p1–15 s有参考图用参考图保持角色一致
Gemini Omni 1.1 FlashGoogle360p–4K3–10 s有文字、首尾帧、参考图、延长片段低分辨率快速试稿,以及延长片段

同一提示词,不同模型

提示词: “A red paper boat drifts down a rain-soaked city street at dusk, neon signs reflecting in the rippling water, slow tracking shot at street level, cinematic, gentle sound of rain”

  • Veo 3.1 Fast
  • Seedance 2.0 Pro
  • MiniMax H3(海螺 3)
  • Gemini Omni 1.1 Flash

如何运作

1

选模型

选一个适合这个镜头的模型,上面的表格列出了时长、分辨率和声音。

2

给一个起点

写提示词,或加上首尾帧,或加上角色、商品的参考图。

3

设置时长、分辨率和声音

选项会跟着所选模型变化,生成前应用会显示所需积分。

4

生成

视频在后台生成,完成后会出现在你的工作区。

5

串成故事

到影视画布里规划分镜,或直接下载片段。

常见问题

哪个 AI 生成视频最好?

看镜头需要。Veo 3.1 擅长写实和原生声音,Seedance 2.0 Pro 擅长用多种参考素材生成较长镜头,Grok Imagine 擅长用参考图保持角色一致,MiniMax H3 擅长生动的动作,Gemini Omni 1.1 Flash 适合快速试稿。在 Sky Studio 里可以把同一个想法交给几个模型,留下最好的一条。

AI 视频最长能做多长?

单个片段:Seedance 2.0 Pro、MiniMax H3 和 Grok Imagine 最长 15 秒,Gemini Omni 1.1 Flash 10 秒,Veo 3.1 8 秒。更长的影片可以在影视画布里用多个片段拼接。

可以把图片变成视频吗?

可以。大多数模型支持首帧,一些模型还支持尾帧或参考图,所以商品图或角色设定图都能成为第一个镜头。

生成的视频有声音吗?

大多数模型会带声音:Veo 3.1、Gemini Omni 1.1 Flash、MiniMax H3 和 Grok Imagine 生成的片段都有声音,Seedance 可以选择开或关。每个模型的情况见上面的表格。

需要订阅吗?

不需要。Sky Studio 按量付费,需要时购买积分,积分永不过期。每条视频消耗多少积分,生成前应用会显示。

在 Sky Studio 中创建

生成视频