视频生成 AI,按用途该选哪个
候选模型根据各模型的官方介绍挑选,并非质量排名。
按用途选择
只用文字制作社交媒体短视频
想仅通过文字描述生成 5~10 秒视频时
Kling 3.0 Turbo (Kling)Veo 3.1 Lite (Google)Seedance 2.0 Mini (ByteDance)
先用速度快、价格低的版本生成多个结果,再用更高档模型重做喜欢的方向,通常更省钱。
官方信息已核实
让一张照片动起来
将产品照或人像照作为起始画面,只添加动作时
Kling 3.0 (Kling)Seedance 2.5 (ByteDance)Wan 3.0 (Alibaba Wan)
起始图像的分辨率会影响结果质量。请上传高分辨率原图。
官方信息已核实
让同一个人物出现在多个场景
需要在各场景中保持角色或人物面孔一致时
Seedance 2.0 (ByteDance)Kling 3.0 (Kling)
支持上传多张参考图像的模型更有优势。
官方信息已核实
一次生成带声音的视频
想一次得到包含音效或背景音的视频时
Seedance 2.0 (ByteDance)Wan 3.0 (Alibaba Wan)Veo 3.1 Lite (Google)
开启声音生成通常会消耗更多点数。
官方信息已核实
公开基准测试中的表现
这是 LMArena 用户投票榜单的前 5 名,与本站实测无关,仅供参考。
文字→视频 发布日期:2026-09-22
| 排名 | 模型 | 开发方 | 分数 |
|---|---|---|---|
| 1 | #1gemini-omni-1.1-flash | 1516 | |
| 2 | #2gemini-omni-flash | 1513 | |
| 3 | #3Bflux-3-video | Black Forest Labs | 1493 |
| 4 | #4xgrok-imagine-video-1.5-agent | xAI | 1492 |
| 5 | #5dreamina-seedance-2.0-720p | ByteDance | 1479 |
图像→视频 发布日期:2026-09-22
| 排名 | 模型 | 开发方 | 分数 |
|---|---|---|---|
| 1 | #1minimax-h3 | MiniMax | 1495 |
| 2 | #2gemini-omni-1.1-flash | 1488 | |
| 3 | #3wan3.0 | Alibaba | 1480 |
| 4 | #4dreamina-seedance-2.5-720p | ByteDance | 1477 |
| 5 | #5dreamina-seedance-2.0-720p | ByteDance | 1475 |
官方视频
亲自进行的测试
向 4 个图像模型输入相同提示词,测试它们能否准确生成韩文字符。结果图像、评分及消耗的积分均原样发布在实测记录中。视频和音频模型尚未实际测试,本页是基于官方资料的指南。
查看图像模型的韩文字符测试运营者可以运行的视频模型
| 模型 | 介绍(官方说明摘要) | 分辨率与声音 |
|---|---|---|
| Seedance 2.5 ByteDance | 文字→视频、多参考素材生成、视频编辑与延长 | 480p · 720p · 1080p / 声音生成 |
| Seedance 2.0 ByteDance | 通过图像、视频和语音参考素材保持人物一致,可同时生成声音 | 480p · 720p · 1080p · 4k / 声音生成 |
| Seedance 2.0 Mini ByteDance | Seedance 2.0 更快、更便宜的版本 | 480p · 720p / 声音生成 |
| Kling 3.0 Kling | 多场景编排、声音同步、动作迁移 | 声音生成 |
| Kling 3.0 Turbo Kling | 快速文字→视频,用一张起始图像生成动作 | 720p · 1080p |
| Veo 3.1 Google | 侧重逼真的电影感画质 | - |
| Veo 3.1 Lite Google | 适合快速、低成本地生成多个结果 | 声音生成 |
| Wan 3.0 Alibaba Wan | 文字→视频、指定首尾画面、同时生成声音 | 480p · 720p · 1080p / 声音生成 |
| Grok Video 1.5 xAI | 通过文字、起始图像和语音参考生成视频 | 480p · 720p · 1080p |
| Hailuo MiniMax | 自然的物理运动与表情 | - |
依据 Higgsfield 模型列表 · 查询日期:2026-10-04