能力雷达图(14 维)
5 分 = 该领域当前第一梯队。分数来自官方文档与更新日志、公开的第三方基准,以及使用者反馈的综合判断,本站不做自建评测,也不是厂商宣传语。每个分数的依据见下方说明。
能按歌词生成,但歌词创作与文本润色能力很弱,歌词基本要自己写
不处理长文档,歌词有长度上限
不做复杂推理,靠风格标签与描述匹配
不涉及数理计算,编曲不按乐理推导
不写代码
不联网检索,没有参考来源机制
有扩展与自定义功能,但多步自动编排能力有限
不做数据处理
不出办公成品文件
仅有视频画面框架,图像不是它的能力
不提供图像理解能力
可生成带画面的音乐视频,但镜头与画面质量弱于专业视频工具
人声自然度与情绪表达在同类中靠前,中英文都能用,风格标签覆盖主流曲风
生成是异步任务,无实时交互形态
展开全部维度分数与打分依据(文字版)
能按歌词生成,但歌词创作与文本润色能力很弱,歌词基本要自己写
不处理长文档,歌词有长度上限
不做复杂推理,靠风格标签与描述匹配
不涉及数理计算,编曲不按乐理推导
不写代码
不联网检索,没有参考来源机制
有扩展与自定义功能,但多步自动编排能力有限
不做数据处理
不出办公成品文件
仅有视频画面框架,图像不是它的能力
不提供图像理解能力
可生成带画面的音乐视频,但镜头与画面质量弱于专业视频工具
人声自然度与情绪表达在同类中靠前,中英文都能用,风格标签覆盖主流曲风
生成是异步任务,无实时交互形态
它最强的地方
下面 1 个维度拿到 4 分以上,这是它真正值得优先考虑的依据。
- 语音音乐4
依据:人声自然度与情绪表达在同类中靠前,中英文都能用,风格标签覆盖主流曲风
最适合这些场景
- 短视频与 demo 配乐:先快速试出合适的氛围
- 游戏与独立作品的原型音乐
- 中文歌曲创意验证,验证通过再考虑专业制作
明确的短板与不适用场景
- 数理计算 仅 0 分
- 编程开发 仅 0 分
- 联网研究 仅 0 分
- 数据分析 仅 0 分
- 办公产出 仅 0 分
- 写作表达 仅 1 分
- 长文理解 仅 1 分
- 逻辑推理 仅 1 分
- 任务自动化 仅 1 分
- 图像生成 仅 1 分
- 图像理解 仅 1 分
- 实时交互 仅 1 分
它最强的地方
- 人声与编曲一次成型:主唱、和声、乐器结构都给了,不用自己混
- 风格标签覆盖面广,从民谣到电子到国风都能试
- 中文可用,中文歌词的表现明显好于多数同类
- 能顺带生成画面,做短视频配乐一条龙,交付效率高
它的短板
- 歌词创作能力弱:文字部分基本要自己写,它只负责唱
- 风格模仿存在授权风险:刻意贴近在世歌手的授权条款要逐字读
- 积分制收费,长曲与多次重试消耗快,商用还要单独买授权
- 国内不可直连,生成结果不可精确控制,废片率不低
别用它做
- 需要精确控制旋律、歌词与结构的商用配乐:随机性太高,不可控
- 要求歌词创作或文案写作的工作:它不写词
- 预算固定且不能失败的商业项目:积分消耗与重试成本不可预测
价格与额度
| 计费模式 | 免费增值 |
|---|---|
| 免费额度 | 免费版有每日积分,生成歌曲数有限 |
| 付费起步价 | 约 $10/月起 |
| 备注 | 积分制且商用需额外授权,条款变动频繁,商业使用前务必核对 |
| 是否有 API | 有 |
| 支持平台 | 网页、iOS、Android、API |
价格随时可能调整,本页数据更新于 2026 年 9 月 11 日,请以官方页面为准。
上手三步
- 1注册与准备用 免费版有每日积分,生成歌曲数有限 就能开始,不需要先付费。注意:在中国大陆通常需要可用的网络环境才能访问,注册前先确认这一点。
- 2第一次别只发「你好」,直接给一个真实任务把下面的提示词模板复制过去,先跑一个你自己今天就要用的任务。第一次就用真实素材,比用「帮我写首诗」更能判断它合不合手。
- 3最可能踩的坑:歌词创作能力弱:文字部分基本要自己写,它只负责唱遇到不对的输出,先补背景和约束,而不是只说「不对,重写」。详见坏提示词对照表。
用它可以直接复制的提示词
模板来自站内教程与案例库,替换变量即可使用。
短视频分镜脚本:从主题到可剪辑的镜头表
写短视频脚本、分镜表、口播稿
帮我做一个短视频脚本,主题:{{topic}}
平台与时长:{{platform}},总时长 {{duration}} 秒
目标:看完后希望观众 {{goal}}
请输出:
1. 【一句话钩子】:前 3 秒说什么/做什么,必须具体,不能是"今天给大家分享"
2. 【分镜表】:每一行一个镜头,包含 —— 时间区间 / 画面内容(拍什么、主体在画面哪个位置)/ 字幕文案(不超过 12 字)/ 配音或口播原文 / 素材来源建议(实拍、录屏、生成)
3. 【节奏标注】:哪几个镜头是信息密度高点,需要用转场或音效强调
4. 【素材清单】:需要提前准备的东西,逐条列,标出哪些必须实拍、哪些可以用 AI 生成
5. 【封面与标题】:给 3 个封面文案 + 3 个标题(含一个带数字或反常识的)
约束:分镜总时长必须等于 {{duration}} 秒,口播原文念出来要能在对应时长内说完(按每秒 4-5 个字估算)。还有 4 个变量未填写,未填写的部分会原样保留 {{变量名}}
使用提示:Runway / Suno / 即梦负责生成画面与配音,脚本仍建议先用对话模型写好:AI 最容易出问题的就是"时间对不上",务必自己按字数复核一遍。
替代品对比入口
没有哪个工具全场景通吃。选型前建议至少对比 2-4 个。
一次对比全部替代品评分怎么来的
依据覆盖 14/14本站不做自建评测(无法在本地复现各家闭源模型),因此这些分数来自三部分交叉整理:官方公开资料(模型卡 / 产品文档 / 定价页 / 发布说明)、产品实际能力边界、以及社区公开反馈中反复出现的一致倾向。 Suno 的语音音乐维度依据官方对生成模型能力的说明与社区作品生态;其余维度按「不具备」给 0-1 分。生成时长与曲风控制的可控性是它的主要短板,已写进弱项。
展开 14 个维度的逐条依据
- 写作表达
- 1 / 5
- 能按歌词生成,但歌词创作与文本润色能力很弱,歌词基本要自己写
- 长文理解
- 1 / 5
- 不处理长文档,歌词有长度上限
- 逻辑推理
- 1 / 5
- 不做复杂推理,靠风格标签与描述匹配
- 数理计算
- 0 / 5
- 不涉及数理计算,编曲不按乐理推导
- 编程开发
- 0 / 5
- 不写代码
- 联网研究
- 0 / 5
- 不联网检索,没有参考来源机制
- 任务自动化
- 1 / 5
- 有扩展与自定义功能,但多步自动编排能力有限
- 数据分析
- 0 / 5
- 不做数据处理
- 办公产出
- 0 / 5
- 不出办公成品文件
- 图像生成
- 1 / 5
- 仅有视频画面框架,图像不是它的能力
- 图像理解
- 1 / 5
- 不提供图像理解能力
- 视频生成
- 3 / 5
- 可生成带画面的音乐视频,但镜头与画面质量弱于专业视频工具
- 语音音乐
- 4 / 5
- 人声自然度与情绪表达在同类中靠前,中英文都能用,风格标签覆盖主流曲风
- 实时交互
- 1 / 5
- 生成是异步任务,无实时交互形态
本页数据复核于 2026 年 9 月 11 日。如果你认为某条依据不成立或有更新, 请在 勘误入口 提交勘误 —— 依据被推翻比分数算错更需要纠正。
数据来源与更新时间
本页数据更新于 2026 年 9 月 11 日。如果你发现某条信息已经过时,请在 /about#errata 提交勘误。
- 音乐生成
- 人声自然
- 适合配乐
- 中文可用
- 积分制
- 授权需细读
难度分级参考:入门 / 进阶 / 深入(本站教程体系用)。本页所有评分维度统一口径, 与 评分方法 一致。 相关概念可从 知识库 入手。