跳到主要内容
AI 能力图谱

即梦(Jimeng)

中文提示词好懂的生图与短视频工具

字节跳动图像生成视频生成中国大陆可直连数据更新于 2026 年 9 月 29 日依据覆盖 14/14

能力雷达图(14 维)

5 分 = 该领域当前第一梯队。分数来自官方文档与更新日志、公开的第三方基准,以及使用者反馈的综合判断,本站不做自建评测,也不是厂商宣传语。每个分数的依据见下方说明。

写作表达1/5

仅能生成图内文字与短提示词描述,文本写作不是它的能力

长文理解0/5

不处理长文档,也不做长文总结

逻辑推理0/5

不做逻辑推理,提示词理解靠生成模型而不是推理过程

数理计算0/5

不涉及数理计算

编程开发0/5

不写代码

联网研究0/5

不联网检索,没有来源标注的概念

任务自动化1/5

流程是「输入描述—出图—再改图」,跨工具的多步自动编排能力有限

数据分析0/5

不做数据处理与统计

办公产出1/5

只出图片文件,Word、PPT、Excel 等成品仍需另做

图像生成5/5

文生图与图生图是产品主形态,中文提示词理解好,风格与细节在国产生图工具里靠前

图像理解3/5

可用参考图与局部重绘来约束画面,图像理解属于生成的附带能力,不是独立识别工具

视频生成4/5

文生视频与图生视频在官方产品内可用,镜头与时长的可控性属中等水平

语音音乐1/5

不做配音与音乐生成,音轨需要外部工具处理

实时交互1/5

生成是异步排队任务,没有实时交互形态

展开全部维度分数与打分依据(文字版)
写作表达1/5

仅能生成图内文字与短提示词描述,文本写作不是它的能力

长文理解0/5

不处理长文档,也不做长文总结

逻辑推理0/5

不做逻辑推理,提示词理解靠生成模型而不是推理过程

数理计算0/5

不涉及数理计算

编程开发0/5

不写代码

联网研究0/5

不联网检索,没有来源标注的概念

任务自动化1/5

流程是「输入描述—出图—再改图」,跨工具的多步自动编排能力有限

数据分析0/5

不做数据处理与统计

办公产出1/5

只出图片文件,Word、PPT、Excel 等成品仍需另做

图像生成5/5

文生图与图生图是产品主形态,中文提示词理解好,风格与细节在国产生图工具里靠前

图像理解3/5

可用参考图与局部重绘来约束画面,图像理解属于生成的附带能力,不是独立识别工具

视频生成4/5

文生视频与图生视频在官方产品内可用,镜头与时长的可控性属中等水平

语音音乐1/5

不做配音与音乐生成,音轨需要外部工具处理

实时交互1/5

生成是异步排队任务,没有实时交互形态

它最强的地方

下面 2 个维度拿到 4 分以上,这是它真正值得优先考虑的依据。

  • 图像生成5

    依据:文生图与图生图是产品主形态,中文提示词理解好,风格与细节在国产生图工具里靠前

  • 视频生成4

    依据:文生视频与图生视频在官方产品内可用,镜头与时长的可控性属中等水平

最适合这些场景

  • 课件配图:为抽象概念找一张能一眼讲清楚的示意图
  • 课堂素材:故事插画、场景图、活动封面图
  • 短视频片段:把静态图变成几秒的动态画面,用在导入或回顾环节

明确的短板与不适用场景

  • 长文理解 仅 0 分
  • 逻辑推理 仅 0 分
  • 数理计算 仅 0 分
  • 编程开发 仅 0 分
  • 联网研究 仅 0 分
  • 数据分析 仅 0 分
  • 写作表达 仅 1 分
  • 任务自动化 仅 1 分
  • 办公产出 仅 1 分
  • 语音音乐 仅 1 分
  • 实时交互 仅 1 分

它最强的地方

  • 中文提示词理解好,「水墨风格的江南小镇黄昏」这类描述不用翻译就能出对方向的东西
  • 图生图与局部重绘实用:给已有课件插图换个背景、去掉多余元素,比重新生成稳定
  • 视频生成能接在图片后面做,同一套素材里静态图与短片能保持相近风格
  • 国内直连且有移动端 App,手机上临时改一张图不用回到电脑
  • 免费额度对做课堂配图基本够用,个人教师不必为几张插图单独付费

它的短板

  • 不写文本也不做推理:任何需要先想清楚再落笔的活它都帮不上
  • 生成结果随机性大,同一提示词重抽几次差异明显,不适合要求精确一致的场合
  • 图内文字与手部结构仍会出错,做带字的信息图必须后期修
  • 精细构图难控制:指定人物位置、数量或精确比例时经常跑偏
  • 只产出图片与短视频片段,既不能交付文档,也不能替代剪辑软件完成成片

别用它做

  • 任何需要写作、推理或给出结论的工作:它只生成图像
  • 要求构图精确、前后一致的教材插图:随机性会直接破坏教学表达
  • 需要交付文档或完整视频成片的场景:它给素材,不给成品

价格与额度

即梦 价格与额度信息
计费模式免费增值
免费额度每日有免费生成额度,出图质量受分辨率与次数限制
付费起步价以官方定价页为准
备注按积分与会员档位计费,不同分辨率与视频时长的消耗差别很大,重抽次数要算进用量
是否有 API没有(只能用网页/App)
支持平台网页、iOS、Android

价格随时可能调整,本页数据更新于 2026 年 9 月 29 日,请以官方页面为准。

上手三步

  1. 1注册与准备用 每日有免费生成额度,出图质量受分辨率与次数限制 就能开始,不需要先付费。注册时建议绑定手机号,登录更稳定。
  2. 2第一次别只发「你好」,直接给一个真实任务把下面的提示词模板复制过去,先跑一个你自己今天就要用的任务。第一次就用真实素材,比用「帮我写首诗」更能判断它合不合手。
  3. 3最可能踩的坑:不写文本也不做推理:任何需要先想清楚再落笔的活它都帮不上遇到不对的输出,先补背景和约束,而不是只说「不对,重写」。详见坏提示词对照表。

用它可以直接复制的提示词

模板来自站内教程与案例库,替换变量即可使用。

文生图提示词:把画面描述成模型能执行的指令

给 Midjourney / 豆包 / 即梦等写生图提示词

打开工具
我想生成这样一张图:{{idea}}

请把它改写成 3 段式生图提示词(中文段 + 英文段各一份):

1. 【主体】:画面里有什么、动作与表情、几个人
2. 【风格与光线】:写实摄影/插画/3D/水彩,画质镜头(如 85mm、浅景深),光线方向与色温
3. 【构图与氛围】:景别(特写/中景/俯视)、色调、情绪、留白位置

然后补上:
- 【负面提示词】:会导致画面崩坏的元素
- 【参数建议】:比例、风格化强度、生成张数,以及"先出 4 张草图选一张再放大"的建议
- 【同一画面的 2 个变体方向】:只改其中一个变量,方便横向对比

英文版请使用摄影/设计领域常见术语,不要直译中文。

还有 1 个变量未填写,未填写的部分会原样保留 {{变量名}}

使用提示:Midjourney 更吃英文术语和参数(--ar --niji 等);国产生图模型(豆包、即梦、通义万相)对中文描述和中文提示词格式更友好。

短视频分镜脚本:从主题到可剪辑的镜头表

写短视频脚本、分镜表、口播稿

打开工具
帮我做一个短视频脚本,主题:{{topic}}
平台与时长:{{platform}},总时长 {{duration}} 秒
目标:看完后希望观众 {{goal}}

请输出:
1. 【一句话钩子】:前 3 秒说什么/做什么,必须具体,不能是"今天给大家分享"
2. 【分镜表】:每一行一个镜头,包含 —— 时间区间 / 画面内容(拍什么、主体在画面哪个位置)/ 字幕文案(不超过 12 字)/ 配音或口播原文 / 素材来源建议(实拍、录屏、生成)
3. 【节奏标注】:哪几个镜头是信息密度高点,需要用转场或音效强调
4. 【素材清单】:需要提前准备的东西,逐条列,标出哪些必须实拍、哪些可以用 AI 生成
5. 【封面与标题】:给 3 个封面文案 + 3 个标题(含一个带数字或反常识的)

约束:分镜总时长必须等于 {{duration}} 秒,口播原文念出来要能在对应时长内说完(按每秒 4-5 个字估算)。

还有 4 个变量未填写,未填写的部分会原样保留 {{变量名}}

使用提示:Runway / Suno / 即梦负责生成画面与配音,脚本仍建议先用对话模型写好:AI 最容易出问题的就是"时间对不上",务必自己按字数复核一遍。

替代品对比入口

没有哪个工具全场景通吃。选型前建议至少对比 2-4 个。

一次对比全部替代品

评分怎么来的

依据覆盖 14/14

本站不做自建评测(生图效果主观性强,同一提示词的结果本身就有波动,无法用统一标准给出判断),因此这些分数来自三部分交叉整理:官方公开资料(即梦产品页与使用说明)、产品实际能力边界、以及公开反馈中反复出现的一致倾向。图像生成与视频维度的高分依据是功能对应关系:文生图、图生图与图生视频是产品主形态,这一点官方可直接核对,属于「具备该能力」的判断,不是画质排名。写作、长文、推理、数理、编程、研究、数据七个维度按「不具备」给 0-1 分,不做模糊处理。需要提醒的是:审美偏好差异很大,同一段提示词在不同人手里结果不同,落地前请用自己的教学场景试一批,再决定哪些图能进课堂、哪些只能自己看。

展开 14 个维度的逐条依据
写作表达
1 / 5
仅能生成图内文字与短提示词描述,文本写作不是它的能力
长文理解
0 / 5
不处理长文档,也不做长文总结
逻辑推理
0 / 5
不做逻辑推理,提示词理解靠生成模型而不是推理过程
数理计算
0 / 5
不涉及数理计算
编程开发
0 / 5
不写代码
联网研究
0 / 5
不联网检索,没有来源标注的概念
任务自动化
1 / 5
流程是「输入描述—出图—再改图」,跨工具的多步自动编排能力有限
数据分析
0 / 5
不做数据处理与统计
办公产出
1 / 5
只出图片文件,Word、PPT、Excel 等成品仍需另做
图像生成
5 / 5
文生图与图生图是产品主形态,中文提示词理解好,风格与细节在国产生图工具里靠前
图像理解
3 / 5
可用参考图与局部重绘来约束画面,图像理解属于生成的附带能力,不是独立识别工具
视频生成
4 / 5
文生视频与图生视频在官方产品内可用,镜头与时长的可控性属中等水平
语音音乐
1 / 5
不做配音与音乐生成,音轨需要外部工具处理
实时交互
1 / 5
生成是异步排队任务,没有实时交互形态

本页数据复核于 2026 年 9 月 29 日。如果你认为某条依据不成立或有更新, 请在 勘误入口 提交勘误 —— 依据被推翻比分数算错更需要纠正。

数据来源与更新时间

本页数据更新于 2026 年 9 月 29 日。如果你发现某条信息已经过时,请在 /about#errata 提交勘误。

  • 生图
  • 中文提示词
  • 图生视频
  • 局部重绘
  • 国内直连
  • 需后期修字

难度分级参考:入门 / 进阶 / 深入(本站教程体系用)。本页所有评分维度统一口径, 与 评分方法 一致。 相关概念可从 知识库 入手。