跳到主要内容
AI 能力图谱

智谱清言(ChatGLM)

国产 Agent 与工具调用的先行者

智谱 AI通用对话中国大陆可直连数据更新于 2026 年 9 月 10 日依据覆盖 14/14

能力雷达图(14 维)

5 分 = 该领域当前第一梯队。分数来自官方文档与更新日志、公开的第三方基准,以及使用者反馈的综合判断,本站不做自建评测,也不是厂商宣传语。每个分数的依据见下方说明。

写作表达4/5

中文表达清楚、结构化好,风格偏正式,文采类写作一般

长文理解3/5

支持长文本,但超长文档的跨段落一致性需要自己核对

逻辑推理4/5

GLM 思考系列在国产开源模型推理基准上表现靠前

数理计算4/5

数学基准稳定,可输出步骤,工程化计算需人工校验

编程开发3/5

能读写常规代码,缺少工程级调试与测试闭环

联网研究3/5

支持联网搜索与引用,深度弱于专业检索工具

任务自动化5/5

AutoGLM 可在手机上完成多步操作,GLM 系列的工具调用在国内模型里最成熟

数据分析2/5

能生成 SQL 与分析建议,实际数据管道仍需自行搭建

办公产出2/5

产出以对话文本为主,办公文件交付能力有限

图像生成3/5

CogView 系列可生图且权重开放,效果与主流生图工具有差距

图像理解3/5

GLM 视觉系列可读图与文档,但官方资源更集中在代理方向

视频生成2/5

有视频相关能力,成熟度与可控性一般

语音音乐2/5

有语音交互入口,音色与合成能力不是重点

实时交互2/5

以文字交互为主,实时语音延迟与打断体验一般

展开全部维度分数与打分依据(文字版)
写作表达4/5

中文表达清楚、结构化好,风格偏正式,文采类写作一般

长文理解3/5

支持长文本,但超长文档的跨段落一致性需要自己核对

逻辑推理4/5

GLM 思考系列在国产开源模型推理基准上表现靠前

数理计算4/5

数学基准稳定,可输出步骤,工程化计算需人工校验

编程开发3/5

能读写常规代码,缺少工程级调试与测试闭环

联网研究3/5

支持联网搜索与引用,深度弱于专业检索工具

任务自动化5/5

AutoGLM 可在手机上完成多步操作,GLM 系列的工具调用在国内模型里最成熟

数据分析2/5

能生成 SQL 与分析建议,实际数据管道仍需自行搭建

办公产出2/5

产出以对话文本为主,办公文件交付能力有限

图像生成3/5

CogView 系列可生图且权重开放,效果与主流生图工具有差距

图像理解3/5

GLM 视觉系列可读图与文档,但官方资源更集中在代理方向

视频生成2/5

有视频相关能力,成熟度与可控性一般

语音音乐2/5

有语音交互入口,音色与合成能力不是重点

实时交互2/5

以文字交互为主,实时语音延迟与打断体验一般

它最强的地方

下面 4 个维度拿到 4 分以上,这是它真正值得优先考虑的依据。

  • 任务自动化5

    依据:AutoGLM 可在手机上完成多步操作,GLM 系列的工具调用在国内模型里最成熟

  • 写作表达4

    依据:中文表达清楚、结构化好,风格偏正式,文采类写作一般

  • 逻辑推理4

    依据:GLM 思考系列在国产开源模型推理基准上表现靠前

  • 数理计算4

    依据:数学基准稳定,可输出步骤,工程化计算需人工校验

最适合这些场景

  • 工具调用与流程自动化:跨系统取数、填单、多步操作
  • 需要私有化部署的 Agent 应用开发
  • 中文指令遵循要求严格的工程化任务

明确的短板与不适用场景

  • 数据分析 仅 2 分
  • 办公产出 仅 2 分
  • 视频生成 仅 2 分
  • 语音音乐 仅 2 分
  • 实时交互 仅 2 分

它最强的地方

  • 工具调用与多步代理是国产模型里最成熟的一套,能真的「去操作」而不只是给建议
  • AutoGLM 可在手机上跨应用完成任务,这类场景几乎找不到第二家
  • GLM 系列权重开源,可离线部署,代理流程可私有化
  • 中文指令遵循好,结构化输出稳定,适合做流程化任务

它的短板

  • 写作与创意类产出偏规整,缺风格,做内容创作不如专用写作模型
  • 主产品的界面与交互是技术导向,新手上手不如豆包直观
  • 不交付 Word / PPT 成品,办公链路要自己补
  • 生图、生视频能力存在但成熟度一般,别指望替代专用工具

别用它做

  • 内容创作与营销文案:风格化表达不是它的强项
  • 只想要轻松聊天和语音交互的用户:产品偏技术
  • 要求直接输出办公成品的场景

价格与额度

智谱清言 价格与额度信息
计费模式免费增值
免费额度官网提供免费对话额度
付费起步价约 ¥1/百万 token 起(按模型不同)
备注GLM 分多个档位与上下文规格,开源版本可自部署以免除 API 费用
是否有 API有
支持平台网页、iOS、Android、API、插件

价格随时可能调整,本页数据更新于 2026 年 9 月 10 日,请以官方页面为准。

上手三步

  1. 1注册与准备用 官网提供免费对话额度 就能开始,不需要先付费。注册时建议绑定手机号,登录更稳定。
  2. 2第一次别只发「你好」,直接给一个真实任务把下面的提示词模板复制过去,先跑一个你自己今天就要用的任务。第一次就用真实素材,比用「帮我写首诗」更能判断它合不合手。
  3. 3最可能踩的坑:写作与创意类产出偏规整,缺风格,做内容创作不如专用写作模型遇到不对的输出,先补背景和约束,而不是只说「不对,重写」。详见坏提示词对照表。

用它可以直接复制的提示词

模板来自站内教程与案例库,替换变量即可使用。

周报 / 工作汇报:从散乱记录到可直接提交

把一周的零散工作记录整理成结构化周报

打开工具
你是一位有十年经验的团队负责人,帮我把下面这份"一周流水账"整理成一份可以直接发给主管的周报。

要求:
1. 结构固定为四段:【本周完成】(按重要性排序,最多 5 条,每条一句话讲清"做了什么 + 带来什么结果")【进行中】(写明卡点和需要谁配合)【下周计划】(不超过 3 条)【风险提示】(没有就写"无")
2. 不要出现"积极推进""持续优化"这类空话,每条都要有具体动作或数字
3. 语气克制、不自我评价式夸张,不使用表情符号
4. 全文控制在 400 字以内
5. 如果原始记录里缺少某段需要的信息,用【待补充:xxx】标出来,不要替我编

我的岗位:{{role}}
本周原始记录:
{{raw_notes}}

写完之后,另外给我 3 条"主管可能会追问的问题",以及每个问题我应该提前准备的材料。

还有 2 个变量未填写,未填写的部分会原样保留 {{变量名}}

使用提示:国产模型(豆包、DeepSeek、Kimi)把原始记录贴全一些效果更好;海外模型对"待补充"这类约束执行得更严格,不会自行编数字。

长文档摘要:几百页 PDF 也能读出可用的结论

读一份很长的 PDF / 报告 / 合同,输出分层摘要与风险点

打开工具
请阅读我上传的文档,输出一份"可执行摘要",不要复述原文。

结构要求:
1. 【一句话结论】:这份文档到底在讲什么、要求我做什么
2. 【关键数据】:最多 8 条,每条必须带原文出处(写明在第几页 / 第几条)
3. 【对我有影响的部分】:只写会改变我决策或行动的段落,并说明为什么
4. 【风险与不确定性】:文档里没写清楚、有歧义或自相矛盾的地方,逐条列出
5. 【我看漏了什么】:站在第一次接触这个主题的人角度,指出还需要补充哪些信息

约束:
- 每一条结论都必须能在原文里找到依据,找不到就标注【原文未见依据】
- 不要用"本文主要介绍了"这类空话开头
- 如果文档太长无法一次读完,请分段处理并告诉我分段方式

文档标题:{{doc_title}}
我的关注点:{{focus}}
文档内容:{{doc_content}}

还有 3 个变量未填写,未填写的部分会原样保留 {{变量名}}

使用提示:Kimi 与 NotebookLM 对超长文档的切分处理更稳;Claude / Gemini 在"必须给出页码依据"上表现更好。上传文件优先于粘贴全文。

PPT 大纲:从一句话需求到可讲述的结构

把一个主题变成能讲 20 分钟的 PPT 大纲

打开工具
帮我把下面这个主题做成一份可以直接讲 {{duration}} 分钟的 PPT 大纲。

我的主题:{{topic}}
听众:{{audience}}
听完我希望他们做的决定 / 记住的结论:{{goal}}

输出要求:
1. 先给一份"一句话主线",说清楚这份 PPT 的论证链条是什么
2. 再给每一页的清单,格式为:【页码】标题 / 这一页要传达的唯一信息 / 建议用什么图表或版式 / 讲这一页要花多久
3. 页数控制在 {{page_count}} 页左右,其中"结论页"必须放在最后
4. 明确标出哪些页可以删(我时间不够时先砍哪几页)
5. 最后给"讲述时的三个转折点",即听众最容易走神的位置

不要输出具体文案,只要大纲和结构。

还有 5 个变量未填写,未填写的部分会原样保留 {{变量名}}

使用提示:Gamma / 讯飞智文这类工具能把大纲直接转成成品文件;纯对话模型只给大纲,需要你再喂给 Gamma 完成排版。

替代品对比入口

没有哪个工具全场景通吃。选型前建议至少对比 2-4 个。

一次对比全部替代品

评分怎么来的

依据覆盖 14/14

本站不做自建评测(无法在本地复现各家闭源模型),因此这些分数来自三部分交叉整理:官方公开资料(模型卡 / 产品文档 / 定价页 / 发布说明)、产品实际能力边界、以及社区公开反馈中反复出现的一致倾向。 智谱清言的分数以官方功能说明为主依据,中文长文与文档处理是其公开主打方向。免费额度策略变动频繁,价格类信息请直接看官方定价页,本页不提供数字。

展开 14 个维度的逐条依据
写作表达
4 / 5
中文表达清楚、结构化好,风格偏正式,文采类写作一般
长文理解
3 / 5
支持长文本,但超长文档的跨段落一致性需要自己核对
逻辑推理
4 / 5
GLM 思考系列在国产开源模型推理基准上表现靠前
数理计算
4 / 5
数学基准稳定,可输出步骤,工程化计算需人工校验
编程开发
3 / 5
能读写常规代码,缺少工程级调试与测试闭环
联网研究
3 / 5
支持联网搜索与引用,深度弱于专业检索工具
任务自动化
5 / 5
AutoGLM 可在手机上完成多步操作,GLM 系列的工具调用在国内模型里最成熟
数据分析
2 / 5
能生成 SQL 与分析建议,实际数据管道仍需自行搭建
办公产出
2 / 5
产出以对话文本为主,办公文件交付能力有限
图像生成
3 / 5
CogView 系列可生图且权重开放,效果与主流生图工具有差距
图像理解
3 / 5
GLM 视觉系列可读图与文档,但官方资源更集中在代理方向
视频生成
2 / 5
有视频相关能力,成熟度与可控性一般
语音音乐
2 / 5
有语音交互入口,音色与合成能力不是重点
实时交互
2 / 5
以文字交互为主,实时语音延迟与打断体验一般

本页数据复核于 2026 年 9 月 10 日。如果你认为某条依据不成立或有更新, 请在 勘误入口 提交勘误 —— 依据被推翻比分数算错更需要纠正。

数据来源与更新时间

本页数据更新于 2026 年 9 月 10 日。如果你发现某条信息已经过时,请在 /about#errata 提交勘误。

  • Agent 能力强
  • 工具调用
  • 开源模型
  • 可本地部署
  • 国内直连
  • 中文能力强

难度分级参考:入门 / 进阶 / 深入(本站教程体系用)。本页所有评分维度统一口径, 与 评分方法 一致。 相关概念可从 知识库 入手。