能力雷达图(14 维)
5 分 = 该领域当前第一梯队。分数来自官方文档与更新日志、公开的第三方基准,以及使用者反馈的综合判断,本站不做自建评测,也不是厂商宣传语。每个分数的依据见下方说明。
中文表达合格偏理性,逻辑清楚但创意与文采一般,长文略干
支持长上下文,但长文摘要与前文约束保持不如专用长文产品
R1 系列在公开数学与代码推理基准上接近闭源第一梯队,社区复现结论一致
官方数学基准领先,输出完整推导链,复杂符号题仍建议人工复核
能写可运行代码并解释思路,但缺少可交互的编辑环境与自动测试闭环
不做联网检索,回答可能停在训练数据,问「最近」类问题必错
有 API 与开源生态,但官方不提供成熟的代理式产品
能写 SQL 与分析代码,实际跑数与出图需要自己搭环境
只产出文本与代码,不生成 Word / PPT / Excel 成品
主模型不生成图片,需另用其他工具
主线对话模型不读图,视觉能力由另的变体系列提供
无视频生成能力
无语音合成与音乐生成能力
无实时语音交互产品形态,API 流式输出不等于实时通话
展开全部维度分数与打分依据(文字版)
中文表达合格偏理性,逻辑清楚但创意与文采一般,长文略干
支持长上下文,但长文摘要与前文约束保持不如专用长文产品
R1 系列在公开数学与代码推理基准上接近闭源第一梯队,社区复现结论一致
官方数学基准领先,输出完整推导链,复杂符号题仍建议人工复核
能写可运行代码并解释思路,但缺少可交互的编辑环境与自动测试闭环
不做联网检索,回答可能停在训练数据,问「最近」类问题必错
有 API 与开源生态,但官方不提供成熟的代理式产品
能写 SQL 与分析代码,实际跑数与出图需要自己搭环境
只产出文本与代码,不生成 Word / PPT / Excel 成品
主模型不生成图片,需另用其他工具
主线对话模型不读图,视觉能力由另的变体系列提供
无视频生成能力
无语音合成与音乐生成能力
无实时语音交互产品形态,API 流式输出不等于实时通话
它最强的地方
下面 3 个维度拿到 4 分以上,这是它真正值得优先考虑的依据。
- 逻辑推理5
依据:R1 系列在公开数学与代码推理基准上接近闭源第一梯队,社区复现结论一致
- 数理计算5
依据:官方数学基准领先,输出完整推导链,复杂符号题仍建议人工复核
- 编程开发4
依据:能写可运行代码并解释思路,但缺少可交互的编辑环境与自动测试闭环
最适合这些场景
- 复杂推理与数理题:解谜、推导、方案分析
- 低成本批量调用:日志分析、批处理、脚本化文本任务
- 数据不能外传:权重开源,可离线部署
明确的短板与不适用场景
- 视频生成 仅 0 分
- 语音音乐 仅 0 分
- 实时交互 仅 0 分
- 联网研究 仅 1 分
- 办公产出 仅 1 分
- 图像生成 仅 1 分
- 图像理解 仅 1 分
- 任务自动化 仅 2 分
- 数据分析 仅 2 分
它最强的地方
- 推理能力在同价位里最强:复杂逻辑、数学推导的答案质量接近头部闭源模型
- API 价格低到可以忽略,适合批量任务、脚本化调用和自建应用
- 权重开源,可完全离线自部署,敏感数据不出本机
- 国内直连稳定,无需网络工具手段
它的短板
- 不做联网检索:任何「最近」「今天」类问题都必须自己去查证
- 不生图、不做视频、不做语音,能力集中在纯文本推理
- 只出文本,不交付 Word / PPT / Excel 成品文件
- 不提供完整的代理产品与工作环境,批量任务要自己接 API 写脚本
- 高峰期 API 排队明显,输出速度波动大
别用它做
- 需要联网获取最新信息或要求逐条引用的调研工作
- 生图、生视频、语音、音乐等任何多媒体生产任务
- 想要开箱即用的办公文件交付:它只给文本
价格与额度
| 计费模式 | 免费增值 |
|---|---|
| 免费额度 | 官网对话免费,官方 API 有极低价的促销档 |
| 付费起步价 | 约 $0.3/百万 token 级(促销价) |
| 备注 | 定价常有大幅促销与缓存命中优惠,权重开源可完全免费自部署 |
| 是否有 API | 有 |
| 支持平台 | 网页、iOS、Android、Windows、macOS、API、命令行 |
价格随时可能调整,本页数据更新于 2026 年 9 月 26 日,请以官方页面为准。
上手三步
- 1注册与准备用 官网对话免费,官方 API 有极低价的促销档 就能开始,不需要先付费。注册时建议绑定手机号,登录更稳定。
- 2第一次别只发「你好」,直接给一个真实任务把下面的提示词模板复制过去,先跑一个你自己今天就要用的任务。第一次就用真实素材,比用「帮我写首诗」更能判断它合不合手。
- 3最可能踩的坑:不做联网检索:任何「最近」「今天」类问题都必须自己去查证遇到不对的输出,先补背景和约束,而不是只说「不对,重写」。详见坏提示词对照表。
用它可以直接复制的提示词
模板来自站内教程与案例库,替换变量即可使用。
周报 / 工作汇报:从散乱记录到可直接提交
把一周的零散工作记录整理成结构化周报
你是一位有十年经验的团队负责人,帮我把下面这份"一周流水账"整理成一份可以直接发给主管的周报。
要求:
1. 结构固定为四段:【本周完成】(按重要性排序,最多 5 条,每条一句话讲清"做了什么 + 带来什么结果")【进行中】(写明卡点和需要谁配合)【下周计划】(不超过 3 条)【风险提示】(没有就写"无")
2. 不要出现"积极推进""持续优化"这类空话,每条都要有具体动作或数字
3. 语气克制、不自我评价式夸张,不使用表情符号
4. 全文控制在 400 字以内
5. 如果原始记录里缺少某段需要的信息,用【待补充:xxx】标出来,不要替我编
我的岗位:{{role}}
本周原始记录:
{{raw_notes}}
写完之后,另外给我 3 条"主管可能会追问的问题",以及每个问题我应该提前准备的材料。还有 2 个变量未填写,未填写的部分会原样保留 {{变量名}}
使用提示:国产模型(豆包、DeepSeek、Kimi)把原始记录贴全一些效果更好;海外模型对"待补充"这类约束执行得更严格,不会自行编数字。
替代品对比入口
没有哪个工具全场景通吃。选型前建议至少对比 2-4 个。
一次对比全部替代品评分怎么来的
依据覆盖 14/14本站不做自建评测(无法在本地复现各家闭源模型),因此这些分数来自三部分交叉整理:官方公开资料(模型卡 / 产品文档 / 定价页 / 发布说明)、产品实际能力边界、以及社区公开反馈中反复出现的一致倾向。 DeepSeek 的推理与数学分数依据其官方公布的公开基准与社区复现结论,属于本站依据相对充分的一组。定价与可用性按公开信息整理;推理档位在高峰期可能限流,这点写在弱项里而不是分数里。
展开 14 个维度的逐条依据
- 写作表达
- 3 / 5
- 中文表达合格偏理性,逻辑清楚但创意与文采一般,长文略干
- 长文理解
- 3 / 5
- 支持长上下文,但长文摘要与前文约束保持不如专用长文产品
- 逻辑推理
- 5 / 5
- R1 系列在公开数学与代码推理基准上接近闭源第一梯队,社区复现结论一致
- 数理计算
- 5 / 5
- 官方数学基准领先,输出完整推导链,复杂符号题仍建议人工复核
- 编程开发
- 4 / 5
- 能写可运行代码并解释思路,但缺少可交互的编辑环境与自动测试闭环
- 联网研究
- 1 / 5
- 不做联网检索,回答可能停在训练数据,问「最近」类问题必错
- 任务自动化
- 2 / 5
- 有 API 与开源生态,但官方不提供成熟的代理式产品
- 数据分析
- 2 / 5
- 能写 SQL 与分析代码,实际跑数与出图需要自己搭环境
- 办公产出
- 1 / 5
- 只产出文本与代码,不生成 Word / PPT / Excel 成品
- 图像生成
- 1 / 5
- 主模型不生成图片,需另用其他工具
- 图像理解
- 1 / 5
- 主线对话模型不读图,视觉能力由另的变体系列提供
- 视频生成
- 0 / 5
- 无视频生成能力
- 语音音乐
- 0 / 5
- 无语音合成与音乐生成能力
- 实时交互
- 0 / 5
- 无实时语音交互产品形态,API 流式输出不等于实时通话
本页数据复核于 2026 年 9 月 26 日。如果你认为某条依据不成立或有更新, 请在 勘误入口 提交勘误 —— 依据被推翻比分数算错更需要纠正。
数据来源与更新时间
本页数据更新于 2026 年 9 月 26 日。如果你发现某条信息已经过时,请在 /about#errata 提交勘误。
- 开源模型
- 可本地部署
- 推理能力强
- API 便宜
- 免费额度高
- 国内直连
难度分级参考:入门 / 进阶 / 深入(本站教程体系用)。本页所有评分维度统一口径, 与 评分方法 一致。 相关概念可从 知识库 入手。