跳到主要内容
AI 能力图谱

Gemini(Gemini)

超长上下文,Google 生态打通

Google通用对话中国大陆通常需借助网络工具访问数据更新于 2026 年 9 月 18 日依据覆盖 14/14

能力雷达图(14 维)

5 分 = 该领域当前第一梯队。分数来自官方文档与更新日志、公开的第三方基准,以及使用者反馈的综合判断,本站不做自建评测,也不是厂商宣传语。每个分数的依据见下方说明。

写作表达4/5

公开反馈普遍认为文本流畅、结构清晰;中文长文偶有英文式表达痕迹

长文理解5/5

官方 1M token 上下文,长文档、长视频可一次性读完并交叉提问

逻辑推理4/5

思考模式下复杂推理表现好,深度思考有次数与时长限制

数理计算4/5

官方数学基准稳定,图表与公式类题目识别准确

编程开发3/5

可写可读代码并跑 Google Colab,同等条件下弱于专用编程代理

联网研究3/5

可调 Google 搜索并给链接,Deep Research 模式更完整但国内不可用

任务自动化3/5

有代理与 Google 服务联动能力,可用性高度依赖账号所在的 Google 生态

数据分析3/5

与 Sheets 双向打通,复杂统计需借助代码执行环境

办公产出4/5

与 Docs / Slides / Sheets 双向读写,是少数能直接改办公文件的助手

图像生成4/5

原生集成图像生成与局部编辑,可与对话上下文联动改图

图像理解5/5

视频、长文档、图表理解均为官方主打能力,公开反馈细节捕捉强

视频生成2/5

不生成视频,但能理解视频内容并跨时间轴提问

语音音乐3/5

有语音对话与 Live 模式,音色自然度尚可但不如专用语音产品

实时交互3/5

Live 语音对话延迟尚可,中文实时识别偶有断句错误

展开全部维度分数与打分依据(文字版)
写作表达4/5

公开反馈普遍认为文本流畅、结构清晰;中文长文偶有英文式表达痕迹

长文理解5/5

官方 1M token 上下文,长文档、长视频可一次性读完并交叉提问

逻辑推理4/5

思考模式下复杂推理表现好,深度思考有次数与时长限制

数理计算4/5

官方数学基准稳定,图表与公式类题目识别准确

编程开发3/5

可写可读代码并跑 Google Colab,同等条件下弱于专用编程代理

联网研究3/5

可调 Google 搜索并给链接,Deep Research 模式更完整但国内不可用

任务自动化3/5

有代理与 Google 服务联动能力,可用性高度依赖账号所在的 Google 生态

数据分析3/5

与 Sheets 双向打通,复杂统计需借助代码执行环境

办公产出4/5

与 Docs / Slides / Sheets 双向读写,是少数能直接改办公文件的助手

图像生成4/5

原生集成图像生成与局部编辑,可与对话上下文联动改图

图像理解5/5

视频、长文档、图表理解均为官方主打能力,公开反馈细节捕捉强

视频生成2/5

不生成视频,但能理解视频内容并跨时间轴提问

语音音乐3/5

有语音对话与 Live 模式,音色自然度尚可但不如专用语音产品

实时交互3/5

Live 语音对话延迟尚可,中文实时识别偶有断句错误

它最强的地方

下面 7 个维度拿到 4 分以上,这是它真正值得优先考虑的依据。

  • 长文理解5

    依据:官方 1M token 上下文,长文档、长视频可一次性读完并交叉提问

  • 图像理解5

    依据:视频、长文档、图表理解均为官方主打能力,公开反馈细节捕捉强

  • 写作表达4

    依据:公开反馈普遍认为文本流畅、结构清晰;中文长文偶有英文式表达痕迹

  • 逻辑推理4

    依据:思考模式下复杂推理表现好,深度思考有次数与时长限制

  • 数理计算4

    依据:官方数学基准稳定,图表与公式类题目识别准确

  • 办公产出4

    依据:与 Docs / Slides / Sheets 双向读写,是少数能直接改办公文件的助手

  • 图像生成4

    依据:原生集成图像生成与局部编辑,可与对话上下文联动改图

最适合这些场景

  • 超长资料消化:整本书、整份年报、几百页文档一次性读完
  • 长视频理解:看课程、看会议录像并跨片段提问
  • 已经在用 Google Workspace 的团队,直接改文档和表格

明确的短板与不适用场景

  • 视频生成 仅 2 分

它最强的地方

  • 1M token 上下文是硬指标:一次性读完整本书或整段长视频,不用切片拼凑
  • 视频理解能力突出,能对长视频做时间轴级别的提问
  • 与 Google 文档、表格、邮件双向打通,能直接改文件而不是只给文本
  • 免费额度相对宽松,多模态输入几乎不额外计费

它的短板

  • 中文写作不如国内模型自然,长文里偶有直译腔和逻辑跳跃
  • 国内无法直连,Google 生态联动(邮箱、文档)在本地基本用不上
  • 代码能力不是它的主攻方向,复杂工程需要自己配环境
  • 深度思考次数有限,密集跑复杂推理会很快触顶

别用它做

  • 需要大量生成或精细编辑图像的创意项目:生图风格控制不如专业工具
  • 中国大陆团队在无外部网络条件下协作:产品与依赖服务均不可直连
  • 写中文营销稿、公文等对语感要求极高的内容

价格与额度

Gemini 价格与额度信息
计费模式免费增值
免费额度免费版每天有限额度,多模态输入不额外计费
付费起步价约 $19.99/月起(AI Pro)
备注与 Google One 订阅打包,套餐内其他权益变化会影响实际性价比
是否有 API有
支持平台网页、iOS、Android、Windows、macOS、API、插件、命令行

价格随时可能调整,本页数据更新于 2026 年 9 月 18 日,请以官方页面为准。

上手三步

  1. 1注册与准备用 免费版每天有限额度,多模态输入不额外计费 就能开始,不需要先付费。注意:在中国大陆通常需要可用的网络环境才能访问,注册前先确认这一点。
  2. 2第一次别只发「你好」,直接给一个真实任务把下面的提示词模板复制过去,先跑一个你自己今天就要用的任务。第一次就用真实素材,比用「帮我写首诗」更能判断它合不合手。
  3. 3最可能踩的坑:中文写作不如国内模型自然,长文里偶有直译腔和逻辑跳跃遇到不对的输出,先补背景和约束,而不是只说「不对,重写」。详见坏提示词对照表。

用它可以直接复制的提示词

模板来自站内教程与案例库,替换变量即可使用。

长文档摘要:几百页 PDF 也能读出可用的结论

读一份很长的 PDF / 报告 / 合同,输出分层摘要与风险点

打开工具
请阅读我上传的文档,输出一份"可执行摘要",不要复述原文。

结构要求:
1. 【一句话结论】:这份文档到底在讲什么、要求我做什么
2. 【关键数据】:最多 8 条,每条必须带原文出处(写明在第几页 / 第几条)
3. 【对我有影响的部分】:只写会改变我决策或行动的段落,并说明为什么
4. 【风险与不确定性】:文档里没写清楚、有歧义或自相矛盾的地方,逐条列出
5. 【我看漏了什么】:站在第一次接触这个主题的人角度,指出还需要补充哪些信息

约束:
- 每一条结论都必须能在原文里找到依据,找不到就标注【原文未见依据】
- 不要用"本文主要介绍了"这类空话开头
- 如果文档太长无法一次读完,请分段处理并告诉我分段方式

文档标题:{{doc_title}}
我的关注点:{{focus}}
文档内容:{{doc_content}}

还有 3 个变量未填写,未填写的部分会原样保留 {{变量名}}

使用提示:Kimi 与 NotebookLM 对超长文档的切分处理更稳;Claude / Gemini 在"必须给出页码依据"上表现更好。上传文件优先于粘贴全文。

替代品对比入口

没有哪个工具全场景通吃。选型前建议至少对比 2-4 个。

一次对比全部替代品

评分怎么来的

依据覆盖 14/14

本站不做自建评测(无法在本地复现各家闭源模型),因此这些分数来自三部分交叉整理:官方公开资料(模型卡 / 产品文档 / 定价页 / 发布说明)、产品实际能力边界、以及社区公开反馈中反复出现的一致倾向。 Gemini 的多模态项依据官方对长视频/长文档理解的说明与上下文窗口规格,这类能力有明确的官方输入上限可核对。分数在「是否有联网与代码执行」上取决于接入形态(网页端 vs API),同一模型不同入口的表现可能不同。

展开 14 个维度的逐条依据
写作表达
4 / 5
公开反馈普遍认为文本流畅、结构清晰;中文长文偶有英文式表达痕迹
长文理解
5 / 5
官方 1M token 上下文,长文档、长视频可一次性读完并交叉提问
逻辑推理
4 / 5
思考模式下复杂推理表现好,深度思考有次数与时长限制
数理计算
4 / 5
官方数学基准稳定,图表与公式类题目识别准确
编程开发
3 / 5
可写可读代码并跑 Google Colab,同等条件下弱于专用编程代理
联网研究
3 / 5
可调 Google 搜索并给链接,Deep Research 模式更完整但国内不可用
任务自动化
3 / 5
有代理与 Google 服务联动能力,可用性高度依赖账号所在的 Google 生态
数据分析
3 / 5
与 Sheets 双向打通,复杂统计需借助代码执行环境
办公产出
4 / 5
与 Docs / Slides / Sheets 双向读写,是少数能直接改办公文件的助手
图像生成
4 / 5
原生集成图像生成与局部编辑,可与对话上下文联动改图
图像理解
5 / 5
视频、长文档、图表理解均为官方主打能力,公开反馈细节捕捉强
视频生成
2 / 5
不生成视频,但能理解视频内容并跨时间轴提问
语音音乐
3 / 5
有语音对话与 Live 模式,音色自然度尚可但不如专用语音产品
实时交互
3 / 5
Live 语音对话延迟尚可,中文实时识别偶有断句错误

本页数据复核于 2026 年 9 月 18 日。如果你认为某条依据不成立或有更新, 请在 勘误入口 提交勘误 —— 依据被推翻比分数算错更需要纠正。

数据来源与更新时间

本页数据更新于 2026 年 9 月 18 日。如果你发现某条信息已经过时,请在 /about#errata 提交勘误。

  • 超长上下文
  • 多模态
  • 免费额度高
  • Google 生态
  • 识图能力强

难度分级参考:入门 / 进阶 / 深入(本站教程体系用)。本页所有评分维度统一口径, 与 评分方法 一致。 相关概念可从 知识库 入手。