Skip to content

Gemini 是 Google 的 AI 助手,用 Google 账号登录,官方入口是网页版 gemini.google.com、Android / iOS 应用和 gemini.google/desktop 上的桌面应用;开发者使用 Gemini CLI、Google AI Studio 和 Gemini API。它的特点是多模态输入和与 Gmail、云端硬盘等 Google 服务配合,用好的关键是:先把图片、文件、音视频准备好,再讲清目标和输出格式;Deep Research 先改研究计划再执行;识别出的文字、数字和时间点回到原始素材核对。

本页适合想把 Gemini 用在文件、图片、音视频和调研任务上的读者。下面先给一张速查表,再讲输入准备、提示词模板、Gems 与 skills、Deep Research、活动记录设置和报错排查;页面末尾的「官方资格入口」列出 Gemini 应用与 Gemini API 的可用地区页面。功能说明按 2026-10-07 的 Gemini 帮助中心与官方页面核对,后续变化以官方页面为准。

核心结论 ​

核心结论

  • 官方入口:网页 gemini.google.com;移动端 Android / iOS;桌面端 macOS 与 Windows(gemini.google/desktop);开发者使用 Google AI Studio 与 Gemini API。
  • 多模态先准备输入:图片清晰、文件结构规整、音视频说明关注片段,比提示词技巧更影响结果。
  • 提示词讲清目标与格式:说明任务、素材、约束和输出形式,信息不足时让它先提问。
  • 可复用指令用 Gems / skills:固定流程写成可复用指令,Gems 正在过渡为 skills,写法原则不变。
  • 长任务先审计划再执行:Deep Research 先改研究计划,长文先定大纲,分块执行、逐块核对。
  • 结果必须核对:识别出的文字、数字、时间点和引用都要回到原始素材确认。
  • 应用与 API 分开计费:Gemini 应用订阅与 Gemini API 价格以各自官方页面为准。

Gemini 速查表 ​

你要做的事用哪个入口或功能本页章节
上传多个文件、长对话、深度研究网页版 gemini.google.com「官方入口与使用入门」
拍照提问、语音口述官方 Android / iOS 应用(开发者为 Google)「官方入口与使用入门」
工作中快速唤起、共享屏幕内容桌面应用(gemini.google/desktop)「官方入口与使用入门」
图片、文档、音视频分析先按类型准备输入「不同任务的输入准备方法」
固定流程反复使用Gems / skills「Gems 与 skills:可复用的指令」
做一份带来源的调研Deep Research(先审研究计划)「Deep Research 与长任务拆分」
在程序里调用模型Google AI Studio、Gemini API(与应用订阅分开计费)AI API 入门
不想保存对话记录活动记录设置「活动记录、隐私与数据设置」
确认所在地区能否使用Gemini 官方可用地区页面「官方资格入口」

Gemini 适合做什么 ​

Gemini 的长处是多模态和与 Google 服务的配合:能同时理解文字、图片、文档、表格,在支持的场景中处理音频和视频,并能在你授权后引用 Gmail、云端硬盘中的内容。

多模态(multimodal)是指模型能处理文字以外的多种输入形式,如图片、音频和视频。多模态带来便利,也带来新的出错点:图片里的字可能识别错、视频的时间点可能定位不准、表格的口径可能理解偏差。和所有大语言模型一样,Gemini 也可能出现幻觉,即生成看似合理但不符合事实的内容。

任务类型适合程度用法建议
写作、改写、翻译很适合给读者、目的和范文
截图、照片中的文字识别与解释很适合图片清晰,识别结果逐项比对
文档总结与问答很适合要求注明出处段落
表格解读适合说明列含义,统计结果复算
音视频要点提炼适合(以功能可用性为准)指定时间范围,回放核对时间点
围绕主题检索并成文适合使用 Deep Research,审阅计划并抽查来源
代码仓库开发换工具使用 Gemini CLI 或其他编程代理
法律、医疗、财务决策仅作参考不能替代专业意见

官方入口与使用入门 ​

Gemini 的官方入口包括网页版、移动应用、桌面应用,以及面向开发者的 Gemini CLI、Google AI Studio 和 Gemini API。

形态官方入口说明
网页版gemini.google.com功能最全,适合文件上传、深度研究、长对话
移动应用Google Play(Android)、App Store(iOS)拍照提问、语音对话
桌面应用gemini.google/desktop(macOS 需 Apple 芯片与 macOS 15 或更高;Windows 10 或更高,支持 x64 与 ARM64)快捷键唤起(Mac 为 Option + Space,Windows 为 Alt + Space),可共享屏幕内容作为上下文
命令行Gemini CLI(开源,github.com/google-gemini/gemini-cli)面向开发者的终端代理
开发者Google AI Studio、Gemini API在程序中调用,见 AI API 入门

按官方桌面应用页面说明,桌面应用可在 Gemini 已支持的所有国家和语言中使用,但具体功能的可用性因地区而异;桌面端还可以连接 Gmail、云端硬盘、文档和日历中的信息,以及授权的本地文件夹。

如何确认是官方渠道 ​

  1. 网页只认 gemini.google.com 与 gemini.google;帮助中心为 support.google.com/gemini。
  2. 应用商店中的开发者应为 Google。
  3. 不在第三方页面输入 Google 账号密码,不使用来源不明的「Gemini 客户端」。Google 账号关联邮箱、云端硬盘和支付信息,一旦泄露影响面很大。

开始使用 ​

  1. 用个人 Google 账号登录 gemini.google.com;工作或学校账号是否可用,取决于所在组织管理员的设置。
  2. 在「设置与帮助」中查看活动记录(Activity)与个性化相关选项,按需调整。
  3. 先用一个小任务熟悉,例如上传一页文档让它总结,对照原文检查准确度。
  4. 需要引用 Gmail、云端硬盘等内容时,再按提示连接相应的 Google 服务。
  5. 有固定用途时,再创建可复用的自定义指令(Gems / skills,见下文)。

各入口的分工建议 ​

网页版适合需要上传多个文件、做 Deep Research、在 Canvas 中反复修改的「坐下来做」的任务;移动应用适合拍照提问、语音口述想法、外出时查看已有对话;桌面应用适合在处理其他工作时快速唤起,并把当前屏幕内容作为上下文提问,例如对着一份正在阅读的报表询问某个指标的含义。共享屏幕内容前,先确认画面中没有不该被读取的私人信息或公司机密,必要时先关闭无关窗口。三端使用同一个 Google 账号,对话记录随活动记录设置保存。

地区与语言限制

Gemini 网页版、移动应用和各项功能的可用地区与语言并不完全相同,部分地区仅对特定账号类型开放;以 Gemini 帮助中心「Where you can use the Gemini web app」等页面为准。网络相关问题可参考 常见问题 与 AI 机场推荐,并请遵守所在地法律法规。

开发者可选:Gemini CLI ​

如果你需要在终端中让 Gemini 处理代码仓库,可以安装官方开源(Apache-2.0 许可)的 Gemini CLI:

bash
# 不安装、直接运行
npx @google/gemini-cli

# 使用 npm 全局安装
npm install -g @google/gemini-cli

# 或使用 Homebrew
brew install gemini-cli

# 安装后在项目目录启动
gemini

首次启动可选择用 Google 账号登录、使用 GEMINI_API_KEY 环境变量中的 API Key,或面向企业的 Vertex AI。项目说明可写在仓库的 GEMINI.md 中,作用类似 Codex 的 AGENTS.md 和 Claude Code 的 CLAUDE.md,编程工作流可参考 Codex 使用教程 与 Claude Code 教程。

文本、文件和多模态任务 ​

Gemini 的特点是多模态:除了文字,还能处理图片、文档、表格、代码,以及在支持的场景中处理音频和视频。

任务类型典型用途输入形式
文本写作、改写、翻译、问答、头脑风暴直接输入或粘贴
文档总结、提取要点、对比、问答上传本地文件或从 Google 云端硬盘添加
表格解读数据、找规律、生成图表CSV、表格文件
图片识别文字、解释图表、分析截图拍照、上传或粘贴
音视频提炼要点、定位片段(以功能可用性为准)上传文件
代码解释、审阅、修改建议导入代码文件夹或 GitHub 仓库
深度研究围绕一个主题检索并生成报告Deep Research,可附加自己的文件作为来源

添加文件的方式 ​

按 Gemini 帮助中心说明,添加文件有几种途径:从本地设备上传;通过「Add from Drive」从云端硬盘添加(需要开启 Keep Activity 并连接 Workspace);通过「Import Code」导入代码文件夹或 GitHub 仓库;以及在「More Uploads」中添加笔记本等内容。在 Chrome 中还可以直接把网页上的图片拖入或粘贴。每次提示可附加的文件数量、单个文件大小、音视频时长等都有限制,部分限制随订阅方案提高,具体以帮助中心为准;如果提示存储空间不足,可以删除旧的对话或文件后再上传。

Canvas:在侧边编辑文档与代码 ​

Canvas(画布)是 Gemini 中用于创作和修改文档、代码的交互空间:文档可以局部修改并调整语气、长度和格式,也可以导出到 Google 文档;代码类内容可以在 Canvas 中预览运行效果。需要多轮修改的长文或小工具,放在 Canvas 中迭代比在对话里来回复制更清楚。

与 Google 服务配合 ​

Gemini 与 Google 自家服务的配合是它区别于其他助手的地方。连接相应服务后,你可以让它在 Gmail 中查找某个主题的往来邮件并整理要点、从云端硬盘的文件里回答问题,或把 Deep Research 的报告、Canvas 中的文档导出到 Google 文档继续编辑。使用时注意三点:

  1. 按需授权:只连接当前任务确实需要的服务,并了解它会读取哪些内容;不再需要时在设置中断开。
  2. 在提问中限定范围:例如「只看过去一个月、主题包含某项目名的邮件」,比「看看我的邮件」更准确,也更少暴露无关信息。
  3. 工作账号先看规定:Workspace 账号能否连接这些服务、数据如何处理,由组织管理员和组织政策决定。

具体可连接的服务与可用功能会因账号类型、地区和方案不同,以 Gemini 帮助中心为准。

在 Canvas 中迭代修改 ​

在 Canvas 中修改长文时,可以选中某一段落单独提出修改要求,而不是让它整篇重写,这样其他已经满意的部分不会被意外改动。建议的顺序是:先确认整体结构,再逐段调整内容,最后统一调整语气和长度。代码类内容在预览中确认效果后,再复制到本地项目中测试;涉及账号、密钥的代码不要在对话中粘贴真实值,使用占位符代替。

不同任务的输入准备方法 ​

多模态任务中,输入质量往往比提示词更关键:模型看不清、读不全的内容,再好的提示词也补不回来。

图片 ​

  • 清晰对焦、光线均匀:文字识别类任务尽量正面拍摄,避免反光和透视变形。
  • 裁剪无关区域:只保留需要分析的部分,复杂截图可以圈出重点。
  • 补充文字说明:告诉它图里是什么、你关心哪一部分,例如「这是路由器后台截图,请解释第三行状态的含义」。
  • 截图打码:账号、邮箱、IP 地址、订阅链接、密钥等先打码再上传。

文档与表格 ​

  1. 优先上传可选中文字的文件:扫描件识别准确度通常低于原生电子文档。
  2. 表格保持规整:第一行是列名,避免多层合并单元格;必要时附一句每列的含义。
  3. 长文档先看目录:先让它列出结构,再按章节提问。
  4. 多文件标注用途:说明哪份是主文件、哪份是参考,避免混淆。
  5. 统一单位与格式:日期、金额、百分比统一格式,避免统计口径错误。

音频与视频 ​

  • 说明需要的是「全文要点」还是「某个话题出现的位置」;
  • 指定时间范围可以减少无关内容,例如「只看 10:00 到 20:00」;
  • 多人对话的录音,先说明大致有几位发言人和各自身份;
  • 时间点、发言人等信息务必回到原素材核对。

代码 ​

  • 导入整个仓库前,先想清楚要回答的问题,例如「登录流程在哪些文件中实现」;
  • 说明运行环境、语言版本要求和你观察到的现象;
  • 它给出的修改建议要在本地运行测试,不要直接用于生产环境。
输入问题后果改进
图片模糊、角度倾斜识别错字、漏字重新拍摄或用扫描应用矫正
表格结构混乱统计口径错误整理为一行一条记录的格式
文件夹杂无关内容回答偏离重点只上传相关部分
没说明关注点泛泛而谈在提示中写清要回答的具体问题
音视频过长要点遗漏、时间点不准指定时间范围或分段处理

多模态结果最容易出错的地方 ​

识别类任务的错误往往很隐蔽:整体看起来通顺,个别关键字符却错了。核对时重点关注以下位置:

  1. 形近字符:数字 0 与字母 O、数字 1 与字母 l 或 I、中文里的形近字,在序列号、地址、型号中尤其要逐字比对。
  2. 表格错行:截图或扫描件中的表格,识别后可能出现某一列整体错位,抽查几行首尾数据即可发现。
  3. 单位与小数点:金额、百分比、计量单位容易丢失或错位,统计前先确认单位。
  4. 手写内容:手写体识别准确度明显低于印刷体,重要内容应人工复核。
  5. 图表读数:从柱状图、折线图中读出的数值是估计值,需要精确数字时以原始数据为准。
  6. 说话人归属:多人录音中某句话是谁说的,容易归错,重要发言回放确认。

如果某类错误反复出现,把对应的要求写进提示词,例如「型号中的字母和数字请逐字转写,不确定的字符用【?】标注」。

隐私提醒

不要上传证件、银行卡、病历或他人的隐私信息。Gemini 的活动记录、数据使用与人工审核相关设置,以 Gemini 隐私说明和账号设置页面为准。

提示词结构与可复用模板 ​

提示词就是你交给 Gemini 的任务说明。多模态场景下,提示词除了说明任务,还要说明「每个附件是什么、你关心附件的哪一部分」。

提示词的基本结构 ​

text
任务:<要完成什么>
素材:<我上传了哪些文件 / 图片,它们分别是什么>
要求:<关注点、语气、长度、禁止事项>
输出:<表格 / 分点 / 先结论后理由>
如果素材中找不到答案,请直接说明,不要推测。

分场景模板 ​

图片识别与解释
text
附件是一张<设备/软件>的<界面/报错>截图。
1. 先把截图中的文字原样转写出来;
2. 再解释<第几行/某个区域>的含义;
3. 如果文字模糊无法确认,请标注「无法辨认」,不要猜测。
多文档对比
text
我上传了 3 份文件:A 是<说明>,B 是<说明>,C 是<说明>。
请按以下维度对比:<维度 1>、<维度 2>、<维度 3>。
输出表格,每个单元格注明出自哪份文件的哪一节;文件未提及的写「未提及」。
会议录音整理
text
附件是一段会议录音,参会者有<人数和身份>。
请输出:1. 会议决定事项(每项附负责人与截止时间,录音中没有的写「未明确」);
2. 待讨论问题;3. 每个决定事项出现的大致时间点,便于我回放核对。
表格分析
text
附件是<数据说明>,每行是<一条记录代表什么>,列含义:<列 1 = …>、<列 2 = …>。
先检查数据质量(空值、重复、异常值)并报告,再回答:<具体问题>。
请说明计算所用的筛选条件和公式,便于我复算。

让多轮对话保持聚焦 ​

  • 先粗后细:先让它给出概览或大纲,再逐项深入。
  • 明确指出修改点:如「第二个表格的『金额』列应以元为单位,请重算」。
  • 一次只改一类问题:结构、内容、措辞分轮处理。
  • 适时开新对话:话题已经换了,或它开始混淆前面的内容时,带上必要小结开新对话。

修改意见的说法对照 ​

笼统的说法更有效的说法
「写得好一点」「第一段删掉背景介绍,直接从结论开始;全文控制在 300 字内」
「再专业些」「面向财务人员,使用会计术语,去掉口语化表达」
「数据不对」「表中第三行的合计应为各月之和,请重新计算并展示公式」
「不是我要的」「我需要的是对比表,不是逐条介绍;列为名称、优点、限制」

提示词常见误区 ​

误区后果改进
只上传附件不说要做什么泛泛描述附件内容写清要回答的问题
多个附件不说明关系混淆主次与来源逐个说明每份附件是什么
没给素材问精确事实编造数字和来源提供素材或使用 Deep Research 并核对来源
要求过多且混杂部分要求被忽略编号列出,要求最后逐条确认

Gems 与 skills:可复用的指令 ​

Gems 允许你为某类任务写好名字、指令并附加知识文件,之后反复调用;skills 是 Google 宣布接替 Gems 的形式。按 Gemini 帮助中心说明,个人账号自 2026 年 11 月开始转换,Workspace 商业、企业与非营利账号以及教育账号随后分批进行,现有 Gems 会被自动转换为 skills,自动转换会带上受支持类型的知识文件;也可以提前手动重建。skills 可以在任意对话中通过斜杠命令加名称调用(官方说明之后会改为 @),能在同一对话中组合使用多个 skills,Gemini 也会在判断相关时自动应用。

写好一个可复用指令 ​

无论叫 Gems 还是 skills,写法原则相同:输入是什么、输出是什么、规则有哪些、遇到不确定时怎么办。

text
名称:周报整理助手
指令:
- 读者是部门负责人,只关心进度、风险和需要的支持。
- 输入是我粘贴的零散工作记录,按「本周完成 / 进行中 / 风险 / 下周计划」整理。
- 每部分不超过 5 条,每条一句话;没有内容的部分写「无」。
- 不添加记录中没有的事项;记录中状态不明确的,标注「待确认」。

指令写好后不是一成不变的。建议每隔一段时间回顾一次:哪些规则已经不再需要、哪些错误反复出现却没有写进规则、知识文件是否已经过期。把可复用指令当作一份需要维护的工作文档,而不是写完就忘的设置,它的输出质量才能长期保持稳定。

哪些任务值得写成可复用指令 ​

判断标准很简单:同一类任务你每周都会做、每次都要重复交代同样的规则,就值得写成 Gems 或 skills。

适合不太适合
周报、日报、会议纪要整理一次性的临时问题
固定格式的客服回复、邮件模板每次要求都不同的创意写作
合同、发票、简历的要点提取需要大量最新信息的调研(更适合 Deep Research)
按术语表翻译特定领域文档规则尚未稳定、还在摸索的任务
学习辅导:讲解 → 出题 → 批改涉及敏感个人信息的任务

写好之后,用两三个真实的历史任务测试一遍:输出是否符合格式、是否出现了输入中没有的内容、遇到信息缺失时是否按规则标注。测试中发现的问题,补充成指令中的一条规则。

组织建议 ​

原则说明
一个指令一件事「周报整理」「合同要点提取」分开写,组合使用比一个大而全的指令更可控
知识文件精简只附反复用到的模板、术语表、样例,过期文件及时替换
规则写成可检查的条目「每条一句话」比「简洁一些」更容易执行和核对
迁移后复查自动转换为 skills 后,用一个旧任务测试输出是否一致
手动迁移时备份名称、描述、指令可直接复制;知识文件需要逐个下载后重新添加

Deep Research 与长任务拆分 ​

需要围绕一个主题检索大量资料时,用 Deep Research;需要产出长文或复杂分析时,把任务拆成可核对的小块。两者的共同点是:先审计划,再执行,最后核对。

Deep Research 的使用流程 ​

按 Gemini 帮助中心说明,Deep Research 的基本流程是:

  1. 在 gemini.google.com 的输入框旁通过添加菜单选择 Deep Research,输入研究问题;
  2. Gemini 生成初步研究计划,可点「Edit plan」修改,再点「Start research」开始;
  3. 来源默认包含 Google 搜索,可通过「Sources」添加 Gmail、云端硬盘、上传的文件或 NotebookLM 笔记本(使用 Google 服务作为来源需先连接相应账号);
  4. 完成的报告在右侧 Canvas 中查看,可以转为音频概览、分享链接、导出到 Google 文档或复制文字。

Deep Research 需要年满 18 岁并登录,存在每日使用次数限制,付费方案限制更高,具体以帮助中心为准。

写一个好的研究问题 ​

研究问题决定了研究计划的方向。一个好的研究问题通常包含四部分:研究对象(研究什么)、范围(时间、地区、行业)、用途(报告给谁、用来做什么决定)、偏好的来源类型。对比下面两种写法:

  • 较弱:「研究一下远程办公。」
  • 较好:「为一家五十人左右的设计公司管理层准备一份材料,说明远程与混合办公对团队协作的主要影响、常见管理做法和需要注意的劳动合规问题;优先使用政府机构、学术研究和知名研究机构公开发布的资料,并区分研究结论与观点文章。」

后者让 Gemini 能生成更聚焦的计划,你审阅计划时也更容易判断哪些方向多余、哪些遗漏。

审阅研究计划的要点 ​

  • 范围是否对:时间范围、地区范围、对象范围是否与你的问题一致。
  • 子问题是否完整:是否遗漏了你最关心的维度,是否包含与目的无关的方向。
  • 来源是否合适:是否需要加入你自己的文件,是否要求优先官方和原始来源。

长文与复杂分析的拆分方法 ​

  1. 定义交付物与验收标准:写清交付什么、多长、包含哪些部分、怎样算完成。
  2. 先出大纲:确认结构和每部分要点后保存下来。
  3. 分块执行:每次只处理一个部分,开头贴上大纲和本部分要求。
  4. 阶段小结:每完成一块,让它输出「本部分结论、使用的资料、遗留问题」。
  5. 整体审阅:合并后检查术语、数据和结论是否前后一致,列出疑点由你处理。
text
请为刚才完成的部分写一份交接小结:
1. 完成了什么;2. 依据了哪些文件或来源;3. 做了哪些假设;
4. 遗留问题;5. 下一部分需要知道的上下文(150 字以内)。

结果核对清单 ​

输出类型核对方法
从图片或文档中提取的文字、数字与原图 / 原文逐项比对
表格统计结果用表格软件复算,检查筛选条件与单位
引用、链接、出处打开原始来源确认存在且内容一致
深度研究报告抽查报告中的关键来源,确认结论有依据,区分事实与推断
音视频时间点回放对应片段确认
代码建议在本地运行与测试

交叉验证的几种办法 ​

除了逐项回到原始素材,还可以用以下方法更快地发现问题:

  • 换一种问法再问一次:同一个事实用不同方式提问,两次回答不一致的地方就是需要重点核对的地方。
  • 让它反向检查:请它「找出上面回答中可能有误或依据不足的三处」,往往能暴露过度推断。
  • 要求给出原文:对关键结论,要求贴出支撑它的原文句子,而不只是给出处位置。
  • 用另一工具对照:对重要的事实性问题,用另一款助手或传统搜索交叉比对,差异处回到官方来源确认。
  • 请熟悉领域的人过目:对外发布或用于决策的内容,最后一道关应由人把守。

让它说明依据

在提示末尾加一句「请在每条结论后注明出自哪个文件或哪一段」,方便你逐条回查。

三个常见场景的完整工作流 ​

把输入准备、提示词、可复用指令和核对串起来,就能形成稳定的工作流。下面是三个示例场景,可按需要替换内容。

示例场景一:把纸质资料整理成电子笔记 ​

  1. 用扫描应用逐页拍摄,矫正角度、提高对比度,裁掉页边。
  2. 一次上传少量页面,要求「先原样转写,无法辨认的字标注为【?】」。
  3. 你对照原件检查转写结果,修正错字和标注处。
  4. 确认无误后,再让它按主题整理成笔记、提炼要点或生成复习题。
  5. 先转写、后加工的顺序,能避免识别错误被带进后续总结。

示例场景二:分析一次产品发布会视频 ​

  1. 说明视频主题和你关心的问题,例如「新功能有哪些、各自面向什么用户」。
  2. 视频较长时,指定时间段分段处理,每段要求附时间点。
  3. 让它汇总各段要点为表格:功能、说明、时间点。
  4. 回放表格中的关键时间点,确认表述准确;官方新闻稿与视频有出入时,以官方书面材料为准。

示例场景三:用 Deep Research 做一份入门调研 ​

  1. 写清问题、用途和读者,例如「为没有技术背景的同事解释某项技术的基本原理、主要应用和常见误解」。
  2. 审阅研究计划,删除与用途无关的方向,补充你关心的维度,要求优先官方与原始来源。
  3. 报告完成后导出到 Google 文档,抽查支撑关键结论的来源。
  4. 让它把报告压缩成一页摘要,并列出「报告中证据较弱、需要进一步确认的结论」。

示例场景四:整理一个项目的邮件往来 ​

  1. 连接 Gmail 后,限定范围提问,例如「查找主题或正文包含某项目名、近两个月的邮件」。
  2. 要求按时间顺序列出关键决定、待办事项和负责人,每条附邮件日期和发件人,便于回查。
  3. 抽查几封原始邮件,确认没有把讨论中的提议误写成已确定的决定。
  4. 把核对后的结果整理成项目进展记录;涉及他人个人信息的内容,不要转发给无关人员。

Gemini、ChatGPT 与 Claude 怎么选 ​

三款助手都能完成大部分日常写作、阅读和分析任务,选择的关键往往不是「谁更聪明」,而是你的资料在哪里、你习惯怎样组织工作,以及所在地区和账号是否可用。

考虑因素倾向 Gemini 的情况也可以考虑
资料所在位置资料主要在 Gmail、云端硬盘、Google 文档中资料在本地文件中,三者都可以上传
多模态输入经常处理截图、照片、音视频图片与文档处理三者都支持,音视频以各自功能说明为准
长期项目组织用 Gems / skills 固化流程ChatGPT 与 Claude 的 Projects 更侧重集中管理资料和对话
编程使用 Gemini CLICodex 与 Claude Code
账号与地区已有可用的 Google 账号,且所在地区受支持以各服务官方支持地区页面为准

对多数人来说,最实用的做法是选一款作为主力,把本页的方法用熟;遇到主力工具不擅长或不可用的任务,再用另一款交叉验证。用两款助手回答同一个事实性问题、比较差异,也是一种发现错误的有效方法,但最终仍要回到原始来源确认。

产品功能、权限和计费信息查阅 ​

Gemini 的功能会按账号类型、订阅方案、年龄、地区和语言分别开放,并经常更新;本站不列具体价格、额度和模型清单。

想确认的信息去哪里查
订阅方案包含的功能与价格Gemini 官方订阅方案页面(gemini.google 上的方案介绍)
某功能在你所在地区或语言是否可用Gemini 帮助中心(support.google.com/gemini)对应功能文章
工作 / 学校账号能否使用所在组织的管理员,以及 Google Workspace 相关帮助
Gemini API 价格与免费层说明Gemini API 官方定价页(ai.google.dev)
API Key 管理与用量Google AI Studio
新功能与变更Gemini 官方更新页(gemini.google.com/updates)

应用与 API 是两套体系

在 gemini.google.com 订阅的方案,用于 Gemini 应用;在程序里调用 Gemini 需要在 Google AI Studio 创建 API Key,按 API 规则计费。详见 AI API 入门。

活动记录、隐私与数据设置 ​

使用 Gemini 前,应先了解「Keep Activity」这个开关决定了对话如何保存。Gemini 应用活动记录是 Google 账号中保存的 Gemini 提示与对话记录。

按 Google 帮助中心说明:开启 Keep Activity 时,Google 会在你的账号中保存 Gemini 的提示和对话;可以在 gemini.google.com 的「设置与帮助 → 活动记录」或 myactivity.google.com/product/gemini 查看、删除具体对话,设置自动删除周期,或关闭该设置;即使关闭,对话仍会在账号中保存最多 72 小时,用于提供服务和处理反馈。还需注意,从云端硬盘添加文件等部分功能依赖于开启活动记录。

你的需求建议做法
不希望保留某次对话结束后在活动记录中删除,或使用临时对话(以界面提供的选项为准)
长期减少保存的数据设置较短的自动删除周期
处理工作资料使用组织提供的 Workspace 账号,并遵守组织规定
连接 Gmail、云端硬盘只连接需要的服务,不再使用时断开

此外,请遵守 Google 的使用政策,不生成违法或有害内容;对外发布或用于决策的内容由你负责核实。

自己验证的顺序 ​

Gemini 无法使用、提示出错或回复中断时,按下面的顺序逐步排除,每一步确认没问题再进入下一步:

  1. 确认资格:打开下文「官方资格入口」中的 Gemini 应用可用地区页面,确认你所在的国家或地区和使用的语言在名单内。
  2. 确认账号类型:个人 Google 账号与工作、学校账号的可用性不同,后者取决于组织管理员的设置。
  3. 排除浏览器因素:用无痕窗口或换一个浏览器登录 gemini.google.com,暂时关闭可能改写页面的扩展。
  4. 排除网络因素:确认网络连接稳定、会话过程中出口没有来回切换;代理接管与分流按 代理与分流入门 检查。
  5. 从小任务到大任务:先发一条短消息,再依次试上传文件、多模态输入和 Deep Research,定位是从哪一步开始失败。

怎样记录一次有效测试

每次只改一个变量,并写下:时间(含时区)、使用的入口或命令、网络环境(家庭宽带 / 手机网络 / 公司网络)、做了什么操作、结果与报错原文。连续几次记录都指向同一环节,再去对应章节处理或向官方支持反馈,比凭印象判断可靠得多。

常见报错与网络相关问题 ​

Gemini 的问题可以按「账号与地区 → 浏览器环境 → 网络 → 功能可用性」的顺序排查;最常见的「Something went wrong」往往与浏览器缓存、扩展、账号类型或网络有关。

症状 → 原因 → 处理对照 ​

情况可能原因处理思路
提示所在地区或语言不支持不在官方支持范围查看帮助中心可用地区说明,遵守当地法规与条款
工作账号无法使用组织管理员未开启联系管理员,或改用个人账号处理非工作内容
Something went wrong / 出错缓存、Cookie、扩展干扰,或对话卡在异常状态新开对话;无痕窗口;清除缓存与 Cookie;停用扩展
文件上传失败格式、大小、数量或存储空间不符合要求转换格式、拆分文件、删除旧文件,以帮助中心的限制说明为准
无法从云端硬盘添加未开启活动记录或未连接 Workspace按帮助中心说明开启相关设置
某功能入口不见了方案、年龄、地区或功能调整查看官方更新页和功能说明
回复中断、加载失败网络不稳定检查网络;参考 速度慢与断流
页面打不开DNS 或网络不可达参考 DNS 问题 与 连接失败
证书或安全连接错误系统时间错误或中间设备干扰参考 TLS 与证书错误
识别结果明显错误输入质量不足按上文方法重新准备图片或文件

网络环境的几点建议 ​

  1. 保持出口地区一致:频繁切换不同地区的出口,可能触发 Google 账号的安全验证。
  2. 避免多重代理叠加:系统代理、浏览器扩展、TUN 模式同时开启可能冲突,见 代理冲突。
  3. 上传与长回复需要稳定线路:大文件上传和 Deep Research 耗时较长,对断流敏感;网络选择标准可参考 AI 机场推荐。
  4. 分清问题层级:其他 Google 服务也打不开,多半是网络问题;只有 Gemini 异常,先检查账号、地区与浏览器环境。

请确保使用方式符合所在地法律法规与 Google 服务条款。仍无法解决时,可在应用中通过「帮助」菜单发送反馈,附上时间、入口、浏览器、报错原文和已尝试的步骤。

官方帮助入口:Gemini 帮助中心 support.google.com/gemini;开发者文档 ai.google.dev。功能变化较快,遇到与本页描述不一致的界面或说明时,以官方帮助中心的最新内容为准。

官方资格入口 ​

Gemini 应用和 Gemini API 的可用地区分别列出,两份名单不一定相同。下面只列官方页面:

产品官方页面说明
Gemini 应用(网页版、移动与桌面应用)Gemini 帮助中心:Gemini 应用的可用地区部分功能和语言另有地区限制
Gemini API 与 Google AI StudioGoogle AI for Developers:Gemini API 可用地区与 Gemini 应用名单不一定相同

以官方页面为准

名单会随时调整,本站只提供官方页面的入口,不代为判断某个账号能否使用,请以官方页面当前内容为准,并遵守所在地法律法规与各服务的使用条款。

依据与来源 ​

信息来源核验时间
网页版可用地区与语言说明Gemini 帮助中心 support.google.com/gemini/answer/135751532026-10-07
桌面应用支持 macOS(Apple 芯片、macOS 15+)与 Windows 10+(x64、ARM64),快捷键与功能官方下载页 gemini.google/desktop2026-10-07
Gems 过渡为 skills 的时间、自动迁移与调用方式Gemini 帮助中心 support.google.com/gemini/answer/185609192026-10-07
文件上传方式(本地、云端硬盘、导入代码等)与限制说明Gemini 帮助中心 support.google.com/gemini/answer/149031782026-10-07
Deep Research 的研究计划、来源、导出与使用条件Gemini 帮助中心 support.google.com/gemini/answer/157191112026-10-07
Gems 知识文件Gemini 帮助中心 support.google.com/gemini/answer/151467802026-10-07
Keep Activity、72 小时保存、活动记录管理入口Gemini 帮助中心 support.google.com/gemini/answer/132788922026-10-07
Canvas 的文档与代码编辑、导出到 Google 文档Google Workspace 更新博客 workspaceupdates.googleblog.com(2025 年 3 月 Canvas 发布说明)2026-10-07
Gemini CLI 安装命令、登录方式、GEMINI.md、Apache-2.0 许可GitHub google-gemini/gemini-cli 仓库 README2026-10-07
API Key 在 Google AI Studio 创建Gemini API 文档 ai.google.dev/gemini-api/docs/api-key2026-10-07

常见问题 ​

Gemini 的官方入口有哪些?

网页版是 gemini.google.com,另有 Android 与 iOS 移动应用,以及适用于 macOS 和 Windows 的桌面应用(下载见 gemini.google/desktop)。开发者可通过 Google AI Studio 和 Gemini API 使用。

Gems 还能用吗?

Google 官方说明 Gems 将逐步过渡为 skills,个人账号自 2026 年 11 月起转换,Workspace 账号随后分批进行,现有 Gems 会被自动迁移。具体时间以 Gemini 帮助中心为准。

Gemini 网页版订阅和 Gemini API 计费是一回事吗?

不是。Gemini 应用的订阅方案和 Gemini API 的按量计费分开管理,价格与额度以各自的官方页面为准。

为什么我的账号无法使用 Gemini?

Gemini 只在官方支持的国家、地区和语言中提供,部分功能还受账号类型、年龄或所在组织的管理设置限制。可查看 Gemini 帮助中心的可用地区说明。

Gemini 可以从哪里添加文件?

可以从本地上传,也可以从 Google 云端硬盘添加;按帮助中心说明,从云端硬盘添加需要开启 Gemini 应用活动记录并连接 Workspace。还可以导入代码文件夹或 GitHub 仓库,具体类型与大小限制以帮助中心为准。

Deep Research 的研究计划可以修改吗?

可以。提交问题后 Gemini 会先生成研究计划,可以点「Edit plan」修改,再点「Start research」开始;来源默认包含 Google 搜索,也可以添加自己的文件等来源。

关闭活动记录后,对话还会保存吗?

按 Google 说明,即使关闭「Keep Activity」,对话仍会在账号中保存最多 72 小时,用于提供服务和处理反馈。活动记录可在 Gemini 的设置与帮助中查看、删除或设置自动删除。

Gemini 出现 Something went wrong 怎么办?

先新开对话,再尝试无痕窗口、清除缓存与 Cookie、停用扩展,并确认登录的是可用的个人账号;同时检查网络与代理设置是否稳定。仍无法解决可在应用内通过帮助菜单发送反馈。

延伸阅读 ​

更新记录 ​

日期变更
2026-10-07首次发布完整内容
2026-10-07扩写为深度指南
2026-10-08按搜索结果页结构调整:开头直接回答、增加速查表、「自己验证的顺序」与「官方资格入口」(仅链接官方页面)

本专题文章 ​

暂无文章,敬请期待。