前些天,朋友问我“该用哪个生成式AI服务好”,我随口答了一句“说实话,只要能用中文把想问的问出来,不都差不多吗”。作为说这话的人,心里也留下了一丝疙瘩:这样敷衍过去真的行吗。于是本文通过对读三项主要服务——ChatGPT(OpenAI)、Claude(Anthropic)、Gemini(Google)——的官方网站、官方帮助与官方文档,来检验这个回答究竟对到什么程度。取材不用各家的宣传辞令,只用价格页、使用条款与帮助文档里写明的事实(价格与模型名均为2026年7月21日的确认值)。

先说结论 —— 对比表

项目ChatGPTClaudeGemini
开发企业OpenAI(美国)Anthropic(美国)Google(由 Google DeepMind 开发)
最新模型GPT-5.6 SolClaude Fable 5 / Claude Sonnet 5Gemini 3.1 Pro / Gemini 3.6 Flash
免费方案
个人付费(月费)Go $8 / Plus $20 / Pro $100 起Pro $20 / Max $100 起Plus ¥1,450 / Pro ¥2,900 / Ultra $100 起
应用Web、iOS、Android、macOS、WindowsWeb、iOS、Android、macOS、Windows、Linux(β)Web、iOS、Android(并集成于 Android OS)
API
图像读取
图像生成×(仅读取)○(Nano Banana 系列)
语音对话○(β)○(Gemini Live)
视频生成×(Sora 已停止提供)×○(Veo 3.1)
用对话进行训练可在设置中关闭在设置中选择可在设置中关闭

单是看表,开头那个回答的对错大致也就浮现出来了。“用中文提问、拿到回答”这一入口体验,三家确实几乎相同。都有免费方案,都有约 $20 的标准方案与 $100 级的高阶方案,都备有手机应用与 API——这套骨架在三家之间整齐地并列。另一方面,在视频与图像的生成、与其他服务的联动、数据的处理这些“周边”上,则留有明显的差异。以下逐一按官方资料确认。

ChatGPT(OpenAI)—— 以功能的“广度”领先

开发企业是 OpenAI。隐私政策上的数据管理者记载为 OpenAI OpCo, LLC(美国旧金山)。

最新模型是 2026年7月9日开始推送的旗舰推理模型 GPT-5.6 Sol。官方的模型发布说明记载其面向编程、研究、科学、网络安全、计算机操作、设计等复杂工作(面向付费方案;免费版的日常默认模型为 GPT-5.5 Instant)。

价格(官方价格页,美元表示):

  • Free($0) —— 可在使用限制下使用 GPT-5.5 Instant。对消息数、上传、图像生成等设有上限
  • Go($8/月) —— 提高上限的廉价方案。明确写有“可能会显示广告”这一点颇具特色
  • Plus($20/月) —— GPT-5.6 系推理模型、扩展版 Deep Research、项目、自定义 GPT 等
  • Pro($100/月起) —— 用量 5 倍或 20 倍两档。图像生成变为高速、无限制
  • 面向企业的有 Business($25/用户/月,年付时 ¥3,050/用户/月)与 Enterprise(价格不公开)

支持平台为 Web、iOS、Android、macOS、Windows,此外还官方提供 Chrome 扩展。API(OpenAI API)为按量计费,最新的 GPT-5.6 系按用途分为三种:Sol(输入 $5 / 输出 $30,每百万 token)、Terra($2.50 / $15)、Luna($1 / $6)。

图像、语音、视频方面,ChatGPT 在应用内具备图像的读取与生成、语音对话,而视频生成服务 Sora 已于 2026年4月26日停止 Web 版与应用的提供(官方帮助明确写有“The Sora web and app experiences were discontinued on April 26, 2026.”。API 也预定于 2026年9月24日终止)。也就是说,现阶段的 ChatGPT 是一项不具备视频生成的服务。

数据处理方面,个人用途下对话可能被用于模型改进(训练),关闭设置中的“Improve the model for everyone”后便不再用于训练。另设有不用于训练、30 天自动删除的“临时聊天”。

Claude(Anthropic)—— 专注于文本与编程,图像“只读”

开发企业 Anthropic 是一家将自身定位为“AI safety and research company”(AI 安全性的研究企业)的公益法人(Public Benefit Corporation)。

最新模型是 2026年6月9日开始正式提供的 Claude Fable 5(官方模型一览中记载为“最高性能的正式提供模型”),免费与 Pro 方案的默认模型是 2026年6月30日发布的 Claude Sonnet 5。此外还有 Claude Opus 4.8(面向智能体式编程)、Claude Haiku 4.5(最快、低成本)。上下文(一次可处理的文本量)最高为 100 万 token。

价格(官方价格页,美元表示):

  • Free($0) —— 聊天、代码生成、Web 搜索、记忆等
  • Pro($20/月,年付时 $17/月) —— 除扩大用量额度外,还含 Claude Code(编程辅助)等各类工具
  • Max($100/月起) —— 用量 5 倍或 20 倍两档
  • 面向企业的有 Team($25/用户/月起)与 Enterprise

支持平台为 Web、iOS、Android、macOS、Windows,此外还官方支持 Linux(β)与 ChromeOS,是三家中最广的配置。API 除在 api.anthropic.com 直接提供外,还可经由 Amazon Bedrock、Google Cloud、Microsoft Foundry 使用。

图像、语音、视频是三家对比中差异最大的地方。图像支持读取(对内容的理解与分析),但无法生成。官方文档明确记载如下。

Claude is an image understanding model only. It can interpret and analyze images, but it cannot generate, produce, edit, manipulate, or create images.

(Claude 是仅用于图像理解的模型。它能够解读与分析图像,但无法生成、制作、编辑、处理或创建图像。)

语音对话作为 β 版在全部方案可用,不支持视频的生成与输入。与其说是拓宽功能,不如说是收拢到文本、编程、长文阅读的配置。

数据处理方面,免费、Pro、Max 方案采用由用户在设置中选择是否允许训练使用的方式。允许训练时聊天最长保留 5 年,不允许时则一如既往保留 30 天(企业方案与 API 不在训练对象之列)。

Gemini(Google)—— 多模态生成与 Google 联动的广度

开发企业是 Google,模型开发由其整合 AI 部门 Google DeepMind 承担。

最新模型是恰巧与本文同日、于 2026年7月21日发布的 Gemini 3.6 Flash(官方博客记载自当日起向 Gemini 应用的全体用户及 API 提供)。面向更高阶推理的,则在高阶方案中备有 Gemini 3.1 Pro(官方表述为“most intelligent model”)与 Gemini 3.1 Deep Think。Flash 系为 3.6、Pro 系为 3.1,各系列间版本号并不统一,这一点与官方表述一致。

价格方面,Gemini 是三家中唯一能在官方页面确认到日元的:

  • 免费 —— 可在使用量上限下使用 Gemini 应用
  • Google AI Plus(¥1,450/月) —— 扩大使用量上限、Gmail 内的 Gemini 等
  • Google AI Pro(¥2,900/月) —— Pro 模型、Deep Research、5TB 存储等
  • Google AI Ultra($100/月与 $200/月两档) —— 用量为 Pro 的 5 倍/20 倍(未能确认到日元的官方标示)

支持平台为 Web、iOS、Android,虽无专用桌面应用,但与 Android OS、Chrome、Google Workspace(Gmail、文档)的集成正在推进。API(Gemini API)可在 Google AI Studio 签发密钥,面向企业则有经由 Vertex AI 的提供。

图像、语音、视频在三家中最为丰厚,图像生成的 Nano Banana 2 / Nano Banana Pro、语音对话的 Gemini Live(含 70 多种语言的语音实时翻译)、视频生成的 Veo 3.1 一应俱全。作为现行服务提供视频生成的,三家中只有 Gemini(如前所述,ChatGPT 的 Sora 已停止提供,Claude 不支持)。

数据处理方面,开启“活动保存”后聊天会被用于服务改进(含模型训练),关闭后今后的聊天便不再用于训练。官方帮助明确写明:为改进,人工审阅者可能会查看部分聊天;保存期限默认 18 个月(关闭时为 72 小时)。

“都一样”对到什么程度

将官方资料并列之后,回到开头的回答来做个梳理。

可以说“一样”的部分 —— 用中文提问获得文本回答、给它看图询问内容、请它帮忙查资料,这些核心用法三家都能免费上手,连价格骨架——约 $20 的标准方案与 $100 级的高阶方案——都相一致。若朋友的问题旨在“想用于日常查资料与写作”,那么开头的回答大体没错。无论选哪个,入口体验差别都不大,先用免费方案试试,觉得哪个聊得顺就用哪个——这便是官方资料所能给出的答案范围。

“并不一样”的部分 —— 选择会发生变化,是在你对以下三点有所在意时:

  1. 想生成什么 —— 若想连视频也一并制作,选项就收窄到 Gemini(作为现行服务具备视频生成的只有 Gemini)。若需要图像生成,则是 ChatGPT 或 Gemini。Claude 能“读”图,却不能“画”图
  2. 在什么环境下使用 —— 若是 Gmail、Google 文档,Gemini 的集成最深;若论含 Linux 桌面在内的专用应用之广,则是 Claude;若论 Chrome 扩展与 Windows/macOS 应用的齐备程度,ChatGPT 也毫不逊色
  3. 数据处理与价格的细节 —— 三家都能在设置中停止将对话用于训练,但默认行为、保存期限、选择方式各不相同。此外,$8 带广告的 Go(ChatGPT)、以日元 ¥1,450 起的 Plus(Gemini)等,在廉价档位的设计上也各显个性

另外,本文有一个未曾涉及的论点:**模型性能(聪明程度)本身的优劣。**这一点无法从各家的官方资料——也就是自我申报——来判断。关于由第三方评价模型的机制(基准测试站点或用户投票),在续篇《生成式AI的“聪明”由谁、如何衡量》中作了梳理。

小结

  • “只要能用中文提问就都一样”,若仅限日常聊天用途大体正确。免费方案、约 $20 的标准方案、$100 级的高阶方案、应用、API 这套骨架在三家之间并列
  • 留有差异的是周边部分。视频生成仅 Gemini,图像生成为 ChatGPT 与 Gemini,Claude 仅支持图像读取
  • 联动的深度三者各异。Gemini 强在 Google 服务与 Android,Claude 强在 OS 支持之广(含 Linux β),ChatGPT 强在功能的广度与 Chrome 扩展
  • 三家都能在设置中控制对话的训练使用,但默认值、保存期限、选择方式各不相同,若用于业务则需确认
  • 性能的优劣无法从官方资料判断。第三方评价的机制在续篇中讨论

参考资料