多数「Claude 对 Gemini」的文章,开头就是一张把两个模型放在同一根轴上的基准表。这些表很少经得起跟来源对照,因为两家公司公布的是不同的评测,跑在不同的设置上,时间也不一样。
所以本文换了个不那么热闹的做法。Claude 一列的每个数字都来自 Anthropic 公布的页面,而且指向具体某一页。Gemini 一列是空的——Google 的模型页和订阅页在撰写本文的网络环境下连不上。产出这张表的提示词放在后面。
为什么这类对比表很少经得起出处核对
对比内容靠答得快排名,而答得快就想要一个赢家。打分是造赢家最省事的办法,而现成的分数,来自跑测试的那个人。
于是有两件事要留意。分数属于跑出它的那次测试,所以两个站点可以互相矛盾而都没说谎。模型阵容换得比文章快。这两个问题都不是靠多塞几个数字解决的,解法是给每个数字指明它来自哪一页,以及在没有页面可指的时候,把格子留空。
Anthropic 公布了 Claude 的哪些东西,在哪
Anthropic 公开列出当前阵容:Claude Fable 5.1、Claude Opus 5、Claude Sonnet 5、Claude Haiku 4.5。它对 Claude Fable 5.1 自己写的一句话是「Our frontier model, sharper on the hardest problems and longest-running agents」。
商业条款有两种呈现。价格卡上,Free 是 $0,Pro 按年付口径每月 $17、一次性预付 $200,月付 $20,Max 从每月 $100 起,可选 Pro 的五倍或二十倍用量。帮助中心把同样的档位写成 Pro 每月 $20 或每年 $200、Max 5x $100、Max 20x $200。两个都引,然后以结账页为准。Anthropic 另外说明价格不含适用税费、方案由它自行决定是否调整,价格方案拆解逐个档位讲了这件事。
公布出来的矩阵里有一行值得单看。Claude Fable 5.1 在 Free 上是「No」,在 Pro 上是「Usage credits」,在两个 Max 档上是「50% of weekly limits」;而 Claude Opus 5 在 Free 上是「No」,往上一律「Yes」。同一个产品,顶级模型怎么付费取决于你在哪一档。

逐项对照,Google 那一列留空
| 对比项 | Claude,来自 Anthropic 公布的页面 | Gemini |
|---|---|---|
| 入门付费档 | Pro 年付口径每月 $17、预付 $200,月付 $20 | 官方未公布 |
| 更高档位 | Max 每月 $100 起,可选 Pro 的 5x 或 20x 用量 | 官方未公布 |
| 当前模型 | Claude Fable 5.1、Claude Opus 5、Claude Sonnet 5、Claude Haiku 4.5 | 官方未公布 |
| 上下文窗口 | 付费档最新模型最高 1M token,其余 500K 或 200K | 官方未公布 |
| 用量限制 | 五小时滚动会话窗口、付费档另有周限额、没有固定消息条数 | 官方未公布 |
| 编码工具 | Claude Code 包含在所有付费方案里,共用同一份用量池 | 官方未公布 |
| 图片与视频 | 未列入 Anthropic 公布的方案能力清单 | 官方未公布 |
一侧能读,一侧故意空着。每个空格的意思都一样:本文能打开的页面里没有出现过这个数字,所以不填。这是本文的边界,不是关于 Gemini 的结论;把边界说出来,比用一个谁也追不到的数字把表填满更有用。
上下文窗口有三个已公布的尺寸
关于 Claude 被重复最多的说法是「只有 200k 窗口」,官方措辞比这具体。Anthropic 写的是「the context window size depends on which model you’re using」,付费档最新模型「support up to a 1M token context window」,其余支持 500K 或 200K,并补充窗口里总有一部分留给模型的回复。三个尺寸,同一页,档位和模型一样重要。
Anthropic 把两件常被当成一件的限制分开了
帮助中心把两者都定义了,而且分得很清楚:用量限制「control how much you can use Claude across all your conversations」,长度限制「control how long any single conversation can become」。同一页还写明网页版、桌面端、手机端和 Claude Code「counts towards the same usage limit」,撞到上限后有三条路:等、升级、买 usage credits。竞争对手是否也这样切分这两个概念,本文核对不了;不过把工作完全搬出订阅会改变计费方式,这条路由 Claude API 接入指南来讲。
案例分析:产出这张表的那条提示词
下面这条提示词在新对话里运行,把上面的表格粘在后面。
Sort every row of this comparison table into three buckets.
Bucket A: a sentence on a vendor's own domain supports it. Quote that
sentence and give the URL.
Bucket B: only a review, a leaderboard or a blog supports it. Say which.
Bucket C: nothing supports it.
Put the row in the lowest bucket it qualifies for, and never move a row
up because a number looks plausible. End with one line per row.
它产出的是七行清单。Claude 有三行落进了 A 桶,分别引用了同一篇帮助中心文章里关于上下文窗口、用量限制和 Claude Code 的句子,并带上了 URL。其余几行进了 B 桶,因为支撑它们的是一个表格单元格,不是一句话。Gemini 的每一行都落进 C 桶。真正的发现是这个分布:能引到整句的那几行,读者一分钟内就能核实;剩下的几行,是二手总结的总结。
两家厂商都不会给你的东西
Anthropic 没有为任何档位公布固定消息条数,没有周限额的数值,也没有 usage credits 与 token 之间的换算率,所以从 Pro 用到顶级模型的真实成本无法提前算出来。年付折扣没有公布百分比。免费方案的描述也一样:基于会话、每五小时重置、没有数字。
Gemini 那一列空着的原因不同。Google 的模型页和订阅页在本文的网络环境下完全连不上,能诚实做的选择只有两个:留空,或者从连得上的站点把数字抄过来。
常见问题
哪个更好? 就公开条款而言,上面那张表回答了 Claude 一侧,并标出了自己的缺口。输出质量要拿同一个测试在两边各跑一次,而任何一次测试都属于跑它的人。
为什么不用别的站点把 Gemini 那一列填上? 追不到出处的数字就是没法核实的数字,把第三方的数字转手当成对比,只会让这一页比留空更没用。
窗口大小本身能决定什么吗? Anthropic 把窗口和模型、档位绑在一起,并注明其中一部分留给回复。把那个数字当成起点,而不是结论。
想从 Claude 本身开始,先看哪篇? 话题总览把相关指南收在一起,上面链接的价格方案拆解是最自然的下一篇。
空着的一列不会让读者损失什么。用别人的测试堆出来的确信,会让人买错东西。