简短回答: 截至2026年7月23日,这两个原始API模型均已过时。. xAI 退役了 Grok 4.1 Fast 于2026年5月15日,将旧的推理和非推理片段重定向至Grok 4.3。. 谷歌关闭了 Gemini 3 Pro 预览版 于2026年3月9日发布,并要求开发者迁移至Gemini 3.1 Pro Preview版本。.
对于一个新项目,更有参考价值的比较是 Grok 4.5 与 Gemini 3.1 Pro. Gemini 发布了更广泛的混合媒体输入集,并将输入限制设定为 1,048,576 个令牌。 Grok 4.5 版本提供 500,000 个令牌的上下文,针对少于 200,000 个令牌的提示词提供更低的输出令牌定价,并支持第一方 Web Search 和 X Search 工具。 最佳选择取决于您的文件、工具、延迟目标以及每条被接受结果的成本。.
GlobalGPT 将多种模型路线整合到一个平台, ,其当前型号列表中包含 Grok 4.1 Fast、Grok 4.3、Gemini 3 Pro 和 Gemini 3.1 Pro 等型号。 GlobalGPT 是一个第三方平台,因此其模型名称、限制和计费均遵循其自身的服务条款;该平台不会继续维持已停用的 xAI 或 Google API 端点的运行。.
官方型号状态,2026年7月23日核查: 调用
grok-4-1-快速推理目前由以下机构提供服务:grok-4.3只需少量推理工作,而调用grok-4-1-fast-non-reasoning由……提供服务grok-4.3无需任何推理。谷歌列出了gemini-3-pro-预览版已关闭,并要求开发者改用gemini-3.1-pro-preview. 新的集成应使用明确的当前模型 ID,并重新运行质量、延迟、工具使用情况和成本测试。.
规格对比:Grok 4.1 与 Gemini 3 Pro 今日对比

与 GPT-5、Nano Banana 等设备一起,提供集写作、图像和视频生成功能于一体的人工智能平台
原始模型名称对于迁移搜索仍然有用,但它们已不再对应两个有效的官方 API 端点。下表将已停用的模型与开发者可主动选择的当前模型区分开来。.
| 规格 | 当前的 xAI 路线 | 当前的谷歌路线 |
|---|---|---|
| 遗留状态 | Grok 4.1 已于 2026 年 5 月 15 日提前退役;旧链接将重定向至 Grok 4.3 | Gemini 3 Pro Preview 将于 2026 年 3 月 9 日停止服务;谷歌要求用户进行迁移 |
| 与当前型号对比 | grok-4.5 | gemini-3.1-pro-preview |
| 已发布的上下文或令牌限制 | 50万个代币的上下文 | 1,048,576 个输入令牌;65,536 个输出令牌 |
| 已发布的输入范围 | xAI 的 Grok 4.5 概述主要围绕文本、工具、代码和代理式工作展开;媒体生成和语音功能则通过独立的 xAI API 实现 | 支持文本、图片、视频、音频和PDF输入;输出文本 |
| 推理 | 低、中或高;默认值为高 | 支持思考 |
| 主要工具 | 函数调用、Web 搜索、X 搜索、代码执行 | 函数调用、代码执行、AI Studio中的文件搜索、谷歌搜索、谷歌地图、URL上下文、结构化输出 |
| API 速率低于 200K 个提示令牌 | 每100万个令牌包含1个$2输入、1个$0.30缓存输入和1个$6输出 | 每100万个令牌包含1个TP41T2输入、1个TP41T0.20缓存输入和1个TP41T12输出 |
| API 速率达到或超过 200K 提示令牌 | 每100万个令牌包含1个TP41T4输入、1个TP41T0.60缓存输入和1个TP41T12输出 | 每100万个令牌包含1个TP41T4输入、1个TP41T0.40缓存输入和1个TP41T18输出 |
xAI 特别推荐将 Grok 4.3 作为已停用的 Grok 4.1 Fast 工作负载的迁移目标,而 Grok 4.5 则是其当前用于代码和更广泛代理任务的旗舰模型。 Google 直接推荐 Gemini 3.1 Pro Preview 作为 Gemini 3 Pro Preview 的替代方案。由于其中一个替代方案是预览版模型,且两家提供商都可能更改路由规则,请将日志中返回的确切模型 ID 固定下来。.
Gemini 在混合媒体输入和长提示词方面具有更明显的已公布优势。Grok 的列出输出率在 20 万个提示词令牌以下,且配备了专用的 X Search 工具。但这两项优势均不能证明其在所有任务中都能提供更高质量的答案。.
多模态能力:当前的继任者
Gemini 3.1 Pro Preview 发布的多模态范围

- 输入: 文本、图片、视频、音频和 PDF;发布后的输出类型为文本。.
- 代币限制: 1,048,576 个输入令牌和 65,536 个输出令牌。.
- 文档工具: 代码执行、URL 上下文、结构化输出、Google 锚定以及 AI Studio 中的文件搜索。.
当需要综合比较报告、图表、截图、音频和视频时,这些已发布的输入信息使得 Gemini 3.1 Pro Preview 成为更安全且有据可查的选择。较大的上下文窗口虽能提升处理能力,但并不能提高可靠性,因此重要论点仍需引用来源并进行输出核查。.
Grok 4.5 的已记录范围

- 核心模型: xAI 将 Grok 4.5 定位于代码编写、聊天、工具调用、自主任务以及知识工作领域。.
- 背景: 当前的 xAI 模型目录中列出了 500,000 个令牌。.
- 独立的媒体路径: xAI 通过 Imagine API 生成图像和视频,并通过 Voice API 生成语音。.
原始截图展示的仅为一个响应结果,并非可复现的基准测试。在选择生产方案之前,请使用相同的文档、工具权限、提示语、评分标准和试验次数,对当前的两个模型进行对比测试。.
生态系统整合:X Search 与 Google Grounding 的对比
Grok 带 X 搜索

xAI 的文档指出,除非启用了搜索工具,否则 Grok 无法识别实时事件。Grok 4.5 支持 Web 搜索和 X 搜索,并且 xAI 当前的定价页面 每1,000次调用,每种工具的费用为$5(美元)。X Search 可搜索帖子、个人资料和讨论串;这是一种付费工具调用,并非每个答案中都包含自动生成的实时知识。.
Gemini 搭配 Google Grounding 和 File Tools
Gemini 3.1 Pro 预览版支持 AI Studio 中的 Google 搜索锚定、Google 地图锚定、URL 上下文、代码执行以及文件搜索。在 谷歌的付费 API 套餐, ,每月前5,000条基于地面数据的提示在Gemini 3个模型中均免费提供,此后按每1,000次搜索查询收取$14的费用。一条提示可能生成多个查询,因此应根据实际日志来核算费用。.
您应该选择哪一种?
- 使用 X 搜索选择 Grok 当X的帖子、个人资料和讨论串被视为一级证据时。.
- 选择 Gemini 当多媒体文件、网络基础知识、地图、URL 以及与谷歌相关的研究成为核心内容时。.
- 对于高风险的工作,, 在使用结果之前,请记录引用、时间戳、工具调用以及未获支持的声明。.
性能基准测试:如何比较当前机型
过往的排行榜排名和单次响应时间测试已不再是决定此次对比结果的依据。原始端点已不再适用,且评分会随模型版本、推理级别、提示词、工具访问权限、采样设置以及评估日期而变化。.
- 图钉
grok-4.5和gemini-3.1-pro-preview, ,并记录返回的模型和日期。. - 为这两个模型提供相同的任务、文件、工具、时间预算和验收标准。.
- 将“闭卷推理测试”与“基于事实的搜索测试”区分开来。.
- 应进行足够多的试验以捕捉变异性,而不是仅保留一个有利的结果。.
- 衡量正确性、引用支持度、延迟、评审时间、令牌使用情况、工具调用次数以及每条被接受结果的总成本。.
如需更全面的候选名单,请参考GlobalGPT中列出的维持选项 最佳AI模型指南. 实际上的优胜者是那个以最低的、经审查调整后的成本通过您自身验收测试的模型。.
开发工具:Grok 与 Gemini 在编程中的对比
Grok 4.5:编码与能动性工作

xAI 将 Grok 4.5 描述为其在代码及更广泛的代理任务领域的旗舰模型。它通过 Responses 和 Chat Completions API 支持可配置的推理、函数调用、搜索和代码执行。这使其成为迭代式代码修复和工具驱动型工作流的强有力候选方案。.
Gemini 3.1 Pro 软件工程预览版

谷歌将 Gemini 3.1 Pro Preview 定位于软件工程、精准工具使用以及多步骤执行。它还提供了 gemini-3.1-pro-preview-customtools 对于同时使用 Bash 和自定义工具的工作流,同时提醒:对于无法从这些工具中受益的任务,其质量可能会有所波动。有关相关工具的背景信息,请参阅 Google《反重力》指南.
开发者应该选择哪一种?
- 从 Grok 4.5 开始 用于以编码为中心的代理循环、支持X的工具,以及降低短上下文输出的成本。.
- 从 Gemini 3.1 Pro 预览版开始 适用于包含 PDF、图片、视频、音频、URL 或 Google Grounding 的存储库。.
- 仅在测试后发货: 生成的截图和看似合理的代码不能替代通过测试和人工审查。.
用户体验:对话式与结构化回复
Grok通常用于更偏向对话风格的场景,而Gemini则常用于结构化研究和以商业为导向的输出。语气并非一项固定的技术能力:系统指令、推理设置、安全策略以及产品界面都会影响这两种模型的响应方式。.
- 创意与社交工作流程: 测试Grok的风格是否能在不降低事实依据的情况下缩短编辑时间。.
- 研究与企业工作流程: 测试Gemini的结构是否能提升审稿质量、被引用次数和再利用率。.
- 面向客户的使用: 对这两种模型均采用相同的安全、升级、隐私和质量控制措施。.
定价方案:已核实的当前费用

截至2026年7月23日,xAI和谷歌公布了以下基于使用量的费率,具体如下: 每100万个代币的美元价值. 这些是 API 价格,并非月度订阅费用。两个开发者定价页面均未注明价格已含税;适用的税费及货币兑换率取决于客户的计费账户和所在司法管辖区。.
| API 路由 | 提示词长度 | 输入 | 缓存输入 | 输出 | 重要条件 |
|---|---|---|---|---|---|
| 已退役的Grok 4.1型“快弹”,现由Grok 4.3型接替 | 低于20万 | $1.25 | $0.20 | $2.50 | 老的会推理的蛞蝓推理能力较低;老的不会推理的蛞蝓则完全不会推理 |
| 已退役的Grok 4.1型“快弹”,现由Grok 4.3型接替 | 20万或以上 | $2.50 | $0.40 | $5.00 | 当提示词达到 200K 时,xAI 会对所有令牌应用长上下文速率 |
| Grok 4.5 | 低于20万 | $2.00 | $0.30 | $6.00 | 搜索和代码执行工具将单独计费 |
| Grok 4.5 | 20万或以上 | $4.00 | $0.60 | $12.00 | 500K 总上下文 |
| 双子座 3.1 预览版 | 最高20万 | $2.00 | $0.20 | $12.00 | 输出价格包含“思考代币”;未列出免费 API 层级 |
| 双子座 3.1 预览版 | 超过20万 | $4.00 | $0.40 | $18.00 | 上下文缓存存储单独列出,每小时每100万个令牌的费用为$4.50 |
Grok 4.5 在长上下文阈值以下的输出速率较低。Gemini 的输出成本更高,但其公布的 100 万令牌输入限制以及对混合媒体的支持,可能减少对单独文件处理管道的需求。 比较每条被接受结果的总成本,包括工具调用、重试和人工审核。.
消费者订阅是单独的
在谷歌的 美国 Gemini 订阅页面, 免费版每月$0,Google AI Plus每月$4.99, Google AI Pro 每月 $19.99,Google AI Ultra 起价为每月 $99.99(提供 Pro 套餐 5 倍的使用额度),或每月 $199.99(提供 20 倍的使用额度)。 该页面显示的是按月计费,具体使用权限因套餐、国家、年龄和语言而异。页面未说明所显示的美元价格是否包含税费。.
Grok 消费者访问服务与 xAI API 的计费是分开的。xAI 的公开开发者定价页面提供了具体的 API 和工具费率,但并未公布适用于所有账户和地区的统一 Grok.com 月度订阅价格。上方的历史消费者定价图不应用于引用当前的套餐价格。.
当前 GlobalGPT 的定价与功能
截至2026年7月23日,该 GlobalGPT 订单页面 “Basic”套餐价格为$11.90(按月计费)或$5.80(按月计费,按年结算), Pro 套餐为按月支付 $19.90 或按年支付每月 $10.80,Unlimited 套餐为按月支付 $49.90 或按年支付每月 $25.00。 年度总费用分别为 $69.60、$129.60 和 $300.00。该页面使用了美元符号,但未注明 ISO 货币代码,也未说明是否包含税费;享受折扣的月费方案需按全年支付。.
- 多种模型路线: 当前列表包括 Grok 4.1 Fast、Grok 4.3、Gemini 3 Pro、Gemini 3.1 Pro 以及其他机型系列。.
- 一个账户: 无需为每个服务商分别订阅消费者套餐,即可对比聊天、搜索、图片、视频和研究工具。.
- 第三方条款: GlobalGPT 自行管理其路由、限额、套餐额度及计费;服务提供商的 API 文档仍是查询官方端点状态的权威来源。.
最终想法
请勿在 Grok 4.1 Fast 或 Gemini 3 Pro Preview 版本上启动新的官方 API 集成。若需明确的 xAI 迁移目标,请使用 Grok 4.3;或评估 Grok 4.5 作为 xAI 当前的旗舰版本。 当原生混合媒体输入、已公布的 1,048,576 个令牌输入限制以及 Google 锚定功能是决定性因素时,请使用 Gemini 3.1 Pro Preview 版本。.
若需以编码为中心的主动型工作流、更低廉的短上下文输出定价或 X Search 功能,请选择 Grok 4.5。若需处理长篇混合媒体输入及使用 Google 工具,请选择 Gemini 3.1 Pro Preview。如果您希望在一个界面中比较不同提供商的方案,, GlobalGPT 提供了一个多模型工作流, ,它有其自身的限制和定价。.
常见问题:Grok 4.1 与 Gemini 3 Pro 对比
Grok 4.1 是否仍可通过 xAI API 获取?
与原始模型不同。xAI 已于 2026 年 5 月 15 日停用 Grok 4.1 快速推理和非推理 API 模型。 旧的链接现在会重定向至 Grok 4.3(推理工作量较低或无需推理),并按 Grok 4.3 的费率计费。.
Gemini 3 Pro 是否仍可通过 Gemini API 获取?
不。谷歌显示“Gemini 3 Pro Preview”将于2026年3月9日停止服务,并建议开发者迁移至“Gemini 3.1 Pro Preview”。谷歌的页面并未承诺旧的模型ID将继续作为别名使用。.
新项目应该采用当前的哪种模型?
使用明确的模型 ID 评估 Grok 4.5 和 Gemini 3.1 Pro Preview。 Grok 4.5 适用于编码、代理和 X-搜索工作流;Gemini 3.1 Pro 预览版适用于大型混合媒体输入和基于 Google 的研究。.
哪个模型的当前上下文窗口更大?
Gemini 3.1 Pro Preview 公布的输入限制为 1,048,576 个令牌,输出限制为 65,536 个令牌。 xAI 列出的 Grok 4.5 模型上下文长度为 500,000 个令牌,而 Grok 4.3 模型的上下文长度为 1,000,000 个令牌。.
当前的替代 API 费用是多少?
在提示词令牌数低于 200K 的情况下,Grok 4.5 版本的输入为 $2,每 1M 令牌的输出为 $6;Gemini 3.1 Pro Preview 版本的输入为 $2,输出为 $12。 在长上下文层级中,Grok 对应 $4/$12,Gemini 对应 $4/$18(以美元计)。.
Grok 是否会自动包含实时 X 数据?
不。xAI 表示,除非启用了搜索工具,否则 Grok 无法访问实时事件。Web Search 和 X Search 是可选工具,每 1,000 次呼叫分别计费 $5。.
GlobalGPT 能否同时显示旧标签和当前的继任标签?
是的。GlobalGPT的当前列表包括Grok 4.1 Fast、Grok 4.3、Gemini 3 Pro和Gemini 3.1 Pro。 这些是 GlobalGPT 根据自身条款设置的路线,不会影响 xAI 或 Google 官方端点的停用安排。.
在2026年,Grok和Gemini哪个更好?
Grok 4.5 是进行 X-search 和以编码为中心代理式工作的更强起点。Gemini 3.1 Pro Preview 是处理长混合媒体输入和 Google 工具时,文档中记载的更强选项。请根据您自己的验收标准对两者进行测试。.



