Gemini 1.5 Pro:完整规格、定价、API 接入与应用场景(2026)
什么是 Gemini 1.5 Pro?
Gemini 1.5 Pro 是 Google DeepMind 推出的中型多模态大语言模型,于 2024年2月15日开启早期测试,具备历史性的 200 万 token 最大上下文窗口和多模态理解能力。截至 2026年6月,该已退役模型暂无 Gemini API 定价。Google 最初宣布 Gemini 1.5 Pro 为 Gemini 1.5 系列首个开放早期测试的模型,标准上下文窗口为 12.8 万 token,私有预览窗口为 100 万 token;随后,Google 于 2024年6月27日将 200 万 token 上下文窗口全面开放给 Gemini 1.5 Pro 用户。
Gemini 1.5 Pro 的重要意义在于推动了长上下文多模态工作流的实际应用,包括长文档分析、视频理解、大型代码库审查和多文件推理。当前,该模型主要作为历史和迁移参考存在,因为 Google Cloud 的模型生命周期文档已将 gemini-1.5-pro-001 和 gemini-1.5-pro-002 列为退役版本。
Gemini 1.5 Pro 的主要参数与定价
| 字段 | Gemini 1.5 Pro 取值 |
|---|---|
| 提供方 | Google DeepMind / Google(截至 2026年6月) |
| 模型系列 | Gemini 1.5(截至 2026年6月) |
| 模型类型 | 采用专家混合(Mixture-of-Experts)架构的多模态大语言模型(截至 2026年6月) |
| 发布时间 | 2024年2月15日宣布早期测试;gemini-1.5-pro-001 于 2024年5月23日 GA(截至 2026年6月) |
| 上下文窗口 | Gemini 1.5 Pro 历史最大 200 万 token;最初公告为 12.8 万标准窗口和 100 万私有预览(截至 2026年6月) |
| 输入定价 | 由于 Gemini 1.5 Pro 已退役,当前 Gemini API 无相关定价(截至 2026年6月) |
| 缓存输入定价 | 曾为 Gemini 1.5 Pro 和 1.5 Flash 推出历史上下文缓存;退役后无当前缓存定价(截至 2026年6月) |
| 输出定价 | 由于 Gemini 1.5 Pro 已退役,当前 Gemini API 无相关定价(截至 2026年6月) |
| 计价单位 | 退役后 Gemini 1.5 Pro 端点不适用现行官方计价单位(截至 2026年6月) |
| 支持模态 | 历史上支持文本、代码、图片、音频、视频及文档类输入;文本输出(截至 2026年6月) |
| 支持输入类型 | 在可用期间,通过 Gemini API 支持文本、代码、图片、视频、音频、PDF/文档输入(截至 2026年6月) |
| 支持输出类型 | 文本输出;Gemini API 工作流中曾支持结构化输出,但退役端点当前不适用(截至 2026年6月) |
| API 访问 | 曾通过 Google AI Studio、Gemini API、Vertex AI 提供访问;现已退役(截至 2026年6月) |
| 模型 ID | gemini-1.5-pro-001,gemini-1.5-pro-002;已退役(截至 2026年6月) |
| 可用性 | 已退役;不建议新生产环境使用(截至 2026年6月) |
| 知识截止时间 | 官方渠道截至 2026年6月未确认。 |
| 速率限制 | 2024年9月付费档历史限额提升至 1,000 RPM;退役后当前限额不适用(截至 2026年6月) |
| 微调支持 | 官方渠道截至 2026年6月未确认 Gemini 1.5 Pro 是否支持微调。 |
| 流式输出支持 | Gemini API 通常支持流式输出,但 Gemini 1.5 Pro 端点退役后不适用(截至 2026年6月)。 |
| 批量 API 支持 | 退役后 Gemini 1.5 Pro 端点不适用(截至 2026年6月)。 |
| 工具/函数调用 | Gemini API 于 2024年5月引入并行函数调用,但退役后 Gemini 1.5 Pro 端点不适用(截至 2026年6月)。 |
| 结构化输出/JSON 模式 | 由于模型已退役,当前 Gemini 1.5 Pro 端点未确认支持(截至 2026年6月)。 |
| 许可/使用限制 | 历史上受 Google Gemini API/Google Cloud 条款约束;当前端点已退役(截至 2026年6月)。 |
Gemini 1.5 Pro 在生产环境中的价值体现
Gemini 1.5 Pro 在长上下文分析方面表现突出,能够处理超大规模输入,包括长文本、大型代码库及多媒体内容。Google 举例说明,该模型可处理 1 小时视频、11 小时音频、大型代码库及单次上下文中数十万字内容,这使其在文档审查、研究整合和代码仓库分析等场景中极具价值。
此外,Gemini 1.5 Pro 具备多模态理解能力。Google 展示的案例包括视频推理、长 PDF 处理、图片描述、目标检测及视觉内容结构化抽取等。这些能力使其适用于融合文本、视觉证据和文档版式信息的多模态工作流。
然而,在生产规划中,团队应将 Gemini 1.5 Pro 视为历史参考,而非默认选项。开发者在对比长上下文模型或统一模型路由时,应将模型能力与生命周期风险分开考虑,因为不可用的模型无法作为新生产系统的可靠基础。
Gemini 1.5 Pro 支持哪些模态?
| 模态类型 | 是否支持 | 说明 |
|---|---|---|
| 文本输入 | 历史支持 | 用于长文本提示、文档正文及一般指令。 |
| 代码输入 | 历史支持 | Google 曾举例支持大型代码库推理。 |
| 图片输入 | 历史支持 | 用于图片描述、视觉推理、目标检测及信息抽取。 |
| 音频输入 | 历史支持 | Google 曾举例支持处理最长 11 小时音频。 |
| 视频输入 | 历史支持 | Google 曾举例支持视频理解及长视频处理。 |
| PDF/文档输入 | 历史支持 | Google 曾举例支持处理 1,000 页 PDF 及文档推理。 |
| 音频输出 | 未确认 | 公开资料未显示 Gemini 1.5 Pro 原生支持语音输出。 |
| 图片/视频输出 | 未确认 | 该模型为多模态理解模型,未确认具备图片/视频生成能力。 |
Gemini 1.5 Pro 的主要局限
首要局限是生命周期。Google Cloud 文档已将 Gemini 1.5 Pro 列为退役模型,意味着新系统不应依赖其 API 访问、定价、速率限制或技术支持。
第二个局限是极大上下文下的成本与延迟。Google 在模型发布时曾指出,超长上下文可能导致延迟增加,后续推出上下文缓存以降低重复 token 任务的成本。
第三个局限是通用 AI 可靠性。这是所有 AI 的通用限制,除非厂商有特别说明:输出结果可能出现幻觉、上下文缺失或错误解释,尤其在法律、医疗、金融或安全关键任务中更需专家复核。
Gemini 1.5 Pro 最适合哪些场景?
| 应用场景 | Gemini 1.5 Pro 的适用原因 | 重要限制说明 |
|---|---|---|
| 历史模型参考 | 有助于理解长上下文多模态 AI 的发展演变。 | 退役端点限制了当前生产环境应用。 |
| 长文档分析设计 | 其 200 万 token 上下文窗口影响了大文档工作流的设计预期。 | 部署时应选用当前支持的模型。 |
| 多模态工作流规划 | 展示了文本、代码、图片、音频、视频、PDF 的理解能力。 | 历史能力不代表当前 API 可用性。 |
| 模型迁移审计 | 有助于团队识别遗留 gemini-1.5-pro-* 依赖。 | 当前迁移目标需以最新 Google 文档为准。 |
| 竞品对比 | 对比历史长上下文系统与Gemini 2.0 Flash、GPT-4o或Claude 3.5 Sonnet等新模型。 | 对比时需关注当前可用性,而非仅历史参数。 |
Gemini 1.5 Pro 与 GPT-4o、Claude 3.5 Sonnet 对比
| 对比维度 | Gemini 1.5 Pro | GPT-4o | Claude 3.5 Sonnet | 场景适配建议 |
|---|---|---|---|---|
| 提供方 | Google DeepMind / Google | OpenAI | Anthropic | 按实际可访问性和合规需求选择 |
| 生命周期状态 | 截至 2026年6月 Gemini 1.5 Pro 版本已退役 | 需当前 OpenAI 验证 | 需当前 Anthropic 验证 | Gemini 1.5 Pro 主要作为历史对比参考 |
| 上下文窗口 | 历史最大 200 万 token | 未经当前官方渠道核实,此处不做对比 | 未经当前官方渠道核实,此处不做对比 | Gemini 1.5 Pro 适合长上下文历史对比 |
| 模态能力 | 历史上支持文本、代码、图片、音频、视频、文档等多模态输入 | 常用于多模态工作流对比,需查阅最新官方信息 | 常用于写作、编程、分析等场景对比,需查阅最新官方信息 | 生产选型前应优先查阅最新官方文档 |
| API 访问 | 历史 Gemini API/Google AI Studio/Vertex AI,现已退役 | 详见 OpenAI 官方文档或内部GPT-4o 模型资料 | 详见 Anthropic 官方文档或内部 Claude 参考资料 | 生产决策应优先选择活跃支持的端点 |
本对比仅供参考,不评选“最佳”模型。对于 2026 年的 Gemini 1.5 Pro,生命周期状态远比能力本身更关键。
如何访问 Gemini 1.5 Pro?
截至 2026年6月,Gemini 1.5 Pro 应视为 API 访问已退役。Google Cloud 模型生命周期文档显示,gemini-1.5-pro-001 于 2025年5月24日退役,gemini-1.5-pro-002 于 2025年9月24日退役;Google Vertex AI 发布说明也指出,Gemini 1.5 模型访问已于 2025年9月24日终止。
因此,本文未提供 Gemini 1.5 Pro 的 Python 或 curl 可执行示例。为退役端点提供代码示例可能误导开发者依赖已不可用的模型 ID。团队如有遗留 gemini-1.5-pro 相关引用,应及时核查 Google 的最新迁移路径,并将退役模型 ID 替换为当前支持的模型。
常见问题解答
Gemini 1.5 Pro 的上下文窗口是多少?
Gemini 1.5 Pro 最初发布时,标准上下文窗口为 12.8 万 token,私有预览为 100 万 token。2024年6月,Google 将 200 万 token 上下文窗口全面开放。
Gemini 1.5 Pro 的费用是多少?
截至 2026年6月,Gemini 1.5 Pro 已退役,无当前 Gemini API 定价。2024 年期间曾有历史定价变动,生产环境应以当前支持模型的定价为准。
还能通过 API 使用 Gemini 1.5 Pro 吗?
Google Cloud 文档已将 gemini-1.5-pro-001 和 gemini-1.5-pro-002 标记为退役。新生产系统不应依赖 Gemini 1.5 Pro API 访问。
Gemini 1.5 Pro 被什么模型替代?
Google 生命周期文档建议在 Gemini 1.5 Pro 退役后选用更新的 Gemini 系列模型。具体替代方案取决于 API 类型、地区、模态和当前 Google 模型可用性。


