gemini 2.0 flash输入0.075美元/百万tokens、输出0.40美元,支持100万上下文;pro输入约0.35–0.55美元、输出1.2美元,上下文200万;flash-lite输出0.30美元,性价比更优。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您正在评估将Gemini 2.0系列模型集成至应用或工作流中,费用是关键决策因素。不同版本在输入/输出token定价、上下文长度支持及功能覆盖上存在显著差异。以下是针对Gemini 2.0 Flash与Pro版本的详细价格对比说明:
一、Gemini 2.0 Flash 版本定价结构
Gemini 2.0 Flash 定位为高速、高吞吐、多模态支持的主力推理模型,适用于实时响应场景。其计费按输入和输出token分别核算,不设免费额度限制(除平台级赠送外),且支持联网搜索与原生多模态输入。
1、文本输入费用为每百万tokens 0.075美元。
2、文本输出费用为每百万tokens 0.40美元。
3、图像、音频等多模态输入统一按0.075美元/百万tokens计价,与文本输入同价。
4、该版本上下文窗口为100万个tokens,支持长文档理解与复杂指令链处理。
二、Gemini 2.0 Pro 版本定价结构
Gemini 2.0 Pro 是实验阶段的高性能模型,专为编码、复杂数学推理与高精度多模态任务设计。其定价高于Flash,但提供每日50次免费提问额度,适用于开发者高频调试与小规模验证。
1、输入费用未公开披露具体数值,但根据基准测试成本推算,约为每百万tokens 0.35–0.55美元区间(高于Flash输入价)。
2、输出费用显著更高,实测报价接近每百万tokens 1.2美元,反映其深度推理与代码生成所需的额外计算资源。
3、上下文窗口扩展至200万个tokens,为Flash版本的两倍,直接推高长上下文调用成本。
4、支持原生音视频输入与未来图像生成接口,当前调用需通过Vertex AI Studio或Google AI Studio启用权限。
Gemini Notebook网页版是一款基于AI的智能笔记工具,其核心功能是让用户上传个人文档(如PDF、文本等),并以此为基础进行交互。它能针对你的资料进行总结、解答疑问、生成新内容,让信息处理更高效。该版本为在线使用,无需下载安装。
三、Gemini 2.0 Flash-Lite 的成本锚点作用
Flash-Lite 并非Pro或Flash的子集,而是独立设计的轻量经济型选项,用于拉低整体调用门槛。它在多项指标上形成价格参照系,帮助判断Pro与Flash的溢价是否合理。
1、文本输入费用为每百万tokens 0.075美元,与Flash完全一致。
2、文本输出费用为每百万tokens 0.30美元,比Flash低0.10美元,降幅达25%。
3、多模态输入(图像/音频/视频)同样按0.075美元/百万tokens计价,无额外加成。
4、在Lmarena与LiveCodeBench v5等权威榜单中,其性能超越Gemini 1.5 Flash,而价格维持不变,构成事实上的性价比基准线。
四、实际调用成本影响因子
除基础token单价外,多个隐性参数会实质性改变单次调用支出。这些因子在Pro与Flash间表现不一,需在API请求前显式控制。
1、启用联网搜索功能会使Flash版本每次调用额外产生固定0.01美元附加费,Pro版本未开放该功能计费细则。
2、上下文缓存(Context Caching)在Flash-Lite中成本不足Flash版本的1/9,若高频复用相同上下文,Lite可大幅摊薄平均成本。
3、Flash版本在SimpleQA测试中得分为29.9%,而Pro达44.3%;若任务对准确率敏感,Pro虽贵但可能降低重试次数,间接节省总支出。
4、T3 Chat平台当前提供Flash与Flash-Lite的免密白嫖通道,不计入Google Cloud账单,适合快速原型验证。










