Gemini 3.7 Flash

首字毫秒级响应、极速无感;日常代码补全与常规 CRUD 生成利器,性价比无敌。

谷歌最快推理模型图片输入音频输入视频输入

综合分

56

混合价

¥10.8

每百万 tokens

上下文

1.0M

速度

362

tokens/秒

首字延迟

12.75s

能力评分

综合
56

综合分取自 Artificial Analysis 的 Intelligence Index,它是一个综合指数而非百分制,当前榜首约 63 分。 本站取用的是「high」推理档位的数据;同一模型换档位,分数与延迟都会变。

价格明细

项目官方标价
输入$0.75
输出$3.75
缓存命中$0.075
缓存写入
最大输出66K

单位为每百万 tokens。折算后的混合价为 ¥10.8(美元按 1 USD = 7.2 CNY 计,汇率核对于 2026-08-27)。显示为「—」表示厂商未公布该项或不按该方式计费。

适用场景

日常问答批量处理图片理解长文档

优点

  • 输出 362 tokens/s,远高于同榜其他模型
  • 输入 $0.75 / 输出 $3.75
  • 支持音频与视频输入

注意事项

  • 当前价格只到 2026-12-31。2027-01-01 起输入涨到 $1.50、输出涨到 $3.75→$7.50、缓存命中涨到 $0.15,相当于翻倍。
  • Google 不按「缓存写入」收费,而是按缓存存储时长收费($0.50/百万 token/小时,2027 年起涨到 $1.00),这项开销无法体现在单价表里。

📦 该模型推荐编程套餐 (Coding Plans)

查看全量对比
Google One AI Premium (Gemini Advanced)
🌐 官方原厂 · $19.99 / 月 (首月免费)
订阅

Gemini Advanced 体验 Gemini 3.7 / 2.5 Pro 超大 1M 上下文;赠送 2TB Google Drive 空间

高达 100万 Token 超大上下文,可一次性分析大型代码库、长视频与音频
AINode 开发者按量中转专线
🇨🇳 国内直连 · ¥10 起充
订阅

充多少用多少,100% 按真实 Token 计费,无月费,无过期时间限制

专为 Cursor / IDE 程序员打造,不用时不花一分钱
GitHub Copilot 个人版
🌐 官方原厂 · $10 / 月 (年付 $100)
订阅

无限次代码行内智能补全,Copilot Chat 自由切换底层模型

代码补全延迟极低,敲回车即填补逻辑

⚡ 该模型推荐专线中转 (API Gateways)

查看专线天梯
AINode 极速专线
延迟 280ms · 在线率 99.99%
省 87%
¥2.80 / M官方参考 ¥21.8/M
国内双线直连
DuiAPI 聚合
延迟 380ms · 在线率 98.8%
省 82%
¥0.70 / M官方参考 ¥4/M
模型较全
hao.ai 开发者站
延迟 420ms · 在线率 99.2%
省 81%
¥4.08 / M官方参考 ¥21.8/M
海外节点加速

© 2026 Hoxi · 一人公司发展指南 · 善用 AI,一人成军,满心欢喜

GitHub价格与评分均标注来源与更新时间