跳转到主要内容
ModelPriceLab

搜索模型价格

按模型、厂商或平台查找可核验费率。

模型服务/Gemini 3.7 Flash vs Inkling Small
Google AI
t

Gemini 3.7 Flash vs Inkling Small

2026 最新官方价格记录与示例 Token 成本对比

Gemini 3.7 Flash

历史 / 过时版本

历史 / 过时版本:同系列已有更新型号。此版本仍可能通过官方或第三方渠道调用;不代表已停服。

替代型号参考:gemini-3.8-flash
示例价格差异
Inkling Small 低约 54%
按 100 万输入 + 20 万输出 tokens;不等于月账单
📌 核心结论 (TL;DR):在标准 100 万输入 + 20 万输出 Token 测算基准下,Inkling Small 比 Gemini 3.7 Flash 挂牌费率低约 54%。对于大规模批处理或高并发场景,Inkling Small 具备更强的单位经济效益;实际落地前建议结合真实 Prompt 长度在下方计算器中精准建模。(价格记录最近更新 2026-10-11(UTC))
💡 1000 万 Token 中型业务用量月度账单测算

按典型中型生产用量(1000 万输入 + 200 万输出 Tokens)测算:Gemini 3.7 Flash 预计挂牌花费约 $15.00,Inkling Small 约 $6.90。切换至 Inkling Small 每月预计节省 $8.10。实际账单受 Prompt 缓存率与突发并发影响。

自定义真实用量 →
对比维度
Gemini 3.7 Flash (Google AI)
Inkling Small (thinkingmachines)
输入挂牌价
$0.75 / 1M Tokens
$0.45 / 1M Tokens
输出挂牌价
$3.75 / 1M Tokens
$1.20 / 1M Tokens
Prompt 缓存输入价
$0.08 / 1M Tokens
$0.10 / 1M Tokens
上下文窗口
1049K Tokens
524K Tokens
支持模态
llm
llm

🏆相关业务场景模型天梯榜

根据编辑推荐、公开方案采用度与挂牌价格信号的决策加权,查看模型在各个生产场景下的综合定位。

要把公开价格换算成你的实际业务用量?

用免费估算工具输入 Token 用量,得到方向性成本对比;实际迁移前仍需验证质量、延迟和厂商条款。