跳转到主要内容
ModelPriceLab

搜索模型价格

按模型、厂商或平台查找可核验费率。

模型服务/Llama 3.3 70B Instruct (US) vs Gemini 3.7 Flash
AWS Bedrock
Google AI

Llama 3.3 70B Instruct (US) vs Gemini 3.7 Flash

2026 最新官方价格记录与示例 Token 成本对比

Gemini 3.7 Flash

历史 / 过时版本

历史 / 过时版本:同系列已有更新型号。此版本仍可能通过官方或第三方渠道调用;不代表已停服。

示例价格差异
Llama 3.3 70B Instruct (US) 低约 42%
按 100 万输入 + 20 万输出 tokens;不等于月账单
📌 核心结论 (TL;DR):在标准 100 万输入 + 20 万输出 Token 测算基准下,Llama 3.3 70B Instruct (US) 比 Gemini 3.7 Flash 挂牌费率低约 42%。对于大规模批处理或高并发场景,Llama 3.3 70B Instruct (US) 具备更强的单位经济效益;实际落地前建议结合真实 Prompt 长度在下方计算器中精准建模。
💡 1000 万 Token 中型业务用量月度账单测算

按典型中型生产用量(1000 万输入 + 200 万输出 Tokens)测算:Llama 3.3 70B Instruct (US) 预计挂牌花费约 $8.64,Gemini 3.7 Flash 约 $15.00。切换至 Llama 3.3 70B Instruct (US) 每月预计节省 $6.36。实际账单受 Prompt 缓存率与突发并发影响。

自定义真实用量 →
对比维度
Llama 3.3 70B Instruct (US) (AWS Bedrock)
Gemini 3.7 Flash (Google AI)
输入挂牌价
$0.72 / 1M Tokens
$0.75 / 1M Tokens
输出挂牌价
$0.72 / 1M Tokens
$3.75 / 1M Tokens
Prompt 缓存输入价
—
$0.08 / 1M Tokens
上下文窗口
128K Tokens
1049K Tokens
支持模态
llm
llm

🏆相关业务场景模型天梯榜

根据编辑推荐、公开方案采用度与挂牌价格信号的决策加权,查看模型在各个生产场景下的综合定位。

要把公开价格换算成你的实际业务用量?

用免费估算工具输入 Token 用量,得到方向性成本对比;实际迁移前仍需验证质量、延迟和厂商条款。