GLM 5.3 Flash API 价格
智谱AI · 17 家渠道报价 · 数据快照 2026-08-29
截至 2026-08-29,GLM 5.3 Flash 的 API 调用价在本站跟踪的 17 家渠道里, 最低混合单价 ¥0.800 / 百万 Tokens,由 Novita AI 给出;智谱AI 官方定价为输入 ¥0.505、输出 ¥1.69 每百万 Tokens。 同一模型最贵渠道(FriendliAI ¥1.60)与最低价之间相差 2.0 倍,选型时值得逐个核对。
| # | 平台 | 地区 | 输入 ¥/M | 输出 ¥/M | 混合 ¥/M | vs 官方 | 价格带 |
|---|---|---|---|---|---|---|---|
| 1 | Novita AInovita.ai | 海外 | ¥0.505 | ¥1.69 | ¥0.800最低 | 1.00× | |
| 2 | GMICloudgmi.cloud | 国内 | ¥0.505 | ¥1.69 | ¥0.800 | 1.00× | |
| 3 | 智谱 Z.AIz.ai | 国内 | ¥0.505 | ¥1.69 | ¥0.800 | 1.00× | |
| 4 | OpenRouteropenrouter.ai | 海外 | ¥0.505 | ¥1.69 | ¥0.800 | 1.00× | |
| 5 | Makoramakora.ai | 海外 | ¥0.944 | ¥3.17 | ¥1.50 | 1.87× | |
| 6 | Modalmodal.com | 海外 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× | |
| 7 | DeepInfradeepinfra.com | 海外 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× | |
| 8 | Parasailparasail.io | 海外 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× | |
| 9 | Phala Cloudphala.cloud | 海外 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× | |
| 10 | DigitalOceandigitalocean.com | 海外 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× | |
| 11 | 硅基流动cloud.siliconflow.cn | 国内 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× | |
| 12 | Venice AIvenice.ai | 海外 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× | |
| 13 | Together AItogether.ai | 海外 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× | |
| 14 | BaseTenbaseten.co | 海外 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× | |
| 15 | Cloudflare Workers AIcloudflare.com | 海外 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× | |
| 16 | Morphmorphllm.com | 海外 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× | |
| 17 | FriendliAIfriendli.ai | 海外 | ¥1.01 | ¥3.37 | ¥1.60 | 2.00× |
本平台说明与数据来源
Novita AI(海外):海外 GPU 云 + API · 来源
GMICloud(国内):国富云,主打低价开源模型 · 来源
智谱 Z.AI(国内):GLM 官方 · 来源
OpenRouter(海外):聚合路由标杆:推理 pass-through 零加价,成本在充值手续费(信用卡 5.5%);下表为各供应商最低报价,Batch 5 折 · 来源
Makora(海外):推理聚合 · 来源
Modal(海外):Serverless GPU · 来源
DeepInfra(海外):海外推理云,开源模型低价档 · 来源
Parasail(海外):去中心化推理 · 来源
Phala Cloud(海外):TEE 隐私推理 · 来源
DigitalOcean(海外):Gradient AI 平台 · 来源
硅基流动(国内):国内模型云,OpenRouter 海外节点报价 · 来源
Venice AI(海外):无审查推理平台 · 来源
Together AI(海外):海外推理云,PTU 预留吞吐 · 来源
BaseTen(海外):高吞吐推理 · 来源
Cloudflare Workers AI(海外):边缘推理 · 来源
Morph(海外):高速推理 · 来源
FriendliAI(海外):低延迟推理 · 来源
按用量估算月成本
下表用全网最低混合价 ¥0.800 / 百万 Tokens 估算,假设输入与输出按本站混合口径(输入 3 : 输出 1)分布。 真实成本还取决于你的上下文长度、是否命中缓存计费、以及是否有批量折扣,这里只给量级感。
| 场景 | 月 Tokens 用量 | 按最低混合价 | 按官方混合价 |
|---|---|---|---|
| 轻度试用 | 100 万 | ¥0.80 | ¥0.80 |
| 日常开发 | 1,000 万 | ¥8.00 | ¥8.00 |
| 小规模上线 | 10,000 万 | ¥80.04 | ¥80.04 |
| 生产级调用 | 100,000 万 | ¥800 | ¥800 |
看价格时还要核对什么
第一是缓存与批量口径。部分渠道展示的输入价已经含 prompt cache 命中价或 Batch 折扣, 与标准实时价不是同一档,横向对比时要以同一口径为准;表中每一行的来源都可在下方展开查看。 第二是币种与汇率。海外渠道按美元原价乘以 6.74 折算, 实际支付时你的通道可能有额外手续费。第三是免费与限流额度, 低单价渠道常伴随更低的 RPM/TPM 上限,压测阶段的实际可用吞吐可能低于标价隐含的能力。