SiliconFlow vs 官方价格对照:旗舰同价、红利在 Flash 和 Qwen3 小模型
TL;DR:用了 40 分钟梳理了 SiliconFlow(SF)和各家官方提供商的当前价格,发现一个反常识的结论:旗舰模型在 SF 和官方基本同价,便宜和更贵的都集中在少数模型上。真正的价差红利在 DeepSeek-V4-Flash 和 Qwen3 中小模型;要省更多,得盯着官方平台的闲时段、限时折扣和免费额度。
一、一个被普遍误解的"常识"
很多人(包括之前的我)有个直觉:聚合 API 一定比官方便宜。毕竟少了一层中间商,规模化采购有议价权。
但把 SiliconFlow(cloud.siliconflow.cn)当前的公开价与各官方平台一一对比之后,这个直觉被打破了。
我用 40 分钟抓了 SF 的公开价,再对照各家官方平台当前公开的按量价/闲时价/折扣信息,得出了本文的核心结论:不是普遍便宜,主流旗舰是"与官方同价对齐",便宜和更贵的都集中在少数模型上。
具体来说有 5 类情况。
二、5 类典型情况:把价差讲清楚
1. 同价对齐(SF = 官方直售价)
下面这些模型在 SF 调用并不省钱,SF 的价值是统一 API、免多家开户:
| 模型 | 输入 / 输出(¥/百万 tokens) | 备注 |
|---|---|---|
| Kimi-K2.7-Code | 6.50 / 27.00 | SF 与官方直售价完全一致 |
| Kimi-K2.6 (Pro) | 6.50 / 27.00 | 同上 |
| MiniMax-M2.5 | 2.10 / 8.40 | 缓存 0.21,两边同价 |
| Qwen3.5 开源全系(397B/122B/27B/35B) | ≤128k 分档都一样 | 128k 切档后两边同步 |
| GLM-5.2 | 8.00 / 28.00 | 缓存 2.00 |
| Step-3.5-Flash | 同官方 | — |
| LongCat-2.0(原价口径) | 5.00 / 20.00 | 但官方有折扣,见下文 |
这些模型在 SF 调用并不省钱。SF 的价值是统一 API 格式、免多家开户、Pro 专属实例同价。
2. SF 明显更便宜(重点关注)
这一类是真正能省钱的:
DeepSeek-V4-Flash(最大的一处价差):
| 渠道 | 输入 | 输出 | 缓存命中 |
|---|---|---|---|
| SF | ¥1.00 | ¥2.00 | ¥0.02 |
| 官方高峰 | ¥3.00 | ¥9.00 | ¥0.10 |
| 官方闲时 | ¥1.50 | ¥4.50 | ¥0.07 |
SF 约为官方高峰价的1/3 到 1/4.5,即使按官方闲时也便宜一半。这是整个对照表里最大的一处价差——日常调用 DeepSeek-V4-Flash 应该优先 SF**。
Qwen3 中小开源模型(SF 也很划算):
| 模型 | SF | 官方 |
|---|---|---|
| Qwen3-32B | ¥1 / ¥4 | ¥2 / ¥8 |
| Qwen3-14B | ¥0.5 / ¥2 | ¥1 / ¥4 |
| Qwen3-8B | 免费 | ¥0.5 / ¥2 |
| Qwen3-30B-A3B | ¥0.7 / ¥2.8 | ¥0.75 / ¥3 |
8B 模型直接免费用!14B/32B 也几乎是半价。中小模型场景下 SF 的优势非常明显。
3. SF 更贵(反向警惕)
有些模型在 SF 上反而更贵,需要注意:
DeepSeek-V4-Pro:
| 渠道 | 输入 | 输出 | 缓存 |
|---|---|---|---|
| SF | ¥12 | ¥24 | ¥1.00 |
| 官方高峰 | ¥9 | ¥27 | ¥0.30 |
| 官方闲时 | ¥4.5 | ¥13.5 | ¥0.15 |
输入贵 33%,缓存贵 3 倍+。只有输出略便宜。如果业务重度用缓存或可闲时调用,官方明显更划算。
其他 SF 更贵的模型:
- GLM-4.5-Air:SF ¥1/¥6 vs 官方 ¥0.8/¥2,输出贵 3 倍
- Hunyuan-A13B-Instruct:SF 高峰 ¥1/¥4、闲时 ¥0.8/¥3.2 vs 官方 ¥0.5/¥2,贵约 60-100%
- LongCat-2.0:SF 按官方原价 ¥5/¥20 卖,但官方正在执行限时折扣 ¥2/¥8,便宜 60%
- GLM-5.1 (Pro):≤32k 档与官方同价,但≥32k 档 ¥8/¥28比官方统一 ¥6/¥24 贵,缓存 ¥1.3-2.0 vs 官方 ¥0.5
- GLM-4.5V:SF ¥1/¥6 vs 官方旧价 ¥2/¥6 输入便宜一半,但官方已被 GLM-4.6V 降价到 ¥1/¥3 取代
4. SF 独有 / 不可比
官方已下架但 SF 仍可用的老模型:DeepSeek-V3.2 / V3.1-Terminus / R1 / V3 系列、Ling-2.0 系列。
官方根本没有按量 API 的:Seed-OSS-36B(字节只给 GPU 自部署)、Hunyuan-MT-7B、PaddleOCR-VL、大量免费 Embedding/Reranker(bge 系、Qwen3-Embedding/Reranker 全家)。
这些场景下SF 是唯一选项,**。
5. 生图 / 视频
| 类型 | SF | 官方 |
|---|---|---|
| Qwen-Image | ¥0.30/张 | ¥0.25/张(SF 略贵) |
| Qwen-Image-Edit | ¥0.30/张 | ¥0.30/张(同价) |
| Wan2.2 | ¥2/个 | 按秒(¥0.14-0.7/秒) |
Wan2.2 5 秒 480P 官方约 ¥0.7 更便宜,1080P 反而贵,量级相当但口径不同。
三、选型决策矩阵
把上面的分析浓缩成一份速查表,按业务场景给出建议:
| 需求 | 更优渠道 | 原因 |
|---|---|---|
| DeepSeek-V4-Flash 日常调用 | SF | 约官方高峰 1/3 价 |
| DeepSeek-V4-Pro / 重缓存 / 可闲时 | 官方 | 高峰输入更便宜,闲时再半价 |
| Kimi K2.7 / K2.6、MiniMax-M2.5、Qwen3.5 开源旗舰、GLM-5.2 | 两边同价 | 按方便程度选 |
| Qwen3-32B/14B/8B 小模型 | SF | 半价或免费 |
| LongCat-2.0 | 官方限时折扣 | 约为 SF 的 40% |
| Hunyuan-A13B、GLM-4.5-Air | 官方 | SF 贵 60-300% |
| 已下架老模型、Seed-OSS-36B、免费 Embedding | SF | 官方不可用或无 API |
四、几个隐藏成本容易被忽略
只看按量价会遗漏几个关键成本项:
- 闲时段:很多官方平台(DeepSeek、GLM、MiniMax)都有闲时半价窗口(一般是凌晨或非工作时段)。如果你的批量任务可以错峰调度,能再砍一半成本
- 限时折扣:LongCat-2.0 当前官方有 ¥2/¥8 的限时折扣(约为 SF 的 40%),这种促销 SF 不会跟进
- 免费额度:LongCat 每日 5500 万 token、蚂蚁每日 50 万 token 等官方高额免费额度,SF 同样不跟
- 缓存命中价:DeepSeek-V4-Pro 在官方的缓存价是 ¥0.30,SF 是 ¥1.00——重度用缓存的业务,渠道选择影响巨大
这些"软成本"加起来,对总账单的冲击往往超过"按量价差"本身。
五、所以,到底该怎么选?
把上面的所有分析总结成三条原则:
原则 1:旗舰看方便,不看价差
Kimi K2.7、MiniMax-M2.5、Qwen3.5、GLM-5.2 这些旗舰模型在 SF 和官方同价,选哪个纯粹看你的运维偏好——SF 是统一 API 不用到处开户;官方可能有更强的 SLA 和免费的额度。
原则 2:DeepSeek-V4-Flash 选 SF,V4-Pro 选官方
这是对照表里价差最大的一组:Flash 选 SF 便宜 1/3 到 1/4.5;Pro 在 SF 上反而贵(尤其缓存)。
原则 3:把官方当成"促销购物车"
官方平台的闲时段、限时折扣、免费额度是聚合 API 学不来的"羊毛"。如果业务可以错峰调度或接受限时模型切换,把官方当主渠道、SF 当 backup 是更优策略。
六、一句话总结
SiliconFlow 的定价策略是旗舰模型跟随官方价、靠聚合与免费/Pro 档做差异化,真正的价差红利在DeepSeek-V4-Flash和Qwen3 中小模型;要省更多,得盯着各官方平台的闲时、限时折扣和免费额度,这些 SF 都不跟。
下次有人跟你说"SF 一定比官方便宜",你可以把这份对照表甩过去——他会发现没那么简单。
附录:怎么自己核价
如果你想自己核一遍当前价格:
- SF 价格中心:https://cloud.siliconflow.cn/me/models
- 各官方价格页:
- DeepSeek:https://api-docs.deepseek.com/quick_start/pricing
- 智谱 GLM:https://open.bigmodel.cn/pricing
- Kimi/Moonshot:https://platform.moonshot.cn/docs/pricing/chat
- 阿里 Qwen:https://help.aliyun.com/zh/model-studio/getting-started/models
- LongCat 美团:https://longcat.chat/platform
- 检查项:输入价、输出价、缓存命中价、是否有闲时段、是否有免费额度、是否有限时折扣
价差这件事每季度都会变,建议每 3 个月重新核一次。
关于本文:这份对照表是我在为团队做 LLM 选型时的工作笔记,整理成文时已根据截至 2026-08-29 的公开价核对。具体到你的业务场景,建议结合实际调用量、错峰能力、缓存命中率再做精细测算。