硅基流动 SiliconFlow 怎么样?测评与对比
国产开源大模型云服务,DeepSeek/Qwen/GLM 等 100+ 模型,自研推理引擎+国产芯片适配
最后核实日期:2026-08-11 · 访问官网 →
硅基流动不是中转站
这个区分很重要。
普通中转站的运作逻辑:批量采购 OpenAI/Anthropic 官方账号,然后以低于官方的汇率转售给国内用户。平台本身不持有模型权重。
硅基流动(SiliconFlow)的运作逻辑完全不同:它直接托管开源模型权重,自研推理引擎(已适配国产昇腾芯片),本身就是 DeepSeek、Qwen、Kimi K2 等模型的云端运行方之一。
这意味着:没有”降智”风险(没有官方账号限流这回事);没有中间层的额外加价;模型版本更新与官方开源发布几乎同步。代价是:没有 GPT/Claude/Gemini 等闭源商业模型。
价格详解
硅基流动的定价在同类平台中属于地板级别,部分小参数模型永久免费,主力模型也以极低价格提供服务。根据 2026 年 8 月官网数据,主要模型参考价格如下(实际价格以官网实时价格为准):
| 模型 | 输入价格(/M tokens) | 输出价格(/M tokens) | 直连 |
|---|---|---|---|
| DeepSeek-V4-Flash | ¥1.00 | ¥2.00(缓存 ¥0.02) | ✓ |
| DeepSeek-V4-Pro | ¥12.00 | ¥24.00(缓存 ¥1.00) | ✓ |
| Qwen3.5-397B-A17B | ¥1.20 | ¥7.20 | ✓ |
| Qwen2.5-7B(免费) | ¥0 | ¥0 | ✓ |
| Kimi-K2.7-Code | ¥6.50 | ¥27.00(缓存 ¥1.30) | ✓ |
| GLM-5.2 | ¥8.00 | ¥28.00(缓存 ¥2.00) | ✓ |
| MiniMax-M2.5 | ¥2.10 | ¥8.40(缓存 ¥0.21) | ✓ |
以 DeepSeek-V4-Flash 为例,输入每百万 tokens 约 ¥1.00、输出约 ¥2.00,在同类平台中仍属低价。与之对比,Anthropic 官方 Claude Sonnet 4.6 的价格为 $3/$15 每百万 tokens(输入/输出),折合人民币约 ¥21.6/¥108——硅基流动的主打国产开源模型价格比闭源旗舰低了 1-2 个数量级。
需要注意的是,硅基流动不提供 GPT/Claude/Gemini 等闭源商业模型,如果你的场景必须用 Claude Code 或 GPT-5.5,需另找中转站。
模型覆盖与实测
硅基流动目前上架了 150+ 开源模型,涵盖:
- DeepSeek 系列:DeepSeek-V3.2、DeepSeek-V4-Flash、DeepSeek-V4-Pro、DeepSeek-R1 系列等,更新速度与官方几乎同步。
- Qwen 系列:Qwen3-235B-A22B、Qwen3-30B-A3B、Qwen2.5-7B(免费)等通义千问全系。
- GLM/InternLM:智谱 GLM 系列、书生 InternLM 系列。
- Kimi K2 Instruct:2026 年新上线的月之暗面 Kimi K2 模型。
- MiniMax M3:MiniMax 旗下最新旗舰模型。
由于硅基流动专注于开源模型,没有 GPT-5.5、Claude Fable 5、Gemini 3.5 等闭源旗舰。部分评测显示,硅基流动的国产芯片(昇腾)适配性较好,推理性能已比肩主流 GPU 水准。无降智风险(因为是直接托管开源权重,没有官方账号限流问题)。
使用体验
注册流程:访问 siliconflow.cn,邮箱注册即可使用;完成实名认证后在「活动中心→认证专享礼」领取 16 元全平台通用代金券。注意:自 2026-05-15 起,未实名认证账户无法使用平台功能。整个流程 3-5 分钟。
充值方式:支持支付宝、微信支付,人民币结算,无最低充值金额限制(但建议充值 ¥10 以上以获得完整功能)。
API Key 获取:登录后在控制台”API 密钥”页面直接生成,支持 OpenAI 兼容格式(https://api.siliconflow.cn/v1),5 分钟内可完成从注册到第一次 API 调用。
Dashboard 功能:提供用量统计、费用明细、模型调用记录,功能相对简洁,够用但不如部分企业级平台详尽。
邀请返利:公开「推荐官」双边返利机制(活动 2026-01-15 至 2026-12-31):成为推荐官后,每成功邀请一位新用户完成注册+实名认证,双方各得 16 元通用代金券,无需联系商务,可直接在控制台查看邀请链接。
稳定性与延迟
硅基流动服务器部署于国内,无需代理/VPN,对国内开发者友好。根据用户实测反馈,生成 500 字内容约需 7 秒左右(DeepSeek-V3 系列),对比官方 API 节省了跨境网络时间。
官方未公开统一的延迟数字或 SLA 承诺,但基于国内直连优势,实际延迟通常优于需要代理的海外中转站。平台目前未发现大规模停运事件,个人开发者用户反馈稳定性良好。
速率限制方面,免费模型有一定 QPS 上限(具体以官网实时配置为准),付费模型的速率限制相对宽松,高并发场景建议联系官方确认。
适合人群
- 国产开源模型的重度用户:DeepSeek、Qwen、Kimi 等模型的主力使用场景,成本比任何闭源中转站都低得多。
- vibe coding 个人开发者:低成本验证产品原型,14 元赠金就能跑不少测试。
- 需要国内直连的场景:服务器在国内、不想为 API 调用单独配代理的项目。
- 需要备用模型池的团队:以开源模型作为 Claude/GPT 之外的降级备选,成本优势显著。
不适合:需要 GPT-5.5 / Claude Code / Gemini 等闭源旗舰模型的场景。
竞品对比
与同类国产平台相比:
- vs. 147API:147API 覆盖 OpenAI/Claude/Gemini 等闭源模型,但价格通常高于硅基流动的开源模型价格;如果你只用开源模型,硅基流动更便宜。
- vs. 302.AI:302.AI 支持闭源旗舰模型(GPT/Claude/Gemini)且余额永久有效,价格接近官方定价;如果需要一站式访问多种闭源模型,302.AI 更合适。
核心区别:硅基流动=开源模型的地板价,302.AI / 147API = 闭源模型的便利通道。
总结
硅基流动是国产开源大模型 API 的首选平台之一,价格极具竞争力(部分模型免费),国内直连无需代理,注册体验友好。唯一局限是不覆盖 GPT/Claude 等闭源旗舰——如果你的场景必须用闭源模型,则需要与其他中转站配合使用。对于主力使用 DeepSeek、Qwen 等国产开源模型的开发者,强烈推荐作为主力平台。
需要同时调用 Claude 且希望以免费额度做集成测试,AiHubMix 的永久免费测试层 + Prompt Caching 支持可作为硅基流动的闭源侧补充。如果连低价区间都嫌贵、想把 API 探索成本降到最低,云雾 API(0.5¥/USD + GitHub 每日免费额度)是更激进的低价备选。
体验/优惠信息以硅基流动官网最新页面为准,本文信息核实日期:2026-08-11。
相关推荐
- AICloud飞云:每日赠50次Sonnet免费调用,Claude低价直连
- Boxying:轻量简洁国内中转,主流模型,快速上手
- Lumin AI:2026年新站,¥5低门槛,Kiro接口¥2/10M token
- DMXAPI:480+模型多模态聚合,文本/图像/视频一站覆盖,企业级稳定性
快速信息卡
| 定价模式 | 按量计费,全网最低价宣称;实名认证后在「活动中心→认证专享礼」领 1 张 16 元全平台通用代金券;「推荐官」邀请好友完成注册+实名认证,双方各得 16 元(活动至 2026-12-31) |
|---|---|
| 模型覆盖 | 100+ 开源模型,覆盖 DeepSeek、Qwen、GLM、InternLM 等国产主流开源大模型,部分模型免费调用 |
| 延迟/SLA | 国内服务器直连,无跨境网络损耗;官方未公开具体延迟数字 |
| 国内直连 | 国内直连,无需代理/VPN |
| 适用场景 | 开发者 / 灰度/备用 |
| 邀请/返利计划 | 公开邀请返利计划:新用户注册即送 14 元体验额度,邀请人成功邀请 1 人再得 14 元,无需联系商务即可参与,是冷启动阶段唯一可以"零谈判"直接接入的联盟项目。 |
优点
- 开源模型覆盖面在国产中转站里数一数二,DeepSeek/Qwen系列更新快
- 国内直连,延迟和合规风险都比海外中转站低
- 公开的双边返利计划,冷启动期可直接用作推广素材,无需走商务流程
- 适合预算有限的个人开发者和 vibe coding 项目做原型验证
缺点
- 主打开源模型,闭源旗舰模型(如 GPT-4.x/Claude 4.x 官方版本)覆盖不如部分中转站
- 官方未公开统一的延迟/SLA 数字,企业级承诺不如诗云API等专做SLA的厂商