硅基流动

3天前更新 5 0 0

国内开源模型 API 覆盖最全的一站式 MaaS 平台,DeepSeek-V4-Flash 输入 ¥1/输出 ¥2 每百万 token,9B 及以下模型永久免费,新用户送 14 元额度(约 2000 万 Tokens),国内直连。

所在地:
中国
语言:
中文
收录时间:
2026-07-26
硅基流动硅基流动
开发商:硅基流动
核心模型:DeepSeek-V4-Flash / DeepSeek-V4-Pro、Kimi-K2.7-Code / K2.6、Qwen3 全系、MiniMax-M2.5、GLM-4.5/4.6 等 100+ 开源模型
上下文:依模型(最高 1M,DeepSeek-V4 / Kimi K3);多数为 32K-128K
多模态:文本、图像(Qwen-VL/GLM-4.1V)、视频(HunyuanVideo/Wan2.1)、语音(CosyVoice2)、FLUX.2 文生图、DeepSeek-OCR
平台类型:聚合网关
计价方式:DeepSeek-V4-Flash:¥1/¥2;DeepSeek-V4-Pro:¥12/¥24(缓存命中 ¥0.10);Kimi-K2.7-Code:¥6.5/¥27;Qwen3.6-35B-A3B:¥1.8/¥10.8;FLUX.2 [pro] $0.03/张;9B 及以下模型永久免费(单位:元/百万 token,以模型广场实时价格为准)
免费额度:新用户注册送 14 元额度(约 2000 万 Tokens) ;9B 及以下参数模型永久免费
接入方式:OpenAI 兼容 / SDK / REST API
适用场景:AI 编程、多模态应用、成本敏感大批量调用、开源模型推理、原型验证、高吞吐场景
特色功能:100+ 开源模型、9B 及以下永久免费、Serverless 免部署、高速推理、CNY 结算可开票、多模态统一 API、OpenAI 兼容
可访问性:直连

硅基流动(SiliconFlow)是北京硅基流动科技有限公司推出的大模型 API 服务平台,定位”开箱即用的大模型 API”,覆盖语言、语音、图片、视频等全场景,按量计费。平台汇聚 100+ 开源模型,包括 DeepSeek-V4-Flash / V4-Pro、Qwen3 全系列、Kimi K2.7 Code、MiniMax M2.5、GLM 等。支持 OpenAI 兼容接口(base_url: https://api.siliconflow.cn/v1)、SDK、REST API。新用户注册送 14 元免费额度(约 2000 万 Tokens),9B 及以下参数模型永久免费。国内直连,无需 VPN。

 

产品概述

硅基流动于 2024 年推出,是国内最早一批聚焦”开源模型 API 化”的 MaaS 平台。商业模式清晰:向上游开源社区(DeepSeek、Qwen、GLM、Llama、MiniMax、Step 等)拿模型权重 → 自研推理加速栈 → 通过 SiliconFlow 平台对外提供 Serverless API,按 token 计费。2025-2026 年快速扩张模型矩阵:DeepSeek-V3/V4 系列、Qwen3 全系、Kimi K2.5/K2.6/K2.7 Code、MiniMax M2.5、GLM-4.5/4.6 等悉数上架。2026 年 7 月 Kimi K3 在 SiliconFlow 上线 Serverless API,输入 $3/缓存命中 $0.30/输出 $15 每百万 token。多模态能力同期补齐:FLUX.2 文生图 $0.03-0.06/张、Z-Image-Turbo ¥0.005/张、CosyVoice2 语音合成、HunyuanVideo/Wan2.1 视频生成。平台主打”高速推理”——语言模型 10x+ 速度提升、生图 3x+ 提升、语音生成 100ms 级延迟,是基础用户 QPS=5、TPM=100k 的高吞吐平台。

 

核心能力

  • 文本生成:DeepSeek-V4-Flash/Pro、Qwen3 全系、Kimi K2.7 Code、MiniMax M2.5、GLM 等 100+ 开源模型
  • 推理:DeepSeek-V4-Pro 思考模式、QwQ-32B、Kimi K2.7 Code 等推理/编程模型
  • 多模态:Qwen-VL、GLM-4.1V 视觉理解、DeepSeek-OCR 文档解析
  • 图像生成:FLUX.2 [pro]/[flex] $0.03-0.06/张、Z-Image-Turbo ¥0.005/张
  • 视频生成:HunyuanVideo-HD、Wan2.1-I2V/T2V 14B 720P
  • 语音:CosyVoice2-0.5B 语音合成
  • 高级功能:OpenAI 兼容、Tool Use、JSON Mode、Kimi K3 支持 Reasoning/Image Input/Tool Calling

 

优势亮点

  • 国内开源模型覆盖最全:DeepSeek/Qwen/GLM/Llama/MiniMax/Step/Kimi 全系开源模型一字排开,100+ 模型一个 Key 调
  • 9B 及以下永久免费:Qwen2.5-7B、GLM-4-9B、DeepSeek-R1 蒸馏版等轻量模型 0 元调用
  • 新用户送 14 元额度(约 2000 万 Tokens),注册即用
  • 价格极致亲民:DeepSeek-V4-Flash 输入 ¥1/输出 ¥2、DeepSeek-V3.2 ¥4/¥6、Kimi-K2.7-Code ¥6.5/¥27 每百万 token
  • 高速推理:语言模型 10x+ 速度提升,语音生成 100ms 延迟,基础用户 QPS=5/TPM=100k
  • CNY 结算 + 可开发票:人民币按量计费,符合国内财务流程
  • 国内直连:CN 节点延迟 50-200ms,无需 VPN
  • 多模态统一 API:语言/语音/图像/视频/嵌入与重排序共用一套 SDK
  • Serverless 免部署:不用关心模型部署和扩缩容,调 API 即用
  • OpenAI 兼容:base_url https://api.siliconflow.cn/v1,原 GPT 代码改地址即可跑

 

短板

  • 闭源旗舰缺失:Claude、GPT-5.5、Gemini 等闭源模型不在覆盖范围内,需配合 OpenRouter 或其他渠道
  • 免费模型有并发限制:RPM/TPM 有限制,生产环境需付费提升并发
  • 暂不支持 Anthropic 原生 SDK 协议:只兼容 OpenAI 格式
  • 无智能路由:不像 OpenRouter 有 Auto-routing,需开发者自己选模型
  • 模型迭代快、价格变动频繁:计费规则明确”保留修改价格的权利”,需定期回模型广场校准
  • 通用推理能力上限取决于开源模型:最强开源 DeepSeek-V4-Pro 仍不及 Claude Opus 4.8 / GPT-5.5
  • 企业级 SLA 待验证:作为创业公司,ToB 服务成熟度不及阿里百炼/火山方舟
  • Structured Outputs/Fine-Tuning 不支持:Kimi K3 在 SiliconFlow 上暂不支持结构化输出和微调

 

适用人群

国内开发者、成本敏感的创业团队、开源模型爱好者、AI 编程(Kimi K2.7 Code / DeepSeek V4)、多模态应用(FLUX.2 生图、CosyVoice2 语音、Wan2.1 视频)、需要 CN 直连的高吞吐场景、想薅免费额度做原型验证的爱好者。

相关导航