← 返回资讯

硅基流动也是供货方:它给谁供货,以及这对你选型意味着什么

2026-09-15

一次给团队定接入方案的会上,有人问了一句很难回答的话:「我们调的这个 DeepSeek,到底是谁在跑?」

问题不是刁难。合同上写的是你和某个平台的关系,账单上写的是某个模型名,但真正把这次请求算完的那块显卡,可能既不属于模型作者,也不属于你签约的那家。开源权重的模型尤其如此——权重是公开的,谁都能拉下来托管一份,于是「同一个模型」在不同平台上其实是不同的部署、不同的批处理策略、不同的限速规格。

这篇不讲怎么接入硅基流动,也不讲报错怎么排。讲的是另一件更少被摆出来的事:硅基流动自己就是别人的上游。 它不只做零售,也做批发。想清楚这一点,你在选型会上该问的问题会换一套。

一、先把那条证据摆出来

力达云这边在 2026-09-15 用 OpenRouter 的官方 API 查了一遍:调 https://openrouter.ai/api/v1/models/{id}/endpoints 这个公开端点,看某个模型 id 底下挂了哪些供货方。

deepseek/deepseek-chat-v3.1 的时候,返回的供货方列表里包含 SiliconFlow,同列出现的还有 DeepInfra、Novita、AtlasCloud、CoreWeave、Mara、Google、SambaNova。

这里要把话说清:这是力达云在 2026-09-15 这一天通过 OpenRouter 官方接口查到的结果,不是我们对硅基流动本身做的性能测试,也不是任何平台方给我们的口径。这只是一次公开接口的读取,你自己也能复现——同一个端点、同一个模型 id,任何人都能拉一遍。也正因为是某一天的快照,它明天可能就变了:供货方上下架是常态,今天在列表里不等于长期在。

但即便只是一天的快照,这一条也足够推翻一个很常见的默认假设:你以为的「零售平台」和「上游供货方」是两拨人,其实在这个行业里往往是同一拨人。

作为对照还可以看另外两行。同一天查 z-ai/glm-4.6,供货方是 Venice、DeepInfra、Novita、AtlasCloud、Z.AI 这几家;而查闭源的 qwen/qwen3-max,底下只有 Alibaba 一家。开源权重可以被多家各托管一份,闭源旗舰只有厂商本人这一个入口——这条规律在《OpenRouter 几百个模型是怎么来的》里展开讲,本篇只借它说明:多供货方这件事本身就是开源生态的结构性结果,不是某一家的特例。

二、零售和批发是两门不同的生意

硅基流动的公开定位不是模型厂商,而是推理云平台/模型聚合器:把开源模型统一接进来,由平台负责托管、负载均衡与推理优化,用户不必自己去 GPU 上部署。公司据公开报道成立于 2023 年 8 月,2026 年 6 月完成 B 轮融资并递交了港交所上市申请(这一条来自公开报道,融资规模我们没有可核实的口径,不写)。

站在用户这一侧,你看到的是零售面:一个 OpenAI 兼容的 base URL(https://api.siliconflow.cn/v1)、一个控制台里新建的密钥、一个模型广场(https://cloud.siliconflow.cn/models)上能看到模型、价格与限速。这条路的抽象层级和《什么是模型网关》里描述的那一层是一样的:你只管发请求,算力在谁家、怎么排队,平台替你消化掉。

但同一套推理能力还可以换个卖法:不零售给成千上万个开发者,而是整批供给一个聚合层,由聚合层去面对终端用户。这两门生意的经济结构完全不同——

零售面上,平台要自己承担获客、控制台、文档、工单、欠费风险,换来的是直接的用户关系和定价权。批发面上,客户只有一个,接口契约是对方定的,对方还会持续拿可用率和延迟指标衡量你,随时可以把流量切给列表里的别家。按 OpenRouter 官方给供货方的接入说明,想挂进去要满足一串硬要求:实现 List Models 端点(返回带类型的输入/输出模态、能力、约束、定价、容量);至少声明一种输入与一种输出模态;用 USD 字符串声明输入、输出、请求三个维度的价格;声明吞吐容量;满足正常路由所需的可用率门槛;支持性能指标采集(TTFT 与吞吐)。

还有一条容易被忽略但方向很关键——资金流。官方接入文档的原话是 For OpenRouter to use the provider we must be able to pay for inference automatically. 也就是说,钱是聚合层付给供货方的,不是终端用户付给供货方的。这一句就把角色关系钉死了:在这条链路上,硅基流动是拿货款的一方,是产业链上游。

把两面合起来看,一家推理平台的真实身份是:零售柜台和批发仓库共用同一套后端产能。 你在零售面上抢的排队位置,和某个聚合层批量打进来的流量,可能落在同一批机器上。

三、所以「同一个模型名」不是同一个东西

这件事对工程判断的直接后果,是模型名的可比性被削弱了。

假设你在两个地方都调「DeepSeek V3.1」。两边的模型字符串也许长得像,返回结构也都是 OpenAI 那一套,但中间隔着的东西可能完全不同:一边是平台自己托管的部署,一边是聚合层路由到某家托管方之后的转手。哪怕最终落到同一家托管方,路由层加的那一跳也会体现在首字延迟上;如果路由把你切到了另一家,那批处理参数、上下文上限的实际表现、限速口径,都是另一套。

这就是为什么「哪家更快」这种问题基本不可能有一个稳定答案。它不是一个关于品牌的问题,是一个关于「这一刻你的请求落到了谁的部署上」的问题。

在硅基流动这一侧还有一层自家的复杂度:同一个模型会有带 Pro/ 前缀和不带前缀两种名字。按官方说明,带 Pro/ 前缀的是付费加速版,不带前缀的免费版在速率与并发上更低;这套命名的由来是要区分免费版与收费版并保持兼容——免费版沿用「厂商/模型名」,付费版加前缀。请求示例里出现的 Pro/deepseek-ai/DeepSeek-R1 就是这个规则的样子。加上限速本身是 RPM 与 TPM 两个维度、还随账号月度消耗金额分成若干个用量等级动态变化(细节见《硅基流动的限速怎么算》),你会发现连「在同一个平台上调同一个模型」都不是一个固定规格,跨平台比较的难度只会更大。

四、选型会上该换的几个问题

知道了上面这些,问法可以更有效一点。下面这几条不是让你去质问供应商,而是帮你判断手里的报价单在比什么:

第一,这个模型在你家是自己托管,还是转手上游? 这个问题几乎不会得到书面答案,但对方的回答方式本身有信息量。愿意说「这是我们自己的部署」的,通常也愿意谈容量保障;含糊过去的,你就该假设它随时可能变。

第二,如果是转手,路由规则是什么,会不会在我不知道的情况下换供货方? 对聚合层来说换供货方是它的核心能力,不是缺陷;问题只在于你的业务能不能承受行为漂移。

第三,限速是按什么口径计的,跟消费额挂不挂钩? 双维度限速、等级制限速、并发数限速是三套不同的东西,照着别人的压测结论抄参数一定会错。

第四,出问题时故障边界在哪? 多一跳转手就多一个甩锅面。你要在故障演练里确认:模型返回异常的时候,你能从谁那里拿到有意义的答复。

第五,条款允许你怎么用? 这条最容易被跳过,却最难事后补救。

五、顺带说一条正向的信息

很多人读到硅基流动《用户协议》里那两段会以为路被封死了:授权是非排他性的、不可转让的,仅用于个人使用或所代表公司/实体的内部业务目的,未明确授予的权利全部保留;未经事先书面同意,不得购买、出售或转让 API 密钥,不得复制、出租、出售、贷款、转让、许可或意图转授、转售、分发服务的任何部分或其知识产权。充值环节也有对应约束:委托第三方代充值的,须保证了解并信任该第三方,若平台被第三方告知该充值未经其同意,有权立即封禁账户,封禁期间暂停 API 请求等全部服务,并要求资金来源合法。

但请注意那个限定语——「未经事先书面同意」。它约束的是「没打招呼就转手」,不是「转手这件事本身不可能」。而第一节那条查询正好从另一个方向印证了这一点:这家平台自己就在给聚合层供货,说明它对 B2B 供货这门生意是熟悉的、是有流程的。这意味着如果你真有分发场景,正路是去谈授权,而不是想办法绕开条款。条款逐条的边界在《硅基流动的服务条款边界》里拆,本文只到「留了商务通道」这一层,具体怎么谈、落成什么形式,取决于你的业务规模和对方的商务判断,我们没有可引用的公开案例,也不提供法律意见。

顺着说清我们自己的位置:力达云是独立第三方,与任何模型厂商都没有官方合作、代理或授权关系,一期只接 DeepSeek 一家的模型,其余一概给不了。我们的接入条款和能力边界写在 /api-terms/,可核查的事实与不做的承诺列在 /verify/。把这段写在这里,是因为一篇讲「谁给谁供货」的文章如果不说清作者自己在链条上的位置,可信度是要打折的。

六、能自己动手验的部分

这一层信息大多数平台不公开,但有几件事不需要别人告诉你:

  • 拉一遍公开接口。 聚合层若提供 endpoints 这类端点,你关心的每个模型 id 都查一次,记下当天有哪几家供货。这是快照,所以要定期重拉、留时间戳,看的是变化趋势而不是某一天的截图。
  • 在你自己的流量特征下压测。 别用别人的 prompt 长度和并发形状。输入输出比例决定了你会先撞 token 维度的墙还是请求数维度的墙,这个比例是你业务独有的。
  • 对同一个模型名跨平台采样比对。 同一批请求打两家,记首字延迟分布、长尾、以及截断和异常返回的比率。重点看分布形状,不要只看均值。
  • 把 base_url 与 model id 收成配置。 这是唯一能让上面所有结论在半年后仍然有用的工程动作,也是《什么是模型网关》那套抽象最实际的价值。
  • 在压测报告里写清采样日期。 供货方组合、限速等级、模型上下架都在变,没有日期的性能结论半年后就是误导。

结论要你自己量

必须说清这篇文章的局限:它的支点是一次公开接口的读取,而不是对硅基流动产能结构的完整了解。哪家平台给哪个聚合层供了多少量、用什么价、有没有独占条款,这些都是商业机密,我们没有,也不打算靠推断来填。

更要紧的是,这类信息的半衰期很短。今天在某个模型下看到的供货方列表,明天可能少一家多两家;某个平台今天做批发,明天可能收回去专做零售。所以正确的用法不是把「硅基流动是 OpenRouter 的供货方之一」记成一条事实结论,而是把「一家推理平台可能同时是你的供应商和你上游的供应商」记成一种看行业的姿势。

如果你正在做接入决策,那么这篇文章能给你的只有提问方式,给不了答案。答案在你自己的压测数据里——用你真实的输入输出比例、真实的并发形状、真实的错误容忍度,跑够长的时间,看长尾而不是均值。任何一篇文章(包括这一篇)给出的性能与稳定性结论,都不该直接进你的技术方案。

不想自己搭网关、自己维护渠道?

力达云是托管的 OpenAI / Anthropic 双格式端点,一期提供 DeepSeek,注册送 ¥5 额度。

去试用

这个页面有问题?

提交时会附带当前页面地址和浏览器信息,帮助我们定位问题。不填联系方式即为匿名。