硅基流动提供私有化MaaS平台、算力纳管服务、专属实例定制三种企业级交付形态,全部支持国产芯片适配与Token计量计费,满足模型权重不离场、API不出内网、审计日志可追溯等安全要求。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

企业需要在自有数据中心或私有云环境里跑满血版DeepSeek-V3、Qwen3-32B等大模型,同时要求API调用不出内网、模型权重不离场、审计日志可追溯——硅基流动提供三种企业级交付形态,全部支持国产芯片适配与Token计量计费。
私有化MaaS平台部署
下载硅基流动企业版安装包,解压后执行install.sh脚本。
脚本会自动检测宿主机CPU架构、CUDA版本、昇腾CANN版本,若检测到华为Atlas 800I A2服务器且CANN 7.0+已就绪,则跳过GPU驱动安装步骤;否则中断并提示缺失依赖。
安装完成后,访问https://[服务器IP]:8443进入控制台,使用初始账号admin@siliconflow.cn和随机生成的16位密码登录(密码明文写入/opt/siliconflow/conf/admin_pwd.log)。
【首次登录后必须立即修改初始密码,否则系统将在15分钟后自动锁定账号】
算力纳管服务
方法一:通过SiliconFlow CLI工具注册本地集群
在已有Kubernetes集群master节点执行:sfctl cluster register --name finance-cluster --api-server https://k8s-api.finance.local:6443 --token-file /root/kubeconfig.token。
方法二:对接NVIDIA DGX SuperPOD裸金属池
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
需提前在DGX Manager中启用REST API,并将/etc/siliconflow/dgx-access.yaml中的dgx_api_key字段替换为DGX Manager生成的Bearer Token。
两种方式均会在30秒内完成算力指纹采集,生成唯一ClusterID,该ID将作为后续所有Token消耗账单的归属标识。
专属实例定制流程
第一步:登录SiliconCloud企业客户门户,进入「专属实例」申请页。
第二步:选择模型规格——必须勾选「满血版」选项(非蒸馏版),当前可选DeepSeek-R1-671B、Qwen3-32B、Kimi-K2-200B三款。
第三步:填写部署位置偏好:① 硅基流动托管机房(北京亦庄/深圳坂田/上海张江三选一);② 客户指定IDC(需提供机柜U位编号及电力容量证明);③ 混合云模式(模型主实例在硅基流动机房,缓存层部署在客户边缘节点)。
第四步:配置安全策略——启用双向TLS认证时,系统强制要求上传PEM格式根证书;若选择IP白名单,则单个实例最多绑定16个IPv4地址段(CIDR格式)。
第五步:确认计费周期。月付模式下,首月按实际启动小时数折算;年付模式享受85折,但需一次性支付全年费用,且【合同签署后不可降配,仅允许升配】。

















