NEW
DeepSeek-V4 正式上架百万级上下文,企业级 SLA 环境下可用 Qwen3-Max 单价下调输入侧单价下调,已全量生效 企业专属实例开放预约预留算力 · 物理隔离 · 定制 SLA
查看公告
全链路境内节点 · 不接入境外模型

一个接口,
接入全部国产大模型

兼容 OpenAI 协议,改一行 base_url 即可迁移。企业级 SLA、按量计费、增值税专用发票与调用审计齐备 —— 数据不出境,合规可举证。

OpenAI SDK 零改造迁移 支持增值税专用发票 预充余额随时可退
quickstart.py 节点正常
# pip install openai
from openai import OpenAI

client = OpenAI(
    api_key  = "sk-sit-••••••••••••",
    base_url = "https://api.siteng.xin/v1",
)

resp = client.chat.completions.create(
    model    = "deepseek-v4",
    messages = [{
        "role": "user",
        "content": 用一句话解释什么是 Token,
    }],
)
print(resp.choices[0].message.content)
// npm i openai
import OpenAI from "openai";

const client = new OpenAI({
  apiKey:  "sk-sit-••••••••••••",
  baseURL: "https://api.siteng.xin/v1",
});

const messages = [
  { role: "user", content: 用一句话解释什么是 Token },
];

const resp = await client.chat.completions.create({
  model: "deepseek-v4",
  messages,
});
console.log(resp.choices[0].message.content);
curl https://api.siteng.xin/v1/chat/completions \
  -H "Authorization: Bearer sk-sit-••••••••••••" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4",
    "messages": [{"role":"user","content":"…"}],
    "stream": true
  }'
首 Token 延迟
312ms
服务可用性
99.95%
当日调用量
12.4M
18
已上架国产模型
3
代码完成接入
100%
数据境内处理
6个月
调用日志留存
覆盖模型厂商
01产品矩阵

从按量调用到私有化,一套平台全接住

四种交付方式覆盖从个人开发者到大型企业的全部场景,按需选择,随时升级,账户体系与计费口径完全一致。

P.01 — 默认形态

大模型 API

开箱即用的一站式模型接口。文本、推理、多模态、向量统一接入,兼容 OpenAI 协议,按实际 Token 消耗计费,用量与费用实时可见。

OpenAI 兼容按量计费流式输出
计费项 口径
输入 Token按每百万 Token 计价
输出 Token按每百万 Token 计价,单价高于输入
结算周期实时扣减,账单按自然月出具

企业 Token Plan

打包月度额度,单价低于按量计费。适合消耗量可预期的团队,超出部分自动回到按量计费,不中断业务。

额度包更低单价

专属实例

独占算力、预留资源,提供企业级 SLA 承诺与定制限速,支撑核心业务的稳定运行,不与公共池争抢资源。

独占算力SLA 承诺

私有化部署

部署在你自己的机房或专有云,数据不出域、物理隔离,适配信创与国产化环境,支持 BYOC 形态交付。

数据不出域信创适配

用量与成本洞察

按 Key、按项目、按模型多维拆分消耗,预算告警与超额熔断可下沉到每一把子 Key,超支前先拦住。

成本归因预算熔断
02为什么选驷腾云算

把"能不能用"变成"敢不敢用"

企业采购 AI 能力的门槛从来不是价格,是发票、是合规、是出问题时有没有人兜。我们把这三件事写进产品里。

迁移成本

1

完全兼容 OpenAI SDK。只改 base_url 与 api_key,业务逻辑一行不动。Python、Node.js、Java、Go 的 OpenAI SDK 均已做过验证。

综合折扣下限

0.80× 官方价

预充值阶梯与月度消耗折扣双重咬合,消耗越大单价越低。折扣是长期契约,不是引流噱头,也没有隐藏的服务费。

渠道容灾

3路冗余

同一模型配置多条上游渠道,按权重分流并做健康探测;渠道异常自动摘除、流量重路由,客户端无感知。

合规可举证

ICP 备案、增值电信业务许可、生成式 AI 服务备案、等保评估——材料按采购方审核口径整理,可直接提交给法务与安全部门。

安全可信

全链路国内节点,数据不出境;API Key 哈希存储、明文不可反查;请求与返回双向内容审核,违规内容实时拦截并留痕。

账目清晰

按实计量、按实开票、账单可导出对账。预充值余额随时可退,实充与赠送分账管理,进出流水每一笔都有据可查。

03模型广场

只上国产模型,覆盖主流能力

语言、推理、多模态、向量与重排,全部来自国内模型厂商。不接入任何境外模型,从源头规避数据出境风险。

卡片价格为每百万 Token 单价,格式为「输入 / 输出」。

DeepSeek-V4 DeepSeek
语言模型长上下文
上下文128K
¥2 / ¥8
DeepSeek-R1 DeepSeek
深度推理
上下文128K
¥4 / ¥16
Qwen3-Max 阿里云通义
语言模型长上下文
上下文256K
¥2.5 / ¥10
Qwen3-VL-32B 阿里云通义
多模态语言模型
上下文128K
¥3 / ¥12
Kimi-K2.7 月之暗面
智能体长上下文
上下文256K
¥4 / ¥16
GLM-5.3 智谱
语言模型智能体
上下文128K
¥2 / ¥8
MiniMax-M2.5 MiniMax
智能体长上下文
上下文200K
¥2.5 / ¥10
Doubao-Pro 字节豆包
语言模型多模态
上下文128K
¥1.6 / ¥6.4
Hunyuan-Turbo 腾讯混元
语言模型高速
上下文128K
¥1.5 / ¥5
ERNIE-4.5 百度文心
语言模型多模态
上下文128K
¥2 / ¥8
Spark-4.0 讯飞星火
语言模型
上下文128K
¥2 / ¥8
Step-3.5-Flash 阶跃星辰
多模态高速
上下文64K
¥1 / ¥4
BGE-M3 智谱
向量
上下文8K
¥0.3
bge-reranker-v2 智谱
重排
上下文8K
¥0.5
CosyVoice2 阿里云通义
语音合成
上下文
¥1 / 万字符

本页为设计稿示例数据,上架模型清单、上下文长度与单价以控制台模型广场及最终商务确认为准。 此处展示代表型号,查看完整清单 →

04接入流程

从注册到第一次调用,最快五分钟

不需要重新学习任何 SDK,也不需要改造现有代码。三个动作,从零到跑通。

01

注册并完成认证

手机号或邮箱注册。个人实名认证即可开始调用;企业认证后开放对公结算、额度池与增值税专用发票。

注册 → 实名 / 企业认证
02

充值并创建 API Key

选择预充值档位,实时到账并附带赠送额度。在控制台创建 API Key,可单独设置额度上限、有效期与 IP 白名单。

充值 → 创建 sk-sit-…
03

替换 base_url,开始调用

把请求地址指向 api.siteng.xin/v1,用原来的 SDK 发出请求。用量、费用与日志在控制台实时可见。

base_url = https://api.siteng.xin/v1
05定价

按实际用量付费,充得越多单价越低

没有月费、没有最低消费、没有隐藏费用。所有模型单价在控制台模型广场公开可见,折扣口径写在合同里。

个人开发者

自助注册,充值即用
按量
无月费 · 无最低消费
  • 全部上架模型可用
  • 兼容 OpenAI SDK
  • 用量实时看板
  • 预充值阶梯赠送
  • 工单支持
免费注册
企业首选

企业客户

对公结算,专票与审计齐备
最高 8 折
按月度消耗阶梯
  • 包含个人版全部能力
  • 企业认证 · 对公结算
  • 增值税专用发票
  • 团队与子账号 · 额度池
  • 调用日志审计与导出
  • 专属客服 + SLA 承诺
联系我们

专属部署

预留实例与私有化方案
一事一议
按算力规格报价
  • 独占算力 · 预留资源
  • 物理隔离 · 数据不出域
  • 信创与国产化适配
  • 定制 SLA 与赔付条款
  • 现场实施与运维支持
预约咨询

预充值阶梯一次性让利

充值金额 个人线赠送 企业线赠送 附加权益
¥1,0003%2%标准工单支持
¥5,0004%3%用量月报
¥20,0005%4%专属客服 · 月度对账
¥100,0006%4% + 阶梯专属客服 · SLA 承诺 · 可开专票
¥500,000+一事一议预留实例报价 · 技术支持

月度消耗阶梯长期折扣 · 可与充值叠加

月度消耗(官方价折算) 折扣系数
< ¥5,0001.00×
¥5,000 – ¥20,0000.95×
¥20,000 – ¥100,0000.90×
¥100,000 – ¥500,0000.85×
≥ ¥500,0000.80×

赠送额度有效期 12 个月,到期不退款、不顺延;实充余额随时可退。折扣与赠送档位以最终商务确认为准。

06解决方案

不同行业的真实约束,我们见过

同一套 API,落到不同行业里要解决的问题完全不同。下面是五类客户最常见的场景与我们的落地方式。

互联网与 SaaS

产品迭代快、流量波动大,模型能力要能随时替换,成本要能按模块归因。最怕的是上线后单价失控、或某个模型断供导致功能停摆。

多模型一键切换,A/B 测试不改架构
按 Key 拆分成本,精确定位到每个功能模块
渠道冗余分流,单点故障不影响终端用户
流式输出与高并发场景下的速率保障

教育

面向未成年人或家庭用户的产品,内容安全是不可退让的底线;同时批改、答疑这类场景调用量巨大,对单价极其敏感。

请求与返回双向内容审核,违规实时拦截
高消耗场景走 Token Plan,单价显著低于按量
调用日志留存,满足主管部门检查要求
轻量模型处理常规题,重模型只用于疑难题目

政务与信创

采购流程严、资质要求硬、数据不能出域。项目往往要走招标,供应商的证照清单与国产化适配能力是第一道门槛。

资质材料按招标口径整理,可提交法务核验
私有化部署,数据不出域、物理隔离
国产芯片与信创环境适配,支持存量算力盘活
本地化实施与运维支持,项目全程有人对接

金融

回答要可追溯、结果要可复核,模型不能自由发挥。合规部门会追问每一句话的来源,以及数据在链路上经过了谁。

全量调用日志可导出,支持事后审计复核
专属实例隔离,业务数据不与其他租户混跑
配合 RAG 场景的向量与重排模型已上架
定制 SLA 与赔付条款,写入合同

智能制造

产线数据不能出厂,模型要跑在车间本地;同时缺乏 AI 工程能力,需要有人把模型接进既有系统而不是丢一份文档。

边缘侧部署形态,产线数据不出厂区
与既有 MES / ERP 对接的实施支持
多模态模型用于质检图像与工艺文档理解
存量算力纳管,减少一次性硬件投入
07合规与安全

合规不是加分项,是入场券

这个赛道的门槛是资质。我们把资质与安全机制做成可交付、可举证的材料,让你的采购与法务能一次过审。

ICP 备案

平台域名已完成工信部 ICP 备案,备案号 浙ICP备2026014260号-1,可在官网页脚与工信部系统公开查验。

增值电信业务许可

经营性增值电信业务许可正在办理中,取得后可向上游渠道与采购方提供核验材料,规避无证转售风险。

生成式 AI 服务备案

按监管要求推进生成式人工智能服务备案与算法备案评估,材料按监管口径准备,取得后于本页公示。

等保测评

按等级保护要求建设,等保测评正在办理中;达标后可满足企业招标与政企采购中常见的信息安全合规要求。

内容安全审核

请求与返回双向内容过滤,违规内容实时拦截并留痕,可追溯、可申诉,审核策略可按行业定制。

数据不出境

全部算力节点位于境内,不接入任何境外模型与服务,从源头规避数据出境与跨境合规风险。

所有资质材料均可按采购方要求提供核验,具体证照编号将于官网页脚与合规专区公示。

08常见问题

企业客户最常问的五个问题

接入需要改造我现有的代码吗?
基本不需要。驷腾云算完全兼容 OpenAI 接口协议,你只需要把 base_url 改成本站地址、把 api_key 换成我们的 Key,原有调用逻辑、SDK、框架全部可以继续使用。Python、Node.js、Java、Go 等主流语言的 OpenAI SDK 都已经过验证。
为什么不做境外模型?
两条原因。第一是合规:境外模型的调用链路涉及数据出境,存在明确的监管风险,我们不愿把这个风险转嫁给客户。第二是稳定:境外模型的账号与通道不具备可持续性,一旦断供,客户的生产业务会直接停摆。我们只做能长期稳定交付的东西。
预充值的钱安全吗?能退吗?
安全且可退。你的预充值余额属于预收款,我们专款专用、不挪用,全部用于向上游采购算力;未消耗的实充余额可以随时申请原路退回。赠送额度是权益不是资产,有 12 个月有效期,不参与退款。实充与赠送在账务和界面上都是分开管理的。
能开增值税专用发票吗?
可以。完成企业认证并使用对公结算后,可以申请增值税专用发票。开票额度按你的实际消耗累计,随用随开,不做"充值即全额开票"。所有账单可导出,方便与你的财务系统对账。
调用量大或者有突发流量时,会不会被限流?
平台默认提供与业务匹配的并发与速率上限,也可以按你的实际业务量协商提高。同一模型我们会配置多条上游渠道,按权重分流并做健康探测,某条渠道异常时自动切换,尽量减少对业务的影响。如果有明确的大流量场景,建议在商务阶段直接告知,我们会提前做容量预留。

现在注册,领取试用额度

五分钟完成接入,用实际效果判断要不要继续。不需要预付、不需要签合同。