SupaNexus 与直接调用模型供应商有什么不同?
SupaNexus 在单一 OpenAI 兼容 API 后面增加了多租户隔离、统一账单、预算管控以及跨多个供应商的路由能力。
统一的访问地址。统一的认证模型。统一的模型目录。
通过单一的 OpenAI 兼容接口访问 DeepSeek、Qwen、GLM、Claude 及所有主流大语言模型。
统一访问地址 · 统一认证 · 统一模型目录
兼容主流模型供应商
专为生产级 AI 团队打造
多租户隔离、预算管控和用量可视化——全部通过单一接口实现。
通过单一 OpenAI 兼容 API 访问 DeepSeek、Qwen、GLM、Kimi 等顶级模型——专为可靠路由、合规管理和统一计费而构建。
按组织和项目管理,每个项目拥有独立 API 密钥、隔离配额和清晰归属——非常适合服务多个内部团队的平台团队。
为每个租户或项目设置预算和用量限制。在超支前获得主动告警,并通过限流或硬性截断来控制成本。
可视化 Token 用量、成本趋势及模型分布。财务团队与工程团队共享同一个 AI 支出数据源。
真实模型,真实服务。
可调用的模型、按量计费、可追踪的路由——每一次请求都是真实的。
模型来自实时供应商集成。GET /v1/models 返回的是可以真正调用的模型 ID,而非静态展示。
每次对话补全都会记录 Token 用量,并进行配额和余额预检。控制台与账单始终保持一致。
请求通过优先级路由和熔断机制代理到真实推理端点。X-SupaNexus-* 响应头帮助您追踪和诊断问题。
// 通过 OpenAI 兼容 API 调用任何模型const client = new OpenAI({ baseURL: "https://api.supanexus.ai/v1", apiKey: process.env.SUPANEXUS_KEY}); const res = await client.chat.completions.create({ model: "deepseek-v3", messages: [{ role: "user", content: "Hello" }]});
零数据留存
我们仅记录账单和用量报告所需的数据,并将对话实时转发至您选择的模型供应商。
您的问题和模型的回复不会存储在我们的系统中。SupaNexus 不会将您的对话用于训练、画像或二次分析。
我们仅保留账单和用量报告所需的信息——使用了哪个模型、消耗了多少、何时使用——而非您对话中的文字内容。
对话实时直接转发至您选择的模型供应商。SupaNexus 不缓存、不改写、不注入额外内容。
供应商 API 密钥静态加密存储,仅用于路由您的请求。它们永远不会以明文形式出现在控制台或日志中。
按量付费
无固定套餐或隐藏渠道费用。每个模型的输入/输出 Token 费率在模型市场实时显示——只为您使用的内容付费。
登录后打开「模型」,在调用前浏览各模型的输入/输出定价。
按 Token 用量计费;输入和输出费率通常不同,与 GET /v1/models 返回的元数据保持一致。
用量分析、账户余额和结算共享同一计量链路——可在控制台中审计。
按量付费
按 Token 计费,无需订阅。
快速开始
从注册到第一次 API 调用,只需几分钟。
在开发者控制台注册并设置您的组织。
创建具有所需权限的项目级 API 密钥。
将您的客户端指向 SupaNexus OpenAI 兼容接口,开始发起 API 调用。
常见问题
关于 SupaNexus、账单和 API 的一切问题。
SupaNexus 在单一 OpenAI 兼容 API 后面增加了多租户隔离、统一账单、预算管控以及跨多个供应商的路由能力。
每个组织都是独立的租户。组织内的项目拥有独立的 API 密钥和配额池,余额从不共享。
在开发者控制台中,打开您的项目并进入 API 密钥页面。可以为每个密钥设置限速和到期日期。
上限逐级生效:如果密钥、项目或组织的任一预算耗尽,请求将被阻止。最严格的上限优先生效。
告警会在支出超过阈值时通知您(邮件/Webhook),但允许流量继续。硬性上限则会在达到限额后阻止新的请求。
打开控制台仪表板,选择时间范围和模型过滤器,然后进入「预算」设置阈值和通知渠道。
一个 API 密钥,接入所有主流大语言模型,几分钟内完成首次调用。