【AI 尝鲜实验室】上新 | New API:一个入口打通全网大模型的统一网关

简介: New API 是 QuantumNous 开源的大模型网关与 AI 资产管理系统(AGPL-3.0,GitHub 42k+ Stars),聚合 OpenAI、Claude、Qwen 等主流模型,提供统一 OpenAI 兼容接口、渠道分组、自动重试、额度管理及在线充值。本实验通过阿里云计算巢一键部署,几分钟即可搭建专属网关,支持团队令牌分发与国产模型无缝接入编程工具。

实验简介

New APIQuantumNous 开源的下一代大模型网关与 AI 资产管理系统(GitHub 42k+ StarsAGPL-3.0 协议)。它将 OpenAI、Claude、Gemini、DeepSeek、通义 Qwen、Midjourney、Suno 等全网主流大模型聚合到一个统一的 OpenAI 兼容接口,内置多渠道分组、加权随机分发、失败自动重试、完整的用户/令牌/额度管理和在线充值能力。

本次实验通过阿里云计算巢一键部署 New API 到云端,几分钟即可拥有一套专属大模型网关。部署完成后你可以在后台集中管理所有模型渠道、给团队成员分发独立令牌和额度,并通过格式互转让 Claude Code、Cursor 等主流 AI 编程工具无缝接入国产大模型。

一、部署环节

整体流程如下:

  1. 阿里云计算巢一键部署,选择实例规格、设置实例密码,创建服务实例
  2. 等待部署完成,在服务实例概览页获取安全代理访问地址
  3. 登录 New API后台,在“渠道管理”中添加大模型 API Key
  4. 在“令牌管理”中创建令牌,将令牌和网关地址填入 AI客户端开始使用

二、资源及环境准备

准备项

说明

账号准备

阿里云账号(已完成实名认证)

模型准备

至少一个大模型服务商的 API Key(如百炼/DeepSeek/OpenAI 官网申请)

资源准备

计算巢会自动创建 ECS 实例,用户只需选择规格和设置密码

网络准备

部署后系统自动分配公网访问地址,无需额外配置

验证准备

一个支持 OpenAI 兼容接口的 AI 客户端(如 Cherry Studio、OpenClaw、Cursor 等)

三、详细部署步骤

步骤 1:在计算巢创建服务实例

前往部署,按照提示选择实例规格,设置服务器实例密码 ,确认后点击「立即创建」。等待约 3-5 分钟,服务实例状态变为「已部署」即表示部署成功。

步骤 2:获取访问地址并登录后台

部署完成后,进入 计算巢 > 服务实例 > 概览 页面,点击 安全代理访问地址,即可进入 New API 管理后台。首次登录时,请根据页面提示设置管理员用户名和密码。

步骤 3:添加大模型渠道并创建令牌

登录后台后,在左侧导航「渠道管理」中点击「新建渠道」,选择模型类型(如 OpenAI、DeepSeek、通义 Qwen),填入从模型服务商官网获取的 API Key 保存。

然后进入「令牌管理」,新建令牌并设置额度和可用模型。

步骤 4:接入 AI 客户端验证

拿到令牌后,可将 New API 的接口地址作为 OpenAI 兼容服务,接入 OpenClaw、Hermes、Qoder、Dify、LobeChat 等客户端,实现使用一个 API Key 统一调用多家大模型。

应用场景:在 OpenClaw 中接入 New API

登录服务器终端执行 openclaw configure按照提示依次完成配置

Where will the Gateway run?     → Local (this machine)
Select sections to configure    → Model
Model/auth provider             → More  → Custom provider
API Base URL                    → http://公网ip:3000/v1
Paste API key now               → New API → 令牌管理 → 复制密钥
Endpoint compatibility          → OpenAI-compatible
Model ID                        → qwen3.7-plus
Endpoint ID                     → 默认回车
Model alias (optional)          → qwen3.7plus
What do you want to configure?  →  Done

体验完成后,返回 New API 管理后台,在左侧进入 数据看板,即可查看请求次数、Token 消耗、模型调用分布、费用及性能指标等数据,统一掌握各模型和渠道的使用情况。

四、使用场景验证

New API 部署完成后,以下是几个典型的使用场景:

场景一:一个入口调用全网大模型

在 New API 后台添加多个服务商的 API Key,客户端只需一个统一接口和令牌即可自由切换 GPT、Claude、DeepSeek、Qwen 等模型,无需修改代码。

场景二:团队 AI 额度集中管理

为团队每位成员创建独立账号和令牌,设定可用模型和额度上限。后台仪表盘实时显示每人的调用量和消耗,消费透明可控。

场景三:Claude Code / Cursor 接入国产模型

利用 New API 的格式互转能力,将网关地址填入 Claude Code 或 Cursor 的 baseURL 配置中,即可用 DeepSeek、Qwen 等国产模型驱动 AI 编程工具,大幅降低使用成本。

场景四:搭建自己的 API 分销站

利用 New API 内置的在线充值(EPay/Stripe)、兑换码和用户注册功能,快速搭建一个面向客户或社群的 API 分销平台。

五、后续使用与常见问题

后续使用建议

  •  定期检查渠道状态,及时更新过期或额度不足的 API Key
  •  善用令牌分组功能,为不同用途(开发/测试/生产)创建独立令牌
  •  关注 New API GitHub 仓库更新,及时升级获取新功能和安全补丁
  •  通过「数据看板」定期复盘各模型的使用频率与费用,优化配置

常见问题

问题

解决方案

部署后无法访问管理后台

确认安全组已放行 3000 端口,或使用计算巢提供的安全代理地址访问

添加渠道后调用报错

检查 API Key 是否正确、是否有余额、模型名称是否与服务商一致

令牌额度用完怎么办

管理员可在「令牌管理」中编辑令牌追加额度

支持哪些客户端接入

所有支持 OpenAI 兼容接口的客户端均可,如 Cherry Studio、OpenClaw、Cursor、Dify、LobeChat 等

如何释放云资源

在阿里云计算巢「服务实例」页面选择对应实例点击删除,即可释放资源停止计费

⚠️ 温馨提示

1. 数据安全:New API 部署在您自己的 ECS 实例上,数据不经过第三方。

2. 费用说明:计算巢部署的 ECS 实例会产生云资源费用(按量计费),各大模型 API 调用费用由对应服务商收取。

3. 资源释放:实验完成后如不再使用,请及时在计算巢删除服务实例以停止计费。

相关文章
|
25天前
|
人工智能 缓存 自然语言处理
阿里云TokenPlan全新升级:2026最新指南、支持AI模型、Credits计费、个人和企业收费价格全解析
阿里云百炼Token Plan是面向个人与企业的AI大模型订阅服务,采用统一Credits计量,支持Qwen3.8-Max等多模态模型及主流AI工具。个人Lite版39元/月起,企业标准坐席198元/月起,夜间调用低至0.2折,性价比高。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
686 2
|
26天前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
2356 131
|
29天前
|
人工智能 弹性计算 API
【AI 尝鲜实验室】上新 | New API:一个入口打通全网大模型的统一网关
New API 是 QuantumNous 开源的下一代大模型网关与 AI 资产管理系统(GitHub 42k+ Stars,AGPL-3.0 协议)。它将 OpenAI、Claude、Gemini、DeepSeek、通义 Qwen、Midjourney、Suno 等全网主流大模型聚合到一个统一的 OpenAI 兼容接口,内置多渠道分组、加权随机分发、失败自动重试、完整的用户/令牌/额度管理和在线充值能力。 本次实验通过阿里云计算巢一键部署 New API 到云端,几分钟即可拥有一套专属大模型网关。部署完成后你可以在后台集中管理所有模型渠道、给团队成员分发独立令牌和额度,并通过格式互转让 Cl
354 2
|
11天前
|
人工智能 负载均衡 API
一个端点接 290 家 AI 服务商--我拆解了周增 7700 Star 的 OmniRoute
OmniRoute 是一款 MIT 协议的本地 AI 网关(TS 编写),聚合 290+ 服务商、500+ 模型,提供 OpenAI 兼容接口。支持智能 Combo 路由、12 因子 auto 选模、三层弹性容错与 RTK 等 12 种 Token 压缩引擎,显著提升免费额度利用率与稳定性。(239 字)
138 1
|
25天前
|
人工智能
2.4 万亿参数 Qwen3.8-Max 发布,三平台一键上手实操,阿里云百炼预览版限时 1 折优惠
阿里云千问Qwen3.8-Max正式发布,参数量达2.4T,代码与办公场景表现卓越。现可通过百炼TokenPlan、Qoder、QoderWork三渠道抢先体验Preview版,享白天1折、夜间再享2折优惠,正式版即将开源。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
873 2
|
25天前
|
存储 人工智能 安全
企业AI知识库搭建教程:从零到一的完整技术实现
本文面向开发者,详解企业AI知识库本地化搭建全流程:涵盖文档解析(PDF/OCR/语义分块)、Milvus+ES混合检索、BGE+Qwen2.5向量化与推理、RAG优化及RBAC+ABAC安全架构,强调数据不出内网、GPU显存隔离与合规审计。(239字)
319 7
|
25天前
|
人工智能
Qwen3.8-Max发布!在阿里云百炼TokenPlan、Qoder和QoderWork快速体验Qwen3.8-Max
阿里云发布Qwen3.8-Max大模型,参数达2.4万亿!可通过百炼TokenPlan(含个人版)、Qoder智能编程平台、QoderWork桌面AI三大渠道快速体验。现开启限时Preview活动:白天Credits享1折,个人版夜间再折上2折!在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
341 2
|
25天前
|
存储 人工智能 自然语言处理
阿里云轻量服务器全新智能体专用型实例发布!服务器 + 亿级 Token 打包,200M带宽免流量
阿里云推出智能体专用轻量应用服务器,集成vCPU、内存、云盘、200Mbps免流带宽及1亿–32亿Tokens,预付费一站式交付。搭载ANOLISA操作系统,Token节省30%,性能提升10%。支持一键部署OpenClaw、Dify等平台,覆盖个人开发至企业生产场景。阿里云轻量应用服务器官网:https://t.aliyun.com/U/dwftch
180 0