专线直连
面向中国大陆网络环境优化路由,结合节点健康状态调度,为不同模型提供稳定、低延迟的调用体验。
无需翻墙,稳定调用 Claude、GPT、Gemini 等全球模型,也可一键切换 Kimi、GLM、Qwen、Wan、 DeepSeek 与 BytePlus。解决访问受限、账号被封、高延迟与支付困难,支付宝/微信支付,按量计费。
OpenAI 兼容 · 只改一行代码 · 用多少付多少
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["ONEAI_API_KEY"],
base_url="https://api.1ai.cloud/v1", # 只需要改这一行
)
response = client.chat.completions.create(
model="claude-sonnet-5",
messages=[{"role": "user", "content": "用一句话打个招呼。"}],
)
print(response.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.ONEAI_API_KEY,
baseURL: "https://api.1ai.cloud/v1", // 只需要改这一行
});
const response = await client.chat.completions.create({
model: "gpt-5.4",
messages: [{ role: "user", content: "用一句话打个招呼。" }],
});
console.log(response.choices[0].message.content);
curl https://api.1ai.cloud/v1/chat/completions \
-H "Authorization: Bearer $ONEAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [{"role": "user", "content": "用一句话打个招呼。"}],
"stream": false
}'
大多数网关只给你一个区域的模型。一智连天下把国内头部模型与海外前沿模型放在同一个 Key、 同一套请求格式、同一张账单后面。
面向中国大陆网络环境优化路由,结合节点健康状态调度,为不同模型提供稳定、低延迟的调用体验。
支付宝/微信支付,按需付费,无需信用卡与境外账户。没有席位费,也没有起订量。
GPT、Claude、Gemini 与 Kimi、GLM、HappyHorse、Qwen、Wan、DeepSeek、BytePlus 在同一份目录里, 共用同一套请求格式。
多节点智能调度,针对中国大陆使用场景持续优化响应速度与稳定性。
标准 /v1/chat/completions 语义。现有 SDK、Agent 框架照常运行, 你只需要改 base_url。
7×24 中文技术支持,微信与 Telegram 上都是实名商务联系人,不是匿名工单队列。
上游全都健康的时候,任何代理都能用。真正要紧的是:上线当天某个供应商开始限流,会发生什么。
传入一个有序的模型列表。当第一个上游返回限流、超时或 5xx,请求会在同一次调用内自动落到下一个模型。 你的应用拿到的是一个正常响应,而不是一段需要自己写的重试逻辑。
{
"model": "claude-sonnet-5",
"fallbacks": ["gpt-5.4", "glm-5.2", "kimi-k3"],
"messages": [ ... ]
}
SSE 流式返回、Function Calling 与 JSON Schema 结构化输出在各家模型之间做了统一, 针对一个模型写好的 Agent,换到另一个模型不用重写。
无论调用的是国内还是海外模型、文本还是视频,都记在同一份用量记录里。按 Key、按模型、 按项目做成本归因是一次查询,而不是六张账单。
因为请求格式是共用的,把一个业务从旗舰模型换到更便宜的模型只是改配置。 用贵的模型做评测,用划算的模型跑生产。
为测试、生产和每位同事分别签发 Key。任何一把泄露了,单独吊销即可,不影响其他流量。
可按供应商或模态筛选。除行内另有说明外,价格均为每 100 万 tokens; 多媒体模型按生成秒数或按张计费。
最高 100 万上下文,原生视觉能力与可配置推理强度,适合编码、知识工作与长链路 Agent 任务。
100 万上下文、最高 128K 输出,支持 Function Calling 与结构化输出,适合长时间运行的开发工作流。
100 万上下文,支持推理、Function Calling 与内置工具。该模型仍处于预览阶段,可用性可能变动。
100 万上下文、最高 384K 输出,支持工具调用与思考模式,面向 Agent 与重推理负载。
文生视频,按生成秒数计费,支持 720P 与 1080P,可与文本模型放在同一条创意生产流水线上。
图像生成,首张免费,之后按张计费;仅在超过 236 万像素时才进入更高一档价格。
如果你已经在调用 OpenAI 兼容接口,第四步只是一行 diff。
在控制台注册并完成账号验证。
支付宝/微信支付,按量扣费,不需要选套餐。
一键签发带作用域的 API Key,吊销同样是一键。
把 base_url 指过来,选一个模型即可。
# 1 — 安装任意 OpenAI 兼容 SDK
pip install openai
# 2 — 配置 API Key
export ONEAI_API_KEY="your-api-key"
# 3 — 验证密钥,并列出当前可路由的模型
curl https://api.1ai.cloud/v1/models \
-H "Authorization: Bearer $ONEAI_API_KEY"
# 4 — 发送请求,model 换成模型目录里的任意 id
curl https://api.1ai.cloud/v1/chat/completions \
-H "Authorization: Bearer $ONEAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-sonnet-5","messages":[{"role":"user","content":"ping"}]}'
文本模型按每 100 万 tokens 计价,货币单位以行内标注为准;多媒体模型按生成秒数或按张计费。 每一行都标明了自己的计费单位。
网关位于你的应用和你依赖的每一个模型之间。这个位置需要被信任,所以我们把它具体写出来。
所有 API 流量走 TLS。密钥以 Bearer Token 方式传递,不会出现在 URL 或查询参数里。
提示词与返回内容仅用于把请求转发给上游供应商完成调用,不会被用于训练模型。
本页每个价格都链接到供应商自己的定价页,并标注了我们最后一次核对的日期。没有无出处的报价。
接口本身就是 OpenAI 兼容的。哪天你想离开,把 base_url 改回去就行, 没有私有格式需要拆解。
按环境或按人签发独立 Key。吊销其中一把不会中断任何其他流量。
三位实名商务与技术联系人,微信与 Telegram 均可直接联系,联系方式公开写在本页。
长上下文加工具调用,多步任务里的常规步骤可以自动落到更便宜的模型上。
100 万上下文让你可以少做激进切块,重排序环节再换成更便宜的模型。
图像与视频生成按张或按生成秒数计费,与文本模型共用同一个 Key。
用同一组 Prompt 横向评测十个模型,不用开十个账号,也不用对十张账单。
关于使用方式、退款规则和个人/企业数据处理的约定。
1)账号责任。 您对自己账号及所有签发的 API Key 下的调用行为负责。请妥善保管密钥, 建议按环境拆分 Key,并在怀疑泄露时立即吊销。
2)许可范围。 服务可用于正常合法的产品研发、内测和商用场景。不得用于违法活动、恶意 爬取、恶意提示词注入服务、或其他违反相关法律法规的用途。
3)计费规则。 费用按计费页面展示与控制台配置结算。若供应商调整价格或可用性, 以供应商生效方案与最新控制台配置为准。
1)预充值消费。 账户余额为预存制,实际消耗部分会按调用量结算,不可对已发生消费进行 部分原路退回。
2)重复/异常扣款。 如在 14 个自然日内提交明确的重复扣款或异常支付反馈,且该笔消费 明确无争议,我们将按核实结果提供全额或部分退还。
3)服务异常导致的扣费。 如因平台故障导致可核实的计费误差,我们将优先恢复余额或补发等值 使用额度,再完成后续结算处理。
1)请求数据。 请求与响应在传输过程中采用加密传输,用于请求处理和运行安全机制所需的数据会 进行最小化保留,不会用于训练公司内部模型。
2)保留周期。 请求元数据仅保留到完成故障排查和风控分析所需的最短周期,随后按控制台可见 的留存策略进行清理。
3)上游厂商规则。 上游供应商对其侧日志与模型输出的数据使用遵循各自隐私条款。 若有企业合规要求,请在开通前提交说明以便定制供应商配置。
请将服务和账务相关问题发送到 [email protected]。
法务、账单与策略咨询将尽量在 1 个工作日内完成处理;复杂企业问题可提供更详细的处理周期。
请使用微信扫码添加任一商务联系人。
请选择任一商务联系人。