犀速AI
文档目录
更新于 2026-08-21

快速开始

平台概览

这是什么、请求怎么走、按什么收费,以及它明确不做的几件事。

这是什么

一个兼容 OpenAI 协议的模型中转网关。你拿到的是一把密钥和一个 base_url —— 把任何兼容 OpenAI 的 SDK 或客户端指过来,就能调用多家厂商的模型, 不用为每一家单独申请账号、单独接一套 SDK、单独结一次账。

我们不训练模型,也不改写你的请求:请求按 OpenAI 协议原样转发给上游, 响应原样返回。

一次请求怎么走

你的应用  →  本平台网关  →  上游模型厂商
                  ↓
            记一笔用量与费用

网关做四件事:校验密钥(以及它身上的白名单与预算)、挑一个当前可用的上游、 转发、按实际用量记账。你的应用不经过我们的控制台 —— 控制台只是用来 建密钥、看用量、充值的地方。

按什么收费

按 token,输入与输出分开计价,调用完成时从账户余额实时扣。 失败的请求不计费。没有起步价、没有月租、不调用就不产生费用。

单价在「模型与价格」页,按模型不同。口径细节见「计费口径」。

你会用到的三个地方

在哪 干什么
模型与价格 看有哪些模型、单价多少、复制模型名
控制台 建密钥、看调用明细与账单、充值
文档(这里) 接入、错误码、计费口径

它明确不做的几件事

写在这里是为了让你在选型阶段就知道,而不是接到一半才发现:

  • 只有三个端点:chat/completionsembeddingsmodels。 没有图片、语音、文件、微调、Assistants —— 计价也没有"按图片""按音频分钟"这类维度。
  • 不提供信用额度或后付费,也还没有自动充值。余额归零即停服(会提前给你通知)。
  • 不保证模型输出的正确性。模型可能生成错误内容,是否采用由你判断。
  • 不承诺无中断。上游故障、网络问题都可能导致某个模型暂时不可用 —— 列表里会把它标成「暂不可用」,那不是你的问题,换一个模型即可。

数字为什么带「数据截至」

余额、用量、账单的事实源在网关侧,控制台展示的是一份带取数时间的快照。 对账时以页面上那一行时间为准。刚调用完就刷新,可能要等下一次取数才看得到。