常见问题

你可能想了解的一切

用大白话说明模型、API 接入、定制企业工作流、部署和计费。

平台与接入

RealRelay.ai 是模型提供商吗?

不是。RealRelay.ai 不是模型提供商,而是连接上游模型提供商的统一智能路由与模型接入平台,提供可靠、稳定、安全的服务。它支持 OpenAI、Anthropic 和 Gemini 等主流供应商兼容的多种 API 格式。

用大白话说,RealRelay.ai 是什么?

RealRelay.ai 是统一的智能体 AI 平台:在提供统一、安全的模型接入之外,还支持智能体开发、部署和运行。对于企业用户,我们还提供私有化或本地部署,以及针对具体业务流程定制的智能体实现。

RealRelay.ai 面向哪些用户?

RealRelay.ai 面向中国大陆以外的国际开发者、初创企业和企业客户。我们提供统一、安全的 AI 模型路由,以及面向全球运营的端到端智能体开发与部署服务。

使用它需要技术背景吗?

不需要。开发者可以直接使用 API 和控制台。业务团队可以查看工作流示例并联系我们讨论定制实施,无需自行设计技术架构。

base URL 和密钥用什么?

把客户端指向 https://www.realrelay.ai/v1,用控制台密钥页创建的密钥以 Authorization: Bearer 方式鉴权。Anthropic 风格的 x-api-key 与 Gemini 风格的 x-goog-api-key 头在各自端点上同样受支持。

我需要重写现有的 OpenAI 集成吗?

通常不需要。把 base_url 指向 https://www.realrelay.ai/v1,换成 RealRelay.ai 密钥,并从目录中选一个 model id。请求结构保持不变。

可以用哪些 SDK?

你可以使用 OpenAI 兼容 SDK,例如官方 Python 与 Node.js 的 openai 包;也可以对 /v1/messages 使用 Anthropic SDK,或对原生 /v1beta 路径使用 Gemini SDK。API 文档提供 OpenAI 兼容 Python 与 Node.js 客户端、Anthropic SDK 和 cURL 的可复制示例。

原生支持 Anthropic 和 Gemini 端点吗?

支持。/v1/messages 使用 Anthropic 请求格式,/v1beta/models/* 使用 Gemini 格式,这些 SDK 只需改 base URL 和密钥即可继续使用。

模型与路由

目录数据来自哪里?

来自运营从平台发布的目录快照,模型页会标注该快照的发布日期。划线原价来自我们维护的渠道刊例价记录;我们收取的价格一律来自平台。

自动「故障转移」是怎么工作的?

用裸模型名发起请求时,RealRelay.ai 会按你的路由策略(默认最低价,可在控制台切换)在服务该模型的渠道中择优。首选渠道变慢或不可用时,会在 10 毫秒内立即改投最优备用渠道,你的用户不会看到中断。

我能锁定特定渠道吗?

可以。写裸模型名让网关在提供该模型的渠道中挑最便宜的;加上渠道前缀则锁定特定渠道。路由策略(默认、最低价、最低延迟)是控制台中的账户级设置。

怎么知道一个模型支持什么?

目录列出平台报告的上下文长度、工具调用、视觉、推理等能力,以及最新发布目录快照中的受支持端点。

模型下线了会怎样?

网站反映最新发布的目录快照。模型从该快照移除后,其详情 URL 返回 404,并从 sitemap 中移除。

支持流式输出和工具调用吗?

流式输出通过标准的 stream 参数走 SSE。工具调用取决于模型。目录会列出哪些模型支持。

账号与计费

统一 API 密钥是怎么工作的?

RealRelay.ai 作为代理封装层。使用一把 API 密钥即可调用该密钥有权访问的模型。使用不带渠道前缀的模型 ID 时,我们会在提供该模型的可用渠道之间动态路由,并按延迟或价格择优。

在哪里创建 API 密钥?

控制台的密钥页。每把密钥可以设置额度、模型白名单、有效期和 IP 白名单,方便按环境分发独立密钥。

计费结构是怎样的?

在控制台钱包预充值,用量按公开费率以每百万 token 扣减,按供应商直供成本计价、无隐藏加价。图像与媒体模型按次计费。目录在价格旁标注计费方式。

套餐层面的计费结构是怎样的?

按量付费预充值、按每百万 token 计费,并有硬性预算上限。企业版按信用额度月度开票,含 SLA 与 SSO。Sovereign Core 是面向完全隔离部署的年度定制合同。规模变化时可更换档位;当前积分档位见定价页。

余额用尽会怎样?

请求会返回 402 insufficient_quota。在控制台钱包充值后即可恢复服务。

如何核对详细账单?

RealRelay.ai 为模型请求提供详细的 token 用量日志。用户可以在控制台查询这些用量日志,核对细粒度的计费详情与费用明细。

付款后可以申请退款吗?

付款原则上不予退款。不过,为了处理误购情况,用户可以在付款后 24 小时内申请退款。

隐私与企业

我的数据会去哪里?私密吗?

任何请求到达公开模型之前,RealRelay.ai 的 PII 脱敏层会遮蔽敏感信息(医疗记录、卡号、密码)。响应会安全地为你还原。需要最强控制时,可以把 RealRelay.ai 完整部署在你自己的基础设施上。

可以部署在自己的服务器上(本地化)吗?

可以。对于合规要求严格的组织(政府、医院、银行),RealRelay.ai 可以部署在你自己的服务器集群或隔离的本地云上。在该形态下,你可以更好地控制相应的数据。安全页详述了主权部署选项。

速率限制是怎样的?

限制按 API 密钥计算,取决于套餐;当前值见控制台。收到 429 时请以指数退避重试。

平台会存储我的模型访问数据吗?

不会。RealRelay.ai 不会存储或分析用户的模型访问数据。它严格作为路由网关,在用户与模型提供商之间透明转发数据。

平台会使用我的数据来优化自身能力吗?

不会。RealRelay.ai 严格遵循用户隐私保护原则,绝不会使用任何用户数据来训练或优化平台能力。

平台如何与模型提供商合作?

RealRelay.ai 通过模型提供商的官方企业 API,与其签订直接的企业合同来接入模型。在这些企业协议下,提供商会提供更严格的数据隐私保护和更稳定的 API 服务。

创建密钥,改一行,即可使用该密钥有权访问的模型。