网关状态自检
对网关做五项冒烟检测;其中 Chat 与 Embedding 会各发起一次最小上游调用,可能产生少量渠道费用。
正在读取运营信号…
用量看板
从服务端调用计量汇总请求、Token、模型、渠道和异常。图表只展示元数据,不存储提示词或模型回复。
流式、非流式、缓存及 HTTP 成功或失败分别统计。网关等待包含 AISIX 与供应商,首个响应字节可能是心跳,不代表首 Token;不含浏览器网络及后续结算耗时。
| 模型 | 渠道 | 响应类型 | 有效样本 / 请求 | P50 ms | P99 ms | |
|---|---|---|---|---|---|---|
加载中… | ||||||
| 模型 | 请求 | 成功率 | Tokens | 计量完整度 | 渠道归因 |
|---|
| 时间 | 下游用户 / Key | 模型 | 结果 | 延迟 | Tokens | 渠道 | 计量 |
|---|
模型与价格
查看当前已上架模型的官方参考价、PhoenAIx 实际售价与 Credits 换算;所有价格均以页面标注计费单位为准。
供应商管理
管理上游 AI 模型供应商、连接信息和余额状态。钱包余额与模型可调用性独立展示,避免将“有余额”误判为“模型可用”。
| 供应商名称 | 协议 | Base URL | 模型数 | 上游钱包 | 连接验证 | 操作 |
|---|
模型管理
查看已有渠道与历史检测结果。自动检测暂未开放,完成预付费接入和扣费验收后再启用;仅已定价、已验收的文本模型可供客户调用。
自动模型检测暂未开放,需先接入预付费并完成扣费验收。可以查看历史结果;日常文本调用请使用 Playground 或 API Key。
| 模型 ID | 显示名称 | 接入供应商 | 模型原厂 | 分类 | 状态 | 健康检查 | 上下架 | 操作 |
|---|
逻辑模型路由
一个下游模型别名可绑定多个上游渠道;下游只看到稳定模型名,实际渠道、成本和故障切换由平台管理。
高级路由暂为只读,不能新增、改配或上架。可以查看既有配置及安全下架;完成验收后再开放。
| 策略名称 | 分发策略 | 目标模型 | 重试 | 渠道健康 | 状态 | 渠道目标 | 操作 |
|---|---|---|---|---|---|---|---|
|
暂无多渠道模型路由 先为同一模型接入至少两个渠道目标,再创建面向下游的稳定模型别名。 | |||||||
限流策略
设置网关实例内的模型共享限流 账户和 API Key 配额由独立的额度控制执行
正在读取限流配置
保存仅确认配置已写入 运行时生效仍需正常重载与验收
| 策略名称 | 模型 | 限制值 | 时间窗口 | 状态 | 操作 |
|---|---|---|---|---|---|
|
正在读取限流配置 | |||||
内容安全
管理护栏基础配置 保存配置不代表已经验证实际防护效果
输出及双向护栏暂不能新启用,需先完成拦截后的扣费对账验收。可以保存下架草稿或停用既有规则。
| 护栏名称 | 类型 | 方向 | 作用范围 | 模式 | 保存开关 | 操作 |
|---|---|---|---|---|---|---|
|
加载中 | ||||||
响应缓存
管理已保存的响应缓存策略;当前运行时统一禁用
响应缓存已安全停用:Playground 和 API Key 调用均不读取或写入缓存,仍按实际用量计费。供应商缓存 Token 优惠不受影响。
| 策略名称 | 后端 | TTL | 作用范围 | 原生缓存分区 | 缓存代次 | 已保存开关 | 操作 |
|---|---|---|---|---|---|---|---|
|
暂无缓存策略 策略仅保存配置,不会启用公共调用的响应缓存 | |||||||
观测导出
配置请求遥测数据导出目标;计费对账只接收脱敏后的调用元数据,不保存提示词或密钥。
正在读取配置与回传记录 读取完成前无法操作
| 导出器名称 | 类型 | 端点/目标 | 内容模式 | 状态 | 操作 |
|---|---|---|---|---|---|
|
暂无观测导出器 支持 OTLP/HTTP、Datadog、阿里云 SLS、S3/GCS 等遥测后端 | |||||
调用日志
核对模型调用、用量计量与 Credits 预占结算;异常补偿操作会写入不可变账本。
| 时间 | 逻辑模型 | 渠道解析 | Tokens | 计费 Credits | 上游成本 / 毛利 | 状态 |
|---|---|---|---|---|---|---|
正在加载调用计量记录… | ||||||
| 请求 / 用户 | 模型 | 预占 Credits | 实际扣费 | 状态 | 处理时间 | 操作 |
|---|---|---|---|---|---|---|
正在加载 Credits 对账记录… | ||||||
| 时间 | 操作人 | 请求 | 状态 | 来源 | 客户端 |
|---|---|---|---|---|---|
正在解密安全审计日志… | |||||
计费总览
独立 Credit 计费的运营入口:公开定价、私有渠道成本、用户余额与利润都以同一次调用快照为准。
| 对象 | 月度已用 / 预算 | 当前余额 | 低余额保护 | 状态 | 操作 |
|---|---|---|---|---|---|
正在读取预算规则… | |||||
模型定价
设置下游可见的平台价格。渠道成本仅用于管理员的毛利预览,绝不向下游返回。
| 模型 / 供应商 | 官方参考价 USD / 1M Token | 平台规则 | 下游价格 USD / 1M Token | Credit 换算 | 毛利预览 | 操作 |
|---|
渠道成本
录入上游的实际结算价格,用于平台内部毛利测算;下游用户永远不可见。
| 模型 / 供应商 | 上游输入成本 USD / 1M Token | 缓存输入成本 留空沿用输入 | 上游输出成本 USD / 1M Token | 最近更新 | 与平台价格关系 | 操作 |
|---|
Credits 账户
管理下游注册用户的 Credits、充值兑换率和支付渠道准备状态;所有新调整都会写入精确账本。
渠道仅在商户资料、HTTPS 回调与验签适配器全部就绪后启用;控制台不会保存支付私钥。
影子模式暂停所有模型调用;灰度模式仅允许选定对象真实计费调用,其余请求会被拒绝。全量计费须先通过定价检查。
| 对象 | 范围 | 状态 | 操作 |
|---|---|---|---|
正在读取灰度范围… | |||
| 下游用户 | 类型 | 账户状态 | 计费钱包余额 | 注册时间 | 管理 |
|---|
收入分析
以调用时的售价快照为收入依据,以 AISIX 回传的实际命中渠道为成本依据。未完成渠道回传的调用不会虚构毛利。
| 模型 | 调用 | 营收估算 | 渠道成本 | 毛利 / 毛利率 | 待回传 |
|---|---|---|---|---|---|
正在加载… | |||||
| 渠道 | 调用 | 营收 | 成本 | 毛利率 |
|---|---|---|---|---|
正在加载… | ||||
| 下游用户 | 调用 | 营收 | 成本 | 毛利率 |
|---|---|---|---|---|
正在加载… | ||||
提示词预设
版本化管理系统提示词与模型参数;发布状态由管理员明确控制。
首发只支持系统提示词。模型参数、历史执行与版本回放暂未开放;已有参数配置会保留,不会被默默忽略。
| 名称 / 版本 | 目标模型 | 状态 | 更新时间 | 操作 |
|---|
评测与发布
登记候选模型、数据集、质量、延迟和成本,以审批结论作为发布门禁记录。
自动评测暂未开放,需先完成真实扣费验收。当前可人工登记结果、审核和查看记录。
| 评测项目 | 模型 / 数据集 | 质量 | P95 延迟 | 单次成本 | 结论 | 操作 |
|---|
| 数据集 | 样本数 | 说明 | 更新时间 | 操作 |
|---|---|---|---|---|
正在加载数据集… | ||||
账户总览
查看账户信息、额度概览与快速统计。
团队管理
管理企业团队成员,分配角色与权限。
| 用户名 | 邮箱 | 角色 | 状态 | 加入时间 | 操作 |
|---|---|---|---|---|---|
| 暂无团队成员 | |||||
API Keys
管理你的 API 密钥,用于接入PhoenAIx 网关。请妥善保管,切勿泄露。
- 企业申请须审核通过 审核不会赠送 Credits
- 充值暂通过线下交易 由管理员核验真实收款图片 凭据编号 密码和 MFA 后入账 联系负责您账户的客户经理或平台管理员办理
- 文本价格按每百万 Token 区分输入 缓存输入和输出 以当前模型价格及平台 Credits 汇率为准 不按请求次数计费
- 余额不足或预算达到限制时请求会被拒绝 请先核对余额 预算和单次最大输出 再联系客户经理 不要连续重试
- Responses Embeddings 图片 视频和音频执行暂未开放 勿用生产请求试探能力
- 遇到异常请提供请求标识 时间和模型名 不发送完整 Key 提示词或客户内容 待管理员核对扣费和账单后再重试
Authorization: Bearer sk-dp-xxxxxxxx。完整密钥只在创建成功时展示一次,请存入服务端环境变量,禁止提交到 Git 仓库或放进浏览器前端。GET /v1/models 获取当前 Key 实际可用的已上架模型,再将返回的模型 ID 填入请求。以下示例支持 SSE 流式返回。- 只返回平台已上架且当前 Key 被授权使用的模型。
- 模型下架、Key 范围变化会实时影响列表和调用权限。
- 不要在业务代码中猜测模型名,建议启动时读取列表并配置允许值。
供应商选择 OpenAI Compatible;API Key 填入当前密钥,Base URL 填入上方地址。若客户端会自行追加
/v1,请避免重复配置。供应商选择 OpenAI 或自定义 OpenAI;填写 Base URL、API Key,并从
GET /v1/models 返回结果中选择模型。需要客户端支持自定义 API 地址。若出现 404,请优先检查最终请求地址是否误写成
/v1/v1/...。| 状态码 | 常见原因 | 处理建议 |
|---|---|---|
| 400 | 请求 JSON、model 或参数不合法 | 核对接口参数和模型能力;强制计费时必须提供有效 model。 |
| 401 | Key 缺失、错误或已撤销 | 检查 Bearer 格式;重新创建 Key 后替换服务端环境变量。 |
| 403 | 当前 Key 无权调用该模型 | 在 API Keys 页面检查模型授权范围。 |
| 402 | 余额不足 预算受限 暂无法计费或接口未开放 | 查看响应中的具体原因 检查余额 预算和支持的文本协议 不要自动重试 |
| 404 | 模型未上架、已下架或名称不存在 | 重新请求 /v1/models 获取可用模型 ID。 |
| 429 | 触发平台、用户、Key 或模型限流 | 采用指数退避并加入随机抖动,避免立即并发重试。 |
| 502/503 | 上游渠道或内部网关暂时不可用 | 遇到异常请提供请求标识 时间和模型名 不发送完整 Key 提示词或客户内容 待管理员核对扣费和账单后再重试 |
- 设置 30–120 秒请求超时;流式请求需使用可持续读取 SSE 的客户端。
- 限流时按 Retry-After 等待并限制重试次数 超时或断流不代表上游未执行 不要自动重发 先核对账单
- 为不同应用、环境和团队分别创建 Key,便于撤销、审计、限流和成本归因。
- 不要记录 Authorization 请求头、完整 Key、提示词或模型输出到公共日志。
- 定期轮换 Key;发现泄露时先撤销旧 Key,再创建并部署新 Key。
账单与额度
查看真实 Credits 余额、调用计量与账本明细;模型调用必须先预占额度。
负责人和团队管理员查看企业流水 普通成员仅查看自己的调用 预占不等于实扣
日期使用北京时间 最多查询 366 天 单次导出最多 10000 条 超限请缩小日期范围
| 时间 | 类型 | 请求 / 模型 | Tokens | 实扣 Credits | 可用额变动 | 可用余额 | 状态 |
|---|
支付凭据由支付机构托管;PhoenAIx 不保存银行卡资料,仅在验签及金额核对通过后发放 Credits。
| 时间 | 支付方式 | 充值金额 | Credits | 状态 |
|---|
| 时间 | 模型 | Tokens | 预估 Credits | 状态 |
|---|
| 时间 | 类型 | 变动 | 可用余额 | 说明 |
|---|
账户设置
管理个人账户信息与偏好设置。
至少 8 位,包含至少三种字符类型
正在核对账户安全状态,完成前无法修改安全设置。
下游用户管理
管理在本平台注册、使用你提供的模型与 Credits 的下游用户;个人与企业账号均在此处统一管理。
企业审核通知
| 用户名 | 邮箱 | 类型 | 企业/组织 | 状态 | Key 配额 | Credits 余额 | 注册时间 | 操作 |
|---|---|---|---|---|---|---|---|---|
| 加载中... | ||||||||
模型策略群组
为下游用户划分可见模型范围;API Key 只能在所属群组范围内进一步收窄。
| 群组 | 可用模型 | 用户 | 状态 | 操作 |
|---|
| 用户 | 类型 | 当前群组 |
|---|
