网关状态自检
对网关做五项冒烟检测;其中 Chat 与 Embedding 会各发起一次最小上游调用,可能产生少量渠道费用。
正在读取运营信号…
用量看板
从服务端调用计量汇总请求、Token、模型、渠道和异常。图表只展示元数据,不存储提示词或模型回复。
| 模型 | 请求 | 成功率 | Tokens | 计量完整度 | 渠道归因 |
|---|
| 时间 | 下游用户 / Key | 模型 | 结果 | 延迟 | Tokens | 渠道 | 计量 |
|---|
模型与价格
查看当前已上架模型的官方参考价、PhoenAIx 实际售价与 Credits 换算;所有价格均以页面标注计费单位为准。
供应商管理
管理上游 AI 模型供应商、连接信息和余额状态。钱包余额与模型可调用性独立展示,避免将“有余额”误判为“模型可用”。
| 供应商名称 | 协议 | Base URL | 模型数 | 上游钱包 | 连接验证 | 操作 |
|---|
模型管理
先完成单模型健康检查,再上架给下游。聊天与向量模型会走最小真实调用;图像、视频和音频仅核验上游目录,避免检测本身产生生成费用。
| 模型 ID | 显示名称 | 接入供应商 | 模型原厂 | 分类 | 状态 | 健康检查 | 上下架 | 操作 |
|---|
逻辑模型路由
一个下游模型别名可绑定多个上游渠道;下游只看到稳定模型名,实际渠道、成本和故障切换由平台管理。
| 策略名称 | 分发策略 | 目标模型 | 重试 | 渠道健康 | 状态 | 渠道目标 | 操作 |
|---|---|---|---|---|---|---|---|
|
暂无多渠道模型路由 先为同一模型接入至少两个渠道目标,再创建面向下游的稳定模型别名。 | |||||||
限流策略
配置请求频率与 Token 用量上限,支持按模型、API Key、团队维度控制
| 策略名称 | 作用域 | 限制值 | 时间窗口 | 状态 | 操作 |
|---|---|---|---|---|---|
|
暂无限流策略 按作用域设置请求数/Token 上限,超限返回 429 | |||||
内容安全
配置输入/输出双向内容审核:关键词过滤、PII 脱敏、外部审核引擎
| 护栏名称 | 类型 | 方向 | 引擎 | 模式 | 状态 | 操作 |
|---|---|---|---|---|---|---|
|
暂无内容安全护栏 支持关键词过滤、PII 脱敏、内容审核等安全策略 | ||||||
响应缓存
复用完全相同的非流式 Chat 响应,降低上游成本与延迟
| 策略名称 | 后端 | TTL | 作用范围 | 数据隔离 | 缓存代次 | 状态 | 操作 |
|---|---|---|---|---|---|---|---|
|
暂无缓存策略 建议从单模型、按调用身份隔离的精确缓存开始 | |||||||
观测导出
配置请求遥测数据导出目标;计费对账只接收脱敏后的调用元数据,不保存提示词或密钥。
AISIX 将仅导出请求 ID、实际渠道、用量和状态,用于回填真实渠道成本与毛利。
| 导出器名称 | 类型 | 端点/目标 | 内容模式 | 状态 | 操作 |
|---|---|---|---|---|---|
|
暂无观测导出器 支持 OTLP/HTTP、Datadog、阿里云 SLS、S3/GCS 等遥测后端 | |||||
调用日志
核对模型调用、用量计量与 Credits 预占结算;异常补偿操作会写入不可变账本。
| 时间 | 逻辑模型 | 渠道解析 | Tokens | 计费 Credits | 上游成本 / 毛利 | 状态 |
|---|---|---|---|---|---|---|
正在加载调用计量记录… | ||||||
| 请求 / 用户 | 模型 | 预占 Credits | 实际扣费 | 状态 | 处理时间 | 操作 |
|---|---|---|---|---|---|---|
正在加载 Credits 对账记录… | ||||||
| 时间 | 操作人 | 请求 | 状态 | 来源 | 客户端 |
|---|---|---|---|---|---|
正在解密安全审计日志… | |||||
计费总览
独立 Credit 计费的运营入口:公开定价、私有渠道成本、用户余额与利润都以同一次调用快照为准。
| 对象 | 月度已用 / 预算 | 当前余额 | 低余额保护 | 状态 | 操作 |
|---|---|---|---|---|---|
正在读取预算规则… | |||||
模型定价
设置下游可见的平台价格。渠道成本仅用于管理员的毛利预览,绝不向下游返回。
| 模型 / 供应商 | 官方参考价 USD / 1M Token | 平台规则 | 下游价格 USD / 1M Token | Credit 换算 | 毛利预览 | 操作 |
|---|
渠道成本
录入上游的实际结算价格,用于平台内部毛利测算;下游用户永远不可见。
| 模型 / 供应商 | 上游输入成本 USD / 1M Token | 缓存输入成本 留空沿用输入 | 上游输出成本 USD / 1M Token | 最近更新 | 与平台价格关系 | 操作 |
|---|
Credits 账户
管理下游注册用户的 Credits、充值兑换率和支付渠道准备状态;所有新调整都会写入精确账本。
渠道仅在商户资料、HTTPS 回调与验签适配器全部就绪后启用;控制台不会保存支付私钥。
建议先选择灰度对象并运行灰度计费。定价、汇率或渠道成本不完整时无法开启;任何时候都可以一键回到影子模式。
| 对象 | 范围 | 状态 | 操作 |
|---|---|---|---|
正在读取灰度范围… | |||
| 下游用户 | 类型 | 账户状态 | 当前 Credits | 注册时间 | 管理 |
|---|
收入分析
以调用时的售价快照为收入依据,以 AISIX 回传的实际命中渠道为成本依据。未完成渠道回传的调用不会虚构毛利。
| 模型 | 调用 | 营收估算 | 渠道成本 | 毛利 / 毛利率 | 待回传 |
|---|---|---|---|---|---|
正在加载… | |||||
| 渠道 | 调用 | 营收 | 成本 | 毛利率 |
|---|---|---|---|---|
正在加载… | ||||
| 下游用户 | 调用 | 营收 | 成本 | 毛利率 |
|---|---|---|---|---|
正在加载… | ||||
提示词预设
版本化管理系统提示词与模型参数;发布状态由管理员明确控制。
| 名称 / 版本 | 目标模型 | 状态 | 更新时间 | 操作 |
|---|
评测与发布
登记候选模型、数据集、质量、延迟和成本,以审批结论作为发布门禁记录。
| 评测项目 | 模型 / 数据集 | 质量 | P95 延迟 | 单次成本 | 结论 | 操作 |
|---|
| 数据集 | 样本数 | 说明 | 更新时间 | 操作 |
|---|---|---|---|---|
正在加载数据集… | ||||
账户总览
查看账户信息、额度概览与快速统计。
团队管理
管理企业团队成员,分配角色与权限。
| 用户名 | 邮箱 | 角色 | 状态 | 加入时间 | 操作 |
|---|---|---|---|---|---|
| 暂无团队成员 | |||||
API Keys
管理你的 API 密钥,用于接入PhoenAIx 网关。请妥善保管,切勿泄露。
Authorization: Bearer sk-dp-xxxxxxxx。完整密钥只在创建成功时展示一次,请存入服务端环境变量,禁止提交到 Git 仓库或放进浏览器前端。GET /v1/models 获取当前 Key 实际可用的已上架模型,再将返回的模型 ID 填入请求。以下示例支持 SSE 流式返回。- 只返回平台已上架且当前 Key 被授权使用的模型。
- 模型下架、Key 范围变化会实时影响列表和调用权限。
- 不要在业务代码中猜测模型名,建议启动时读取列表并配置允许值。
GET /v1/models 的实际返回为准。输入规模、模型价格和余额都会影响是否允许调用。- 图片生成:
POST /v1/images/generations。 - 视频生成:
POST /v1/videos;部分供应商会先返回任务 ID,需要按响应约定轮询结果。 - 模型支持的尺寸、时长、宽高比和其他参数由实际上游决定,请先在“模型体验”验证。
供应商选择 OpenAI Compatible;API Key 填入当前密钥,Base URL 填入上方地址。若客户端会自行追加
/v1,请避免重复配置。供应商选择 OpenAI 或自定义 OpenAI;填写 Base URL、API Key,并从
GET /v1/models 返回结果中选择模型。需要客户端支持自定义 API 地址。若出现 404,请优先检查最终请求地址是否误写成
/v1/v1/...。| 状态码 | 常见原因 | 处理建议 |
|---|---|---|
| 400 | 请求 JSON、model 或参数不合法 | 核对接口参数和模型能力;强制计费时必须提供有效 model。 |
| 401 | Key 缺失、错误或已撤销 | 检查 Bearer 格式;重新创建 Key 后替换服务端环境变量。 |
| 403 | 当前 Key 无权调用该模型 | 在 API Keys 页面检查模型授权范围。 |
| 402 | Credits 不足、预算超限或计费配置不完整 | 检查余额、预算策略与目标模型定价。 |
| 404 | 模型未上架、已下架或名称不存在 | 重新请求 /v1/models 获取可用模型 ID。 |
| 429 | 触发平台、用户、Key 或模型限流 | 采用指数退避并加入随机抖动,避免立即并发重试。 |
| 502/503 | 上游渠道或内部网关暂时不可用 | 记录请求时间与模型名,稍后重试;持续出现时联系管理员。 |
- 设置 30–120 秒请求超时;流式请求需使用可持续读取 SSE 的客户端。
- 仅对
429、502、503做有限次数的指数退避重试,不要自动重试业务参数错误。 - 为不同应用、环境和团队分别创建 Key,便于撤销、审计、限流和成本归因。
- 不要记录 Authorization 请求头、完整 Key、提示词或模型输出到公共日志。
- 定期轮换 Key;发现泄露时先撤销旧 Key,再创建并部署新 Key。
账单与额度
查看真实 Credits 余额、调用计量与账本明细;影子模式的金额仅用于预估,不会扣款。
支付凭据由支付机构托管;PhoenAIx 不保存银行卡资料,仅在验签及金额核对通过后发放 Credits。
| 时间 | 支付方式 | 充值金额 | Credits | 状态 |
|---|
| 时间 | 模型 | Tokens | Credits | 状态 |
|---|
| 时间 | 类型 | 变动 | 可用余额 | 说明 |
|---|
账户设置
管理个人账户信息与偏好设置。
使用兼容 TOTP 的身份验证器保护账户。管理员账号强烈建议启用。
下游用户管理
管理在本平台注册、使用你提供的模型与 Credits 的下游用户;个人与企业账号均在此处统一管理。
| 用户名 | 邮箱 | 类型 | 企业/组织 | 状态 | Key 配额 | Credits 余额 | 注册时间 | 操作 |
|---|---|---|---|---|---|---|---|---|
| 加载中... | ||||||||
模型策略群组
为下游用户划分可见模型范围;API Key 只能在所属群组范围内进一步收窄。
| 群组 | 可用模型 | 用户 | 状态 | 操作 |
|---|
| 用户 | 类型 | 当前群组 |
|---|
