Logo
PhoenAIx AI GATEWAY CONSOLE
就绪
PhoenAIx · AI 网关

选择模型,开始对话

请求由 PhoenAIx 安全处理,用量自动记账 · 支持文本 / 图片 / 视频 / 嵌入

Enter 发送 · Shift+Enter 换行 内容经网关加密转发
生成记录
生成记录

网关状态自检

对网关做五项冒烟检测;其中 Chat 与 Embedding 会各发起一次最小上游调用,可能产生少量渠道费用。

网关存活
待检
Key 鉴权
待检
Chat 转发
待检
Embeddings
待检
供应商余额接口
待检
自检明细
T1无密钥请求应被拒绝(401)
T2错误密钥应被拒绝(401)
T3正确密钥 Chat 应返回 200(真实上游调用)
T4Embeddings 接口应返回向量(真实上游调用)
T5CORS 跨域预检通过
运营风险信号
由计量、Credit 预占与渠道回传实时汇总;不保存第二份可能过期的告警数据。

正在读取运营信号…

正在检查告警投递通道…

用量看板

从服务端调用计量汇总请求、Token、模型、渠道和异常。图表只展示元数据,不存储提示词或模型回复。

读取服务端计量…正在加载最近调用数据加载中…
请求量
所选周期
成功率
按网关响应状态
Token 消耗
输入 (缓存 ) · 输出
活跃模型
所选周期内被调用
渠道归因率
多渠道成本对账基础
响应缓存命中
命中时不产生上游成本
P50 延迟
一半请求在此时间内完成
P95 延迟
观察常规高延迟体验
P99 延迟
等待真实调用采集
请求与 Token 趋势
柱体为请求数,折线为 Token 量;可快速定位流量峰值。
请求 Token
运行信号
异常、未计量和渠道待回传需优先处理。
模型用量分布
按 Token 排序,识别高消耗模型与模型组合。
渠道与路由覆盖
实际渠道回传是成本、毛利和故障转移分析的基础。
模型表现
支持从模型维度追踪请求、成功率、Token、计量状态与渠道归因。
模型请求成功率Tokens计量完整度渠道归因
近期调用
可从下游用户和 API Key 下钻到最近请求;不展示提示词或返回内容。
第 1 页
时间下游用户 / Key模型结果延迟Tokens渠道计量

模型与价格

查看当前已上架模型的官方参考价、PhoenAIx 实际售价与 Credits 换算;所有价格均以页面标注计费单位为准。

模型价格 · 选择适合你的模型,实际费用以调用时的价格快照为准。正在读取价格…

供应商管理

管理上游 AI 模型供应商、连接信息和余额状态。钱包余额与模型可调用性独立展示,避免将“有余额”误判为“模型可用”。

01 · CONNECT连接与凭据以只读验证确认上游可达,不在列表暴露密钥。
02 · FUND余额与风险余额能力与模型可用性分开判断,避免错误结论。
03 · CATALOG模型接入先导入渠道目标,再决定是否上架给下游。
供应商名称 协议 Base URL 模型数 上游钱包 连接验证 操作

模型管理

先完成单模型健康检查,再上架给下游。聊天与向量模型会走最小真实调用;图像、视频和音频仅核验上游目录,避免检测本身产生生成费用。

PUBLISH发布边界上架状态同时控制目录、Playground 与真实 API 调用。
VERIFY健康验证先验证最小真实请求,再允许模型面向下游开放。
ROUTE渠道抽象渠道目标用于路由;下游始终只看到稳定的逻辑模型名。
模型 ID 显示名称 接入供应商 模型原厂 分类 状态 健康检查 上下架 操作

逻辑模型路由

一个下游模型别名可绑定多个上游渠道;下游只看到稳定模型名,实际渠道、成本和故障切换由平台管理。

策略名称 分发策略 目标模型 重试 渠道健康 状态 渠道目标 操作

暂无多渠道模型路由

先为同一模型接入至少两个渠道目标,再创建面向下游的稳定模型别名。

限流策略

配置请求频率与 Token 用量上限,支持按模型、API Key、团队维度控制

策略名称 作用域 限制值 时间窗口 状态 操作

暂无限流策略

按作用域设置请求数/Token 上限,超限返回 429

内容安全

配置输入/输出双向内容审核:关键词过滤、PII 脱敏、外部审核引擎

护栏名称 类型 方向 引擎 模式 状态 操作

暂无内容安全护栏

支持关键词过滤、PII 脱敏、内容审核等安全策略

响应缓存

复用完全相同的非流式 Chat 响应,降低上游成本与延迟

策略名称 后端 TTL 作用范围 数据隔离 缓存代次 状态 操作

暂无缓存策略

建议从单模型、按调用身份隔离的精确缓存开始

观测导出

配置请求遥测数据导出目标;计费对账只接收脱敏后的调用元数据,不保存提示词或密钥。

计费渠道回传 正在检查

AISIX 将仅导出请求 ID、实际渠道、用量和状态,用于回填真实渠道成本与毛利。

导出器名称 类型 端点/目标 内容模式 状态 操作

暂无观测导出器

支持 OTLP/HTTP、Datadog、阿里云 SLS、S3/GCS 等遥测后端

调用日志

核对模型调用、用量计量与 Credits 预占结算;异常补偿操作会写入不可变账本。

读取模式…
已记录调用
最近 100 条
已完成计量
响应含 Token 用量
待补定价
不会产生预估扣费
渠道待解析
多渠道路由不会虚构成本
调用计量记录 管理员可见
时间逻辑模型渠道解析Tokens计费 Credits上游成本 / 毛利状态

正在加载调用计量记录…

处理中预占
占用 — Credits
已结算请求
累计扣费 —
已释放预占
失败、超时或人工补偿
超时异常
超过 15 分钟仍未完成
Credits 对账记录 最近 200 条
请求 / 用户模型预占 Credits实际扣费状态处理时间操作

正在加载 Credits 对账记录…

安全审计日志 AES-256-GCM 加密存储
敏感详情在数据库中加密,仅由管理员在服务端鉴权后解密展示。
时间操作人请求状态来源客户端

正在解密安全审计日志…

计费总览

独立 Credit 计费的运营入口:公开定价、私有渠道成本、用户余额与利润都以同一次调用快照为准。

读取真实快照…
调用估算收入
已计量调用的价格快照
渠道成本
仅管理员可见
调用毛利
收入减渠道成本
毛利率
等待计量数据
PRICE对外定价官方参考价与平台售价分离,历史调用使用价格快照。
COST渠道成本实际成本仅管理员可见,并以真实渠道回传为准。
GUARD运营保护预算、预占、低余额与强制计费门禁在同一条链路运行。
一次调用的计费链路
模型官方参考价透明展示,不参与结算
平台售价 / 折扣用户可见、换算 Credits
调用定价快照防止改价影响历史账单
Credit 账本扣款、退款、对账
下游预算与低余额保护
预算在每次请求预占 Credits 前原子校验;超出月度预算会直接拒绝。低余额可仅提醒,或设为保护性拦截。
读取规则…
对象月度已用 / 预算当前余额低余额保护状态操作

正在读取预算规则…

模型定价

设置下游可见的平台价格。渠道成本仅用于管理员的毛利预览,绝不向下游返回。

已设平台价
已持久化的对外价格规则
待定价模型
不会自动对下游开放价格
默认兑换率
Credits / USD
毛利保护
持久化预警阈值;暂不扣费
定价上线中心 Shadow
先完成商业政策,再补齐已上架模型的平台价格与所有可命中渠道成本。全部通过后才允许进入灰度计费。
1 美元平台售价换算的 Credits;必须由运营确认。
任一可命中渠道低于该值都会阻止上线。
POLICY正在检查汇率等待服务端结果
PRICE正在检查平台价等待服务端结果
COST正在检查渠道成本等待服务端结果
MARGIN正在检查毛利等待服务端结果
已选 0
模型 / 供应商官方参考价
USD / 1M Token
平台规则下游价格
USD / 1M Token
Credit 换算毛利预览操作
强制计费上线检查
检查中…
强制计费前,平台会逐项检查 Credits 汇率、全部逻辑模型的平台价与实际渠道成本。
定价与计费边界 支持影子 / 强制模式
规则保存为版本化定价与渠道成本记录。影子模式只生成估算快照;强制模式会在请求前预占 Credits,并按响应中的实际用量结算。只有完成定价上线检查后才能启用强制计费。

渠道成本

录入上游的实际结算价格,用于平台内部毛利测算;下游用户永远不可见。

模型 / 供应商上游输入成本
USD / 1M Token
缓存输入成本
留空沿用输入
上游输出成本
USD / 1M Token
最近更新与平台价格关系操作
成本数据的权限边界
成本已保存在管理员专用的版本化记录中,并保留编辑人、来源、生效时间与历史版本。模型定价页只显示毛利预警,不会将任何渠道成本返回给下游用户或 API。

Credits 账户

管理下游注册用户的 Credits、充值兑换率和支付渠道准备状态;所有新调整都会写入精确账本。

下游用户
来自注册用户管理
已发放 Credits
当前可用余额汇总
零余额账户
用于低余额保护与运营提醒
计费账本
已启用
调用预占、结算和人工调整可追溯
充值政策与支付准备 管理员
每种法币独立换算 Credits;未配置的币种不会创建充值订单。
正在读取支付渠道状态…

渠道仅在商户资料、HTTPS 回调与验签适配器全部就绪后启用;控制台不会保存支付私钥。

计费运行模式 影子模式

建议先选择灰度对象并运行灰度计费。定价、汇率或渠道成本不完整时无法开启;任何时候都可以一键回到影子模式。

灰度计费范围 未选择
仅在“灰度计费”模式下生效。可按下游用户或 API Key 精确放量,其他请求继续影子计量。
对象范围状态操作

正在读取灰度范围…

灰度计费验收中心 等待预检
先校验定价、真实渠道成本、余额与灰度对象;显式确认后才开启灰度。完成一笔最小调用后,再核对计量、真实渠道和 Credits 结算。
PRICE等待预检平台价与渠道成本
TARGET等待选择用户或 API Key
BALANCE等待预检Credits 可用余额
RECON尚未调用计量、渠道与结算
选择对象和模型后运行预检。系统不会自动发起产生费用的上游请求。
下游 Credits 余额 读取真实注册用户数据
下游用户类型账户状态当前 Credits注册时间管理
账本与支付边界
当前已启用:精确余额、幂等账本请求号、余额前后值、调用价格快照、余额预占与不足拦截、结算释放及管理员操作审计。支付宝和微信仍需商户资料、公网 HTTPS 回调、验签、查单与退款对账;完成这些安全条件前不会展示可支付二维码。

收入分析

以调用时的售价快照为收入依据,以 AISIX 回传的实际命中渠道为成本依据。未完成渠道回传的调用不会虚构毛利。

本月调用营收
读取调用售价快照
已对账渠道成本
仅统计实际命中渠道
已对账毛利润
等待渠道成本不会被计入
已对账毛利率
按已归因收入计算
分析口径 当前自然月
正在读取计量与渠道对账数据…
读取中
按逻辑模型
下游始终按逻辑模型计价;可识别高收入、低毛利的模型。
模型调用营收估算渠道成本毛利 / 毛利率待回传

正在加载…

按实际渠道
仅回传后写入渠道成本与毛利。
渠道调用营收成本毛利率

正在加载…

按下游用户
仅管理员可见,不向用户暴露渠道成本。
下游用户调用营收成本毛利率

正在加载…

提示词预设

版本化管理系统提示词与模型参数;发布状态由管理员明确控制。

已发布
可供应用接入
草稿
待审核或完善
归档
保留历史记录
预设仓库
保存会递增版本号;敏感系统提示词仅管理员可见。
名称 / 版本目标模型状态更新时间操作

评测与发布

登记候选模型、数据集、质量、延迟和成本,以审批结论作为发布门禁记录。

上架质量门禁
开启后,模型或逻辑路由上架前除健康检查外,还必须有有效期内的“已通过”评测。默认关闭,不影响当前已上架模型。
读取中…
评测记录
可人工登记,也可执行小样本关键词验收;自动结果始终先保存为草稿,审批人决定是否发布。
评测项目模型 / 数据集质量P95 延迟单次成本结论操作
可复用评测数据集
数据集只保存输入与期望关键词,不保存模型回复;执行时默认最多取 20 条,避免意外扩大上游费用。
数据集样本数说明更新时间操作

正在加载数据集…

账户总览

查看账户信息、额度概览与快速统计。

当前余额
--
Credits
累计请求
0
自首次调用起
API Keys
0
活跃密钥
账户信息
用户名--
邮箱--
用户 ID--
角色--
快速操作

团队管理

管理企业团队成员,分配角色与权限。

团队成员
0
总人数
活跃成员
0
状态正常
管理员
0
成员列表
用户名 邮箱 角色 状态 加入时间 操作
暂无团队成员

API Keys

管理你的 API 密钥,用于接入PhoenAIx 网关。请妥善保管,切勿泄露。

01 · ENDPOINTOpenAI 兼容接口只需替换客户端的 Base URL 与 API Key。
02 · SECURITYKey 权限隔离每个 Key 可单独限定允许调用的模型范围。
03 · BILLINGCredits 统一计量调用受余额、预算及平台限流策略共同约束。
Base URL
认证方式
所有 API 请求都需携带 Authorization: Bearer sk-dp-xxxxxxxx。完整密钥只在创建成功时展示一次,请存入服务端环境变量,禁止提交到 Git 仓库或放进浏览器前端。
接入与排查
先通过 GET /v1/models 获取当前 Key 实际可用的已上架模型,再将返回的模型 ID 填入请求。以下示例支持 SSE 流式返回。
curl __BASE_URL__/v1/chat/completions \ -H "Authorization: Bearer sk-dp-xxxxxxxx" \ -H "Content-Type: application/json" \ -d '{ "model": "gpt-5.4-mini", "messages": [{"role":"user","content":"Hello"}], "temperature": 0.7, "max_tokens": 1024, "stream": true }'
curl __BASE_URL__/v1/models \ -H "Authorization: Bearer sk-dp-xxxxxxxx"
  • 只返回平台已上架且当前 Key 被授权使用的模型。
  • 模型下架、Key 范围变化会实时影响列表和调用权限。
  • 不要在业务代码中猜测模型名,建议启动时读取列表并配置允许值。
from openai import OpenAI client = OpenAI( api_key="sk-dp-xxxxxxxx", base_url="__BASE_URL__/v1" ) stream = client.chat.completions.create( model="gpt-5.4-mini", messages=[{"role":"user","content":"Hello"}], max_tokens=1024, stream=True ) for chunk in stream: if chunk.choices and chunk.choices[0].delta.content: print(chunk.choices[0].delta.content, end="", flush=True)
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.PHOENAIX_API_KEY, baseURL: "__BASE_URL__/v1" }); const stream = await client.chat.completions.create({ model: "gpt-5.4-mini", messages: [{ role: "user", content: "Hello" }], max_tokens: 1024, stream: true }); for await (const chunk of stream) { process.stdout.write(chunk.choices[0]?.delta?.content ?? ""); }
curl __BASE_URL__/v1/embeddings \ -H "Authorization: Bearer sk-dp-xxxxxxxx" \ -H "Content-Type: application/json" \ -d '{ "model": "text-embedding-3-small", "input": ["PhoenAIx 向量检索示例"] }'
Embedding 模型名以 GET /v1/models 的实际返回为准。输入规模、模型价格和余额都会影响是否允许调用。
curl __BASE_URL__/v1/images/generations \ -H "Authorization: Bearer sk-dp-xxxxxxxx" \ -H "Content-Type: application/json" \ -d '{ "model": "请替换为已上架图片模型", "prompt": "A golden phoenix rising from cosmic fire", "n": 1, "size": "1024x1024" }'
  • 图片生成:POST /v1/images/generations
  • 视频生成:POST /v1/videos;部分供应商会先返回任务 ID,需要按响应约定轮询结果。
  • 模型支持的尺寸、时长、宽高比和其他参数由实际上游决定,请先在“模型体验”验证。
Cursor / Continue 等编码工具
供应商选择 OpenAI Compatible;API Key 填入当前密钥,Base URL 填入上方地址。若客户端会自行追加 /v1,请避免重复配置。
NextChat / LobeChat / ChatBox
供应商选择 OpenAI 或自定义 OpenAI;填写 Base URL、API Key,并从 GET /v1/models 返回结果中选择模型。
通用兼容规则
需要客户端支持自定义 API 地址。若出现 404,请优先检查最终请求地址是否误写成 /v1/v1/...
状态码常见原因处理建议
400请求 JSON、model 或参数不合法核对接口参数和模型能力;强制计费时必须提供有效 model。
401Key 缺失、错误或已撤销检查 Bearer 格式;重新创建 Key 后替换服务端环境变量。
403当前 Key 无权调用该模型在 API Keys 页面检查模型授权范围。
402Credits 不足、预算超限或计费配置不完整检查余额、预算策略与目标模型定价。
404模型未上架、已下架或名称不存在重新请求 /v1/models 获取可用模型 ID。
429触发平台、用户、Key 或模型限流采用指数退避并加入随机抖动,避免立即并发重试。
502/503上游渠道或内部网关暂时不可用记录请求时间与模型名,稍后重试;持续出现时联系管理员。
生产环境建议
  • 设置 30–120 秒请求超时;流式请求需使用可持续读取 SSE 的客户端。
  • 仅对 429502503 做有限次数的指数退避重试,不要自动重试业务参数错误。
  • 为不同应用、环境和团队分别创建 Key,便于撤销、审计、限流和成本归因。
  • 不要记录 Authorization 请求头、完整 Key、提示词或模型输出到公共日志。
  • 定期轮换 Key;发现泄露时先撤销旧 Key,再创建并部署新 Key。

账单与额度

查看真实 Credits 余额、调用计量与账本明细;影子模式的金额仅用于预估,不会扣款。

读取模式…
当前余额
--
Credits
处理中预占
0
等待调用完成后结算
本月预估消费
0
--
累计预估消费
0
仅已完成计量调用
充值 Credits
通过托管收银台安全支付,到账由签名回调确认
正在读取渠道…
预计获得— Credits

安全结账

支付凭据由支付机构托管;PhoenAIx 不保存银行卡资料,仅在验签及金额核对通过后发放 Credits。

充值记录
时间支付方式充值金额Credits状态
调用计量 仅本人可见
时间模型TokensCredits状态
Credits 账本 不可变记录
时间类型变动可用余额说明

账户设置

管理个人账户信息与偏好设置。

个人信息
用户名创建后不可修改
邮箱由管理员分配
修改密码
≥8位 大写 小写 数字 特殊字符
会话管理
双重身份验证 正在读取

使用兼容 TOTP 的身份验证器保护账户。管理员账号强烈建议启用。

下游用户管理

管理在本平台注册、使用你提供的模型与 Credits 的下游用户;个人与企业账号均在此处统一管理。

用户列表
用户名 邮箱 类型 企业/组织 状态 Key 配额 Credits 余额 注册时间 操作
加载中...

模型策略群组

为下游用户划分可见模型范围;API Key 只能在所属群组范围内进一步收窄。

策略群组
用于模型可见性和调用授权
已分配用户
未分配用户保持全量权限
权限合并规则
取交集
群组是上限,Key 可继续收窄
群组与模型范围
禁用或空群组会拒绝全部模型,避免误放行。
群组可用模型用户状态操作
用户分配
策略同步影响模型目录、Playground、模型列表接口与真实调用。
用户类型当前群组