一个 Key · AUTO 智能路由 · 也可指定模型

统一多模型接口

同一个忻擎 API Key 可以调用平台已开放的不同供应商模型。聊天请求可填写 model: "auto" 自动识别任务并选路,也可填写具体模型名;最终按实际选中的模型公开价格和真实用量结算。

基础地址:https://xinqingapi.com

鉴权:Authorization: Bearer xq_live_...

智能路由:填写 "model": "auto"。系统识别图片、长上下文、推理、代码和文案意图,从已开放且已定价的候选模型中先匹配能力,再比较预计费用。

固定模型:填写具体模型名,例如 "model": "gpt-5.6-sol"。请求 GET /v1/models 可查看当前模型及其输入、输出售价。

能力目录:GET /v1/capabilities 模型与价格目录:GET /v1/models

方法路径用户意图实际计费依据
POST/v1/chat/completions文本对话、推理、代码、图片理解百万 Token
POST/v1/messagesClaude Code / Anthropic Messages 兼容调用百万 Token
POST/v1/messages/count_tokens调用前估算输入 Token,不扣费不计费
POST/v1/images/generations图片生成每张
POST/v1/audio/speech文字转语音每千字符
POST/v1/audio/transcriptions语音转文字(multipart/form-data)每分钟
POST/v1/videos视频生成任务每秒
GET/v1/videos/{id}查询本人视频任务不单独计费

AUTO 怎样计费:Key 和 auto 都不决定价格;路由选出实际模型后,再按该模型公开输入价、输出价和真实 Token 用量结算。响应中的 routing.actual_model 会明确显示最终模型。

多模态对话:messages[].content 可包含文本和 image_url;AUTO 只会选择具备图片理解能力的已开放模型。

请求限制:每个账户每分钟 30 次;JSON 请求最大 256 KB;语音文件最大 25 MB;对话暂不支持 stream: true

透明与失败保护:响应会展示 routing.requested_modelrouting.actual_model 和路由模式。没有合适候选、模型未开放或价格未配置时直接失败且不扣余额;审计记录不保存提示词、文件或回答内容。

当前状态:至少一个真实适配器已经开启;只有公开模型列表中的模型可被路由。当前代码支持十一家文本供应商、OpenAI 图片与语音,以及火山方舟/BytePlus Seedance 异步视频。各模型仍需分别配置成本、售价、预算并人工开放。