统一多模型接口
同一个忻擎 API Key 可以调用平台已开放的不同供应商模型。聊天请求可填写 model: "auto" 自动识别任务并选路,也可填写具体模型名;最终按实际选中的模型公开价格和真实用量结算。
基础地址:https://xinqingapi.com
鉴权:Authorization: Bearer xq_live_...
智能路由:填写 "model": "auto"。系统识别图片、长上下文、推理、代码和文案意图,从已开放且已定价的候选模型中先匹配能力,再比较预计费用。
固定模型:填写具体模型名,例如 "model": "gpt-5.6-sol"。请求 GET /v1/models 可查看当前模型及其输入、输出售价。
能力目录:GET /v1/capabilities 模型与价格目录:GET /v1/models
| 方法 | 路径 | 用户意图 | 实际计费依据 |
|---|---|---|---|
POST | /v1/chat/completions | 文本对话、推理、代码、图片理解 | 百万 Token |
POST | /v1/messages | Claude Code / Anthropic Messages 兼容调用 | 百万 Token |
POST | /v1/messages/count_tokens | 调用前估算输入 Token,不扣费 | 不计费 |
POST | /v1/images/generations | 图片生成 | 每张 |
POST | /v1/audio/speech | 文字转语音 | 每千字符 |
POST | /v1/audio/transcriptions | 语音转文字(multipart/form-data) | 每分钟 |
POST | /v1/videos | 视频生成任务 | 每秒 |
GET | /v1/videos/{id} | 查询本人视频任务 | 不单独计费 |
AUTO 怎样计费:Key 和 auto 都不决定价格;路由选出实际模型后,再按该模型公开输入价、输出价和真实 Token 用量结算。响应中的 routing.actual_model 会明确显示最终模型。
多模态对话:messages[].content 可包含文本和 image_url;AUTO 只会选择具备图片理解能力的已开放模型。
请求限制:每个账户每分钟 30 次;JSON 请求最大 256 KB;语音文件最大 25 MB;对话暂不支持 stream: true。
透明与失败保护:响应会展示 routing.requested_model、routing.actual_model 和路由模式。没有合适候选、模型未开放或价格未配置时直接失败且不扣余额;审计记录不保存提示词、文件或回答内容。
当前状态:至少一个真实适配器已经开启;只有公开模型列表中的模型可被路由。当前代码支持十一家文本供应商、OpenAI 图片与语音,以及火山方舟/BytePlus Seedance 异步视频。各模型仍需分别配置成本、售价、预算并人工开放。