可用模型与价格
控制台「快速接入」页的可用模型列表展示了当前可调用的全部模型,以及每个模型的价格与上下文长度。调用时把列表中的「名称」填入请求的 model 字段。
两种模型类型
| 类型 | 说明 | 适合场景 |
|---|---|---|
| 智能路由池 | 一个池名背后是一组模型。调用时路由层按任务类型与难度自动选择池内最合适的模型 | 大多数对话/写作/代码场景——把选模型交给路由层,成本与质量自动平衡 |
| 直调模型 | 固定映射到具体供应商模型,行为与普通模型 API 完全一致 | 需要锁定特定模型的场景(评测、回归对比、特定能力依赖) |
列表中每个模型带一个「调用示例」入口——点一下,上方接入向导的代码示例就会自动换成该模型。
价格口径
- 固定单价:列表直接给出输入价 / 输出价(¥ / 1M tokens)。每次调用费用 = 输入 tokens × 输入价 + 输出 tokens × 输出价。
- 按量计费(metered):该模型没有固定单价,按实际通道成本结算——最终费用以「用量与账单」页为准。
「用量与账单」页底部的模型价格表同时列出智能路由池与直调模型的计价方式(直调模型也可以被单独定价)。
程序化的价格表可通过 GET /api/pricing 获取(New API 兼容格式,无需鉴权),详见 API 参考。
上下文长度
列表中的「上下文」列为模型支持的最大上下文 tokens 数。超出上下文的请求会被上游拒绝(返回 400 类错误),请控制会话长度或做历史截断/摘要。
常见问题
Q:模型列表里没有我想要的模型? 可用模型由服务提供方维护。如需新增模型或供应商,请联系服务提供方。
Q:路由池会自动切到更贵的模型吗? 路由池按任务难度选档:简单任务落便宜模型,复杂任务落强模型。你也可以通过路由偏好把整体倾向设为「成本优先」,进一步压低选档。