文档不会暴露上游真实路由或未确认模型名。接入时以客户可见模型名作为
model,并把模型名放进配置。当前库存口径
文本模型不是“待补齐才可用”。Tapapi 已覆盖 OpenAI/GPT、Claude、Gemini、Qwen、DeepSeek、GLM、Grok、Kimi、Doubao、Hunyuan 等多类文本和多模态文本模型。主流方向见 主流模型,完整实时列表以控制台和价格页为准。选型维度
常见路线
场景建议
生产建议
- 为聊天和流式任务记录首字时间、总耗时和错误码
- 每次请求记录
X-Oneapi-Request-Id,方便排查单次失败和对账 - 为结构化输出增加 schema 校验和最多 1-2 次修复重试
- 为批量文本任务设置队列、并发上限和预算上限
- 默认模型和兜底模型分开配置,不要只依赖单个模型
- 涉及文件、图像、工具调用时,先用真实样本验证
- 需要稳定 JSON 时,不要只靠 prompt,业务侧也要校验格式
- 需要工具调用时,先验证模型是否支持工具 schema 和流式返回
- 需要长上下文时,记录输入 token、输出 token 和截断策略