> ## Documentation Index
> Fetch the complete documentation index at: https://docs.tapapi.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# 文本模型

> 聊天、代码、推理、结构化输出和多模态文本模型选型

文本模型是 Tapapi 的主线能力之一，适合聊天问答、内容生成、代码、推理、工具调用、结构化输出和多模态理解。实时可用模型、价格、上下文长度和账号权限以控制台和价格页为准。

<Note>文档不会暴露上游真实路由或未确认模型名。接入时以客户可见模型名作为 `model`，并把模型名放进配置。</Note>

## 当前库存口径

文本模型不是“待补齐才可用”。Tapapi 已覆盖 OpenAI/GPT、Claude、Gemini、Qwen、DeepSeek、GLM、Grok、Kimi、Doubao、Hunyuan 等多类文本和多模态文本模型。主流方向见 [主流模型](/models/mainstream-models)，完整实时列表以控制台和价格页为准。

## 选型维度

| 维度    | 说明                         |
| ----- | -------------------------- |
| 成本    | 高频批量任务优先看单次调用成本            |
| 速度    | 聊天和 AI Coding 更关注首字时间和流式稳定 |
| 上下文   | 长文档、知识库和代码任务关注上下文长度        |
| 指令遵循  | 结构化输出、工具调用和复杂任务关注稳定性       |
| 推理能力  | 复杂分析、规划、数学和多步骤任务需要单独评测     |
| 多模态输入 | 图像、文件或音频输入要看模型是否明确支持       |
| 能力字段  | 工具调用、结构化输出、联网搜索等能力不要靠猜     |

## 常见路线

| 路线      | 适合                   | 选择重点           |
| ------- | -------------------- | -------------- |
| 低成本默认模型 | 客服、摘要、改写、翻译、批量内容处理   | 价格、速度、限流和失败率   |
| 高质量主力模型 | 复杂问答、重要内容、付费用户       | 指令遵循、上下文、稳定性   |
| 推理模型    | 规划、分析、数学、多步骤任务       | 正确率、耗时、成本上限    |
| 代码模型    | AI Coding、代码解释、修复、重构 | 工具调用、长上下文、可运行率 |
| 长上下文模型  | 文档问答、合同、代码仓库分析       | 上下文上限、截断策略、费用  |
| 多模态文本模型 | 看图问答、文件理解、图文审核       | 输入模态、文件大小、响应稳定 |

## 场景建议

| 场景             | 优先看               | 生产注意             |
| -------------- | ----------------- | ---------------- |
| 通用聊天           | 稳定、便宜、流式顺畅        | 记录首字时间和总耗时       |
| 客服 / 自动回复      | 成本、延迟、拒答稳定性       | 保留人工兜底和敏感词处理     |
| 长文档 / 知识库      | 上下文长度、文件能力        | 不要把超长内容硬塞进短上下文模型 |
| 代码 / AI Coding | 指令遵循、工具调用、上下文     | 用真实仓库任务评测，不只看演示  |
| 推理任务           | 推理能力、复杂指令稳定性      | 设置预算上限，避免无限重试    |
| 结构化输出          | JSON / schema 稳定性 | 入库前必须做 schema 校验 |
| 批量改写 / 翻译      | 单次成本、吞吐、限流        | 用队列和批次预算控成本      |

## 生产建议

* 为聊天和流式任务记录首字时间、总耗时和错误码
* 每次请求记录 `X-Oneapi-Request-Id`，方便排查单次失败和对账
* 为结构化输出增加 schema 校验和最多 1-2 次修复重试
* 为批量文本任务设置队列、并发上限和预算上限
* 默认模型和兜底模型分开配置，不要只依赖单个模型
* 涉及文件、图像、工具调用时，先用真实样本验证
* 需要稳定 JSON 时，不要只靠 prompt，业务侧也要校验格式
* 需要工具调用时，先验证模型是否支持工具 schema 和流式返回
* 需要长上下文时，记录输入 token、输出 token 和截断策略

## 接入入口

* [Chat Completions](/text-generation/chat-completions)
* [流式输出](/text-generation/streaming)
* [OpenAI 兼容调用](/text-generation/openai-compatible)
* [模型与参数](/text-generation/models-and-parameters)
* [工具调用](/text-generation/tool-calling)
