> ## Documentation Index
> Fetch the complete documentation index at: https://docs.tapapi.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# 如何选择模型

> 按模态、质量、速度、成本和场景选择模型

选模型时不要先问“哪个最强”，而是先判断任务类型、输入输出模态、生产风险和成本上限。Tapapi 的模型、价格、分组和权限会随控制台配置变化，文档提供选型方法，实时可调用状态以控制台和价格页为准。

<Note>生产代码里不要把模型名散落写死。建议把默认模型、兜底模型和实验模型都放进配置，并在日志里记录每次实际调用的 `model` 和 `X-Oneapi-Request-Id`。</Note>
<Note>Tapapi 已接入的模型远不止文档里的精选详情页。模型中心只放主流模型族和重点说明；完整实时列表以控制台和价格页为准。</Note>

## 第一步：先选模态

| 任务             | 输入 -> 输出                  | 去哪里                          |
| -------------- | ------------------------- | ---------------------------- |
| 聊天、摘要、改写、翻译、代码 | text -> text              | [文本模型](/models/text-models)  |
| 图像理解、多模态问答     | text + image/file -> text | [文本模型](/models/text-models)  |
| 文生图            | text -> image             | [图片模型](/models/image-models) |
| 图生图、多参考图、图片编辑  | text + image -> image     | [图片模型](/models/image-models) |
| 文生视频、图生视频      | text/image -> video       | [视频模型](/models/video-models) |
| 知识库检索、相似度召回    | text -> embedding         | [模型对比](/models/comparison)   |
| 语音生成或转写        | text/audio -> audio/text  | [模型对比](/models/comparison)   |

## 第二步：按业务目标选

| 目标                 | 优先考虑                 | 不建议一开始做               |
| ------------------ | -------------------- | --------------------- |
| 跑通 API             | 便宜、快、参数少的模型          | 直接上最贵模型               |
| 批量文本处理             | 低成本文本模型 + 明确重试上限     | 让用户请求直接打模型            |
| AI Coding / 工具调用   | 指令遵循、上下文和流式稳定        | 只按价格选                 |
| 文生图批量              | 低成本图片模型 + `n: 1` 队列  | 直接 `n > 1` 大并发        |
| 商品图 / 营销图          | 商品图友好的图片模型 + 自有存储    | 依赖临时图片 URL            |
| 高质量精修              | 高质量模型 + 人工审核         | 用高质量模型跑大批量草稿          |
| 视频生成               | 受控开放模型 + 任务轮询 + 输出转存 | 写进默认生产链路              |
| Embedding / Rerank | 召回质量、维度、单位成本         | 只看模型名不做检索评测           |
| 音频                 | 输入输出类型、延迟、价格单位       | 把 TTS、ASR、Realtime 混用 |

## 第三步：给模型分角色

| 角色    | 选择原则                  | 用法             |
| ----- | --------------------- | -------------- |
| 默认模型  | 成本、速度、质量均衡，能覆盖大多数常规请求 | 生产主链路          |
| 兜底模型  | 同模态、接口兼容、失败时可切换       | 默认模型故障或维护时启用   |
| 高质量模型 | 效果优先，成本可接受            | 付费用户、关键任务、人工审核 |
| 低成本模型 | 便宜、吞吐高、可接受轻微质量波动      | 草稿、预览、批量低价值任务  |
| 实验模型  | 新接入、受控开放或参数未完全稳定      | 灰度、小样本评估       |

生产环境不要只配一个模型。默认模型解决日常吞吐，兜底模型解决可用性，高质量模型解决高价值请求，实验模型只进入灰度。

## 第四步：小样本评测

1. 从真实业务里抽 20-50 条样本，不要只用演示 prompt。
2. 每个候选模型使用同一批输入，记录返回内容、耗时和错误码。
3. 文本任务看指令遵循、格式稳定、首字时间和总耗时。
4. 图片任务看可用率、主体稳定、尺寸比例、转存字段和单张成本。
5. 视频任务看任务提交、轮询、完成耗时、输出文件和失败返还。
6. 最后再决定默认模型、兜底模型、预算上限和降级策略。

## 不建议的选法

* 只选最便宜的模型，不测失败率和人工可用率
* 只看单张样例效果，不测真实批量
* 只看文档里的模型介绍，不确认账号是否有权限
* 把受控开放模型直接放进默认生产链路
* 没有记录实际 `model`、价格、耗时和错误码
* 没有记录 `request_id`，导致扣费、超时和失败无法定位
* 没有为 429、5xx、超时和内容安全拒绝设置降级路径

## 快速入口

* 文本任务看 [文本模型](/models/text-models)
* 主流模型看 [主流模型](/models/mainstream-models)
* 图片任务看 [图片模型](/models/image-models)
* 视频任务看 [视频模型](/models/video-models)
* 横向评估看 [模型对比](/models/comparison)
* 状态口径看 [模型状态](/models/status)
