> ## Documentation Index
> Fetch the complete documentation index at: https://docs.tapapi.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# 模型对比

> 价格、速度、能力和适用场景对比

模型对比不是找一个“全场最强模型”，而是给每类业务选出默认模型、兜底模型和实验模型。实时价格、可见分组、账号权限和模型上下线以控制台和价格页为准，本页只提供对比方法和生产评估口径。

<Note>模型中心只展示主流模型族和选型方法，不做完整库存表。横向看主流方向请先看 [主流模型](/models/mainstream-models)，实时可调用列表以控制台和价格页为准。</Note>

## 多模态总览

| 模态                 | 主要调用形态           | 生产选择重点                    |
| ------------------ | ---------------- | ------------------------- |
| 文本                 | 同步或流式            | 上下文、速度、成本、指令遵循、工具调用、结构化输出 |
| 图片                 | 文生图主线，部分模型支持图片输入 | 质量、速度、价格、尺寸、输出保存、失败重试     |
| 视频                 | 任务式，受控开放         | 时长、分辨率、任务轮询、输出文件、成本和失败返还  |
| Embedding / Rerank | 检索或排序            | 召回质量、维度、语种、批量成本、延迟        |
| 音频                 | TTS、ASR、Realtime | 输入输出类型、延迟、价格单位、流式能力       |

## 核心对比维度

| 维度   | 看什么                   | 适用场景              |
| ---- | --------------------- | ----------------- |
| 质量   | 人工可用率、指令遵循、稳定性        | 终稿、客服、代码、商品图      |
| 速度   | 首字时间、总耗时、P95 耗时       | 聊天、AI Coding、批量生成 |
| 成本   | 每次、每张、每秒、每百万 token    | 高频调用、批量任务         |
| 输入能力 | 文本、图片、文件、音频、视频        | 多模态理解、图生图、转写      |
| 输出能力 | 文本、图片、视频、音频、embedding | 生成任务和检索任务         |
| 接口形态 | 同步、流式、任务轮询            | 长任务、前端体验、队列设计     |
| 稳定性  | 成功率、限流、错误码、维护频率       | 生产默认模型和兜底模型       |

## 场景推荐

| 场景             | 优先看             | 记录指标             |
| -------------- | --------------- | ---------------- |
| 聊天客服           | 首字时间、流式稳定、成本    | 平均响应时间、失败率、人工满意度 |
| 长文档 / 知识库      | 上下文长度、文件能力、召回质量 | 上下文命中率、超长失败率     |
| 代码 / AI Coding | 指令遵循、工具调用、上下文   | 修复成功率、可运行率、成本    |
| 结构化输出          | JSON 稳定性、函数调用   | schema 通过率、重试次数  |
| 批量改写 / 翻译      | 单次成本、吞吐、限流      | 每千条成本、P95 耗时     |
| 商品图生成          | 主体完整、背景、尺寸比例    | 人工可用率、单张成本、转存成功率 |
| 广告图 / 社媒图      | 审美、文字处理、风格一致    | 可用图比例、返工率        |
| 视频生成           | 任务完成率、轮询耗时、输出文件 | 完成耗时、失败返还、转存成功率  |
| 知识库检索          | 向量质量、维度、语义召回    | Top-K 命中率、检索成本   |

## 图片模型对比

图片模型更新快，价格和可见权限以控制台为准。文档里的图片模型详情页用于解释典型定位，不代表控制台实时可见的全部模型。

| 定位        | 适合           | 不适合        | 重点验证             |
| --------- | ------------ | ---------- | ---------------- |
| 低成本批量     | 草稿、预览、低价值素材  | 终稿精修       | 单张成本、失败率、并发限制    |
| 高质量文生图    | 海报、品牌视觉、付费用户 | 大批量草稿      | 可用率、人工返工率、耗时     |
| 商品图       | 电商主图、白底图、场景图 | 强创意广告      | 主体完整、背景干净、转存字段   |
| 人物 / 社媒风格 | 头像、封面、小红书风格  | 严格身份一致     | 人脸稳定、审核拒绝率       |
| 指令遵循 / 编辑 | 局部修改、复杂指令    | 未确认字段的生产请求 | 输入图片字段、输出格式、失败计费 |

## 图片能力边界

| 能力           | 当前建议                                |
| ------------ | ----------------------------------- |
| 文生图          | 当前公开主线，优先用 `/v1/images/generations` |
| 图生图          | 按具体模型确认，不要把未开放字段写进默认生产请求            |
| 多参考图         | 按具体模型确认，等待明确白名单和计费说明                |
| 图片编辑         | 条件能力，仅在模型明确支持时使用                    |
| Webhook / 轮询 | 当前不要当作图片接口稳定能力                      |

## 视频模型对比

视频模型按受控开放维护。即使状态页显示视频能力正常，也必须先确认控制台可见模型、账号权限、价格和具体接口字段。

| 场景    | 优先看             | 上线建议         |
| ----- | --------------- | ------------ |
| 文生短视频 | 提示词控制、画面稳定、时长   | 先灰度，不做默认生产能力 |
| 图生视频  | 主体保持、首帧/参考图一致   | 必须转存输出文件     |
| 电商素材  | 商品形态稳定、背景干净     | 控制并发和预算上限    |
| 批量生产  | 任务完成率、失败返还、排队耗时 | 必须设计任务队列和轮询  |

## 生产对比方法

1. 每个候选模型准备同一批 20-50 条真实 prompt。
2. 记录成功率、平均耗时、P95 耗时、人工可用率、单次成本。
3. 分开测试默认模型、低成本模型、高质量模型和兜底模型。
4. 文本任务额外记录首字时间、JSON/schema 通过率和工具调用成功率。
5. 图片任务额外记录 `data.length`、`metadata.tapapi_partial`、输出保存和失败返还。
6. 视频任务额外记录 `task_id`、轮询状态、完成耗时、输出转存和失败返还。
7. 每次请求保存 `X-Oneapi-Request-Id`，用于排查单次请求和对账。
8. 最后再决定默认模型和兜底模型，不要只看单次样例效果。

## 上线前清单

* 控制台能看到该模型，且账号分组有权限
* 价格页显示的价格单位和业务预算一致
* 已确认输入和输出模态，不把文本模型当图片或视频模型调用
* 已记录成功率、P95 耗时、失败率和实际扣费
* 已记录 `X-Oneapi-Request-Id`、业务 `task_id` 和最终结算字段
* 已设计兜底模型、有限重试和降级策略
* 图片和视频输出已转存到自己的对象存储
* 受控开放模型只进入灰度，不作为默认生产链路
