> ## Documentation Index
> Fetch the complete documentation index at: https://docs.moxus.cloud/llms.txt
> Use this file to discover all available pages before exploring further.

# 模型广场与定价

> 在模型广场中筛选模型、查看普通标签、理解价格展示，并选择适合任务的模型。

“模型广场”是选择模型和理解价格的主要入口。充值与余额在“付款与账单”页面处理，用量排查在“控制台与用量”页面处理，本页只关注“选哪个模型”和“价格怎么看”。

<Columns cols={3}>
  <Card title="筛选模型" icon="sliders-horizontal">
    按供应商、标签和关键词筛选模型，找到适合当前任务的候选项。
  </Card>

  <Card title="比较价格" icon="chart-no-axes-combined">
    查看输入价、输出价、缓存价、按次价格或动态价格说明。
  </Card>

  <Card title="复制模型名" icon="copy">
    复制模型广场展示的完整模型名称，用于 API 请求中的 `model` 字段。
  </Card>
</Columns>

## 页面信息

“模型广场”通常包含：

* 模型名称：API 请求中 `model` 字段需要原样填写的值。
* 供应商：模型来源或兼容通道。
* 标签：用于搜索和粗略归类的简短标记。
* 价格：输入、输出、缓存或按次计费价格。

## 模型名称

请求中的 `model` 必须使用“模型广场”展示的完整名称。注意：

* 区分大小写、点号、斜杠和连字符。
* 不要根据供应商官网名称自行猜测。
* 同一模型系列的不同版本可能价格、上下文长度和支持范围不同。

## API 片段

模型广场中的 API 片段是通用调用模板，用来帮助你理解 OpenAI、Anthropic 或 Google 兼容接口的请求结构。它不是“每个模型都有一套不同 API 写法”。

使用时只需要关注三件事：

| 项    | 说明                                      |
| ---- | --------------------------------------- |
| 接口协议 | 按你的客户端选择 OpenAI、Anthropic 或 Google 兼容写法 |
| 模型名称 | 将模板里的 `model` 替换为模型广场中复制的完整名称           |
| 参数支持 | 不同模型支持的参数不同，不支持的参数可能会被忽略或报错             |

如果你只是第一次验证外部调用，优先参考 [快速入门](/zh/overview/quickstart) 中的直接 HTTP 或 SDK 示例。

## Token 与价格

Token 是模型处理文本和计费的基本单位。不同模型的分词器不同，中文、英文、标点、空格、代码和 JSON 都可能被拆成不同数量的 Token。实际消耗以 API 响应中的 `usage` 字段和“控制台与用量”页面中的日志为准。

常见计费方式：

| 类型   | 说明                                 |
| ---- | ---------------------------------- |
| 输入价格 | 请求内容、历史消息、系统提示词、文档上下文等输入 Token 的价格 |
| 输出价格 | 模型生成内容的 Token 价格                   |
| 缓存价格 | 命中或写入提示缓存时使用的价格                    |
| 按次价格 | 图像生成、部分专用模型或工具调用可能按请求次数计费          |
| 动态价格 | 某些模型会按请求参数、工具调用或分层规则计算价格           |

## 费用估算

按 Token 计费时，可以用下面的简化公式估算：

```text theme={null}
单次费用 = 输入 Token 数 × 输入单价 + 输出 Token 数 × 输出单价
```

页面价格通常按每百万 Token 展示，实际扣费会按真实 Token 数折算。若模型显示为动态价格，请以页面展示的价格说明和最终用量日志为准。

## 选择建议

* 简单分类、摘要、格式转换：优先选择低价快速模型。
* 复杂推理、代码、长文分析：选择推理能力或上下文更强的模型。
* 图片理解：不要只看标签，先在“对话”页面上传样例测试模型是否支持图片输入。
* 文档问答：优先确认上下文长度、PDF 支持和价格。
* 结构化数据：选择支持 JSON 模式或工具调用稳定的模型。

## 成本优化

* 缩短不必要的历史上下文。
* 使用 `max_tokens` 控制最大输出长度。
* 把固定系统提示和长文档放在请求前部，以便支持缓存的模型复用。
* 为项目创建独立 API 密钥并设置额度上限。
* 定期在“控制台与用量”页面找出高消耗模型和异常请求。

## 相关文档

* [付款与账单](/zh/platform/billing)
* [控制台与用量](/zh/platform/dashboard-and-usage)
* [对话](/zh/platform/playground)
