筛选模型
按供应商、标签和关键词筛选模型,找到适合当前任务的候选项。
比较价格
查看输入价、输出价、缓存价、按次价格或动态价格说明。
复制模型名
复制模型广场展示的完整模型名称,用于 API 请求中的
model 字段。页面信息
“模型广场”通常包含:- 模型名称:API 请求中
model字段需要原样填写的值。 - 供应商:模型来源或兼容通道。
- 标签:用于搜索和粗略归类的简短标记。
- 价格:输入、输出、缓存或按次计费价格。
模型名称
请求中的model 必须使用“模型广场”展示的完整名称。注意:
- 区分大小写、点号、斜杠和连字符。
- 不要根据供应商官网名称自行猜测。
- 同一模型系列的不同版本可能价格、上下文长度和支持范围不同。
API 片段
模型广场中的 API 片段是通用调用模板,用来帮助你理解 OpenAI、Anthropic 或 Google 兼容接口的请求结构。它不是“每个模型都有一套不同 API 写法”。 使用时只需要关注三件事:
如果你只是第一次验证外部调用,优先参考 快速入门 中的直接 HTTP 或 SDK 示例。
Token 与价格
Token 是模型处理文本和计费的基本单位。不同模型的分词器不同,中文、英文、标点、空格、代码和 JSON 都可能被拆成不同数量的 Token。实际消耗以 API 响应中的usage 字段和“控制台与用量”页面中的日志为准。
常见计费方式:
费用估算
按 Token 计费时,可以用下面的简化公式估算:选择建议
- 简单分类、摘要、格式转换:优先选择低价快速模型。
- 复杂推理、代码、长文分析:选择推理能力或上下文更强的模型。
- 图片理解:不要只看标签,先在“对话”页面上传样例测试模型是否支持图片输入。
- 文档问答:优先确认上下文长度、PDF 支持和价格。
- 结构化数据:选择支持 JSON 模式或工具调用稳定的模型。
成本优化
- 缩短不必要的历史上下文。
- 使用
max_tokens控制最大输出长度。 - 把固定系统提示和长文档放在请求前部,以便支持缓存的模型复用。
- 为项目创建独立 API 密钥并设置额度上限。
- 定期在“控制台与用量”页面找出高消耗模型和异常请求。
