Skip to main content
“模型广场”是选择模型和理解价格的主要入口。充值与余额在“付款与账单”页面处理,用量排查在“控制台与用量”页面处理,本页只关注“选哪个模型”和“价格怎么看”。

筛选模型

按供应商、标签和关键词筛选模型,找到适合当前任务的候选项。

比较价格

查看输入价、输出价、缓存价、按次价格或动态价格说明。

复制模型名

复制模型广场展示的完整模型名称,用于 API 请求中的 model 字段。

页面信息

“模型广场”通常包含:
  • 模型名称:API 请求中 model 字段需要原样填写的值。
  • 供应商:模型来源或兼容通道。
  • 标签:用于搜索和粗略归类的简短标记。
  • 价格:输入、输出、缓存或按次计费价格。

模型名称

请求中的 model 必须使用“模型广场”展示的完整名称。注意:
  • 区分大小写、点号、斜杠和连字符。
  • 不要根据供应商官网名称自行猜测。
  • 同一模型系列的不同版本可能价格、上下文长度和支持范围不同。

API 片段

模型广场中的 API 片段是通用调用模板,用来帮助你理解 OpenAI、Anthropic 或 Google 兼容接口的请求结构。它不是“每个模型都有一套不同 API 写法”。 使用时只需要关注三件事: 如果你只是第一次验证外部调用,优先参考 快速入门 中的直接 HTTP 或 SDK 示例。

Token 与价格

Token 是模型处理文本和计费的基本单位。不同模型的分词器不同,中文、英文、标点、空格、代码和 JSON 都可能被拆成不同数量的 Token。实际消耗以 API 响应中的 usage 字段和“控制台与用量”页面中的日志为准。 常见计费方式:

费用估算

按 Token 计费时,可以用下面的简化公式估算:
页面价格通常按每百万 Token 展示,实际扣费会按真实 Token 数折算。若模型显示为动态价格,请以页面展示的价格说明和最终用量日志为准。

选择建议

  • 简单分类、摘要、格式转换:优先选择低价快速模型。
  • 复杂推理、代码、长文分析:选择推理能力或上下文更强的模型。
  • 图片理解:不要只看标签,先在“对话”页面上传样例测试模型是否支持图片输入。
  • 文档问答:优先确认上下文长度、PDF 支持和价格。
  • 结构化数据:选择支持 JSON 模式或工具调用稳定的模型。

成本优化

  • 缩短不必要的历史上下文。
  • 使用 max_tokens 控制最大输出长度。
  • 把固定系统提示和长文档放在请求前部,以便支持缓存的模型复用。
  • 为项目创建独立 API 密钥并设置额度上限。
  • 定期在“控制台与用量”页面找出高消耗模型和异常请求。

相关文档