模型与选型
可用模型与选型
模型名从哪复制、为什么有的置灰、输入与输出为什么分开报价。
更新于 2026-08-17
模型名从哪来
去「模型与价格」页,点一下就能复制完整模型名。不要凭印象手打 ——
模型名里的版本号、日期后缀差一个字符就是 model_not_allowed。
程序里想动态取,调 GET /v1/models,它返回的就是你这把密钥能用的那些。
「暂不可用」是什么意思
列表里标着暂不可用(接口上是 available: false)的模型,
现在没有上游能服务它。选了会失败,而那不是你的问题。
它是暂时状态,会自己恢复,不需要开工单。要紧的活换一个模型即可。
输入与输出是分开报价的
价格页上每个模型有两个价:输入(你发过去的 token)和输出(模型生成的 token)。
⚠️ 这两个值差得很远。现网所有模型的输出价都是输入价的 3 到 5 倍。 只按输入价估算成本会大幅低估 —— 尤其是让模型写长文、写代码这类输出重的场景。
估算时把两段分别算:
这一笔的费用 = 输入 token × 输入单价 + 输出 token × 输出单价
实际扣费以网关记录为准,控制台「调用明细」里每一笔都把输入、输出、费用分列。
选型的三条经验
- 先用便宜的跑通链路,确认 prompt 和解析都对了,再换贵的模型比效果。
- 输出重的场景优先看输出价,别只比输入价。
- 别为了省钱把 prompt 压到影响效果 —— 输入便宜,重试才贵。