模型
逻辑模型、上游重定向、元数据与定价。
逻辑模型
客户端请求的是逻辑模型名。Monoize 把这个名字解析到你的 Provider 和 Channel。客户端看到的名字不需要与上游厂商的名字一致。
一个逻辑模型可以映射到多个 Provider 各自的 Channel。客户端无需任何修改即可获得故障转移。

重定向
Channel 的模型条目可以用 redirect 指定真实的上游模型名。
示例:客户端调用 my-fast-model。一个 Provider 将其重定向到 gpt-4o-mini,另一个 Provider 将其重定向到 claude-3-5-haiku-20241022。计费和日志始终显示逻辑名。
使用 admin 或 super_admin 账户时,请求日志还会在逻辑模型徽标旁显示不同的上游响应模型。
将指针移到模型徽标或 Channel 上,查看实际模型。该值不改变计费。
请参阅请求日志。
模型元数据与定价
模型数据库页面存储模型元数据和 Billing Profile 费率记录。Monoize 从 Models.dev 导入元数据和价格建议。
计费规则:
- 选择模型映射的有效 Billing Profile;
- 为上游模型或逻辑模型选择完整费率矩阵;
- 应用模型倍率覆盖或 Provider 倍率。
每条费率记录同时保存价格和价格货币。手动录入的费率默认以 CNY / 1M tokens 计价。从 Models.dev 导入的费率保持 USD。
价格编辑器带 CNY/USD 货币选择;输入的数字按所选货币直接解释,不做汇率换算。从 Models.dev 导入的费率保持 USD。
编辑器为每个用量类别(含缓存写入 5m 与 1h)设置谷价和可选峰价。峰价仅在北京时间周一至周五 09:00–12:00 与 14:00–18:00 生效。峰价留空则始终按谷价计费。
Monoize 用当前的 CNY/USD 汇率快照换算 CNY 价格,并以纳美元(nano-dollar)为单位把费用累计到每个用户的流水账。如果某个模型使用 CNY 价格而当前没有可用的汇率快照,该模型的请求返回 model_pricing_required,不会按估算汇率扣费。
模型列表
GET /v1/models 返回调用方 API 密钥可用的逻辑模型。结果反映密钥的模型限制和分组归属。
模型通配符
变换规则和部分限制支持模型通配符:
*匹配任意长度的字符序列,包括空序列。?恰好匹配一个字符。- 匹配区分大小写,并锚定整个模型名。
示例:gpt-4* 匹配 gpt-4o 和 gpt-4o-mini,不匹配 o4-mini。
管理计费 Profile
打开工具栏的 Profile 管理。每个 Profile 显示模型数与费率数。
- 复制将全部费率行复制到新 Profile 名下。
- 删除移除该 Profile 及其全部费率行。被匹配规则或 Provider 引用的 Profile 会拒绝删除,并内联显示原因。
同步价格
打开工具栏的 同步,选择 同步 models.dev 或 同步目录。同步完成后,报告显示更新了多少模型、移除了多少,以及哪些模型保留了手动价格。手动价格不会被同步覆盖。
同步 Models.dev 时,Monoize 会为 Anthropic 官方条目补齐 anthropic Profile 的 1 小时缓存写入价格。必须同时满足以下条件:
- 模型 ID 以
claude-开头。 - 输入价格大于零。
- 5 分钟缓存写入价格恰好是输入价格的 1.25 倍。
推导出的价格是输入价格的 2 倍。保存元数据价格时也应用此规则。 如需自定义价格,请在 Provider 的有效 Billing Profile 中设置。手动费率优先,并在同步时保留。 同时存在两种缓存写入费率时,上游必须分别报告 5 分钟和 1 小时的写入用量。 如果上游只提供缓存创建总量,结算会失败;Monoize 不会估算两种用量的比例。
直接添加模型价格
打开工具栏的 添加价格,输入模型名,在右侧面板填写各价格项。模型无需先有元数据,Profile 也不绑定单个 channel——凡通过该 Profile 路由此模型的 Provider 都按这些价格计费。
跨账户类共享 Profile
计费 Profile 不专属于某个账户类。任意 Provider 可引用任意 Profile 名。价格隔离依然成立:每个请求只解析自己类的 Provider 的 Profile;跨类共享一个 Profile 只意味着两个类用同样的价格。需要不同价格时,再为各类复制 Profile。
模型限制
价格编辑器的模型限制卡片设置上下文窗口与 token 上限(最大输入/输出/总量)。留空表示不限制。没有元数据记录时保存会自动创建,可与新价格一起设置。