合并「各厂商官方价源」与「岚图报价单源」,清理已下线机型、补充同系列新机型后的单一入口。 440 个模型键,其中 25 个走官方分档 / 分模态计费表达式。
/full_ratio_config.json
—— new-api ratio_sync 的 type1 格式:
{"success": true, "data": {
"model_ratio": {...}, "completion_ratio": {...}, "cache_ratio": {...},
"model_price": {...}, "billing_mode": {...}, "billing_expr": {...}
}}
/model_ratio.json · /completion_ratio.json
· /cache_ratio.json · /model_price.json/billing_mode.json · /billing_expr.json
—— 官方有上下文分档的模型| 来源 | 说明 |
|---|---|
| 各厂商官方价源 2026-04-26 |
Anthropic / Google / OpenAI 官方定价页 + Qwen / Doubao 官方文档,覆盖面广 |
| 岚图报价单源 2026-08-24 |
图灵中科报价单的官网参考价格列,逐条核过官方模型 ID,带官方分档表达式 |
| 冲突取舍 | 报价单源胜出——它更新、模型 ID 逐条核实过,且对官方有上下文分档的模型带
billing_expr,比老源的「取最贵档」单值更准。实际冲突 5 条,全部是档位口径差异。 |
只清厂商已下线的代际;仍在服务的 gemini-2.5-*、gpt-5.x、
qwen3-*、豆包 seed 1.x 一律保留。
| 厂商 | 清理内容 |
|---|---|
| OpenAI(38) | gpt-3.5 / gpt-4 / gpt-4o 聊天线 / gpt-4.1 / o1 / o3 / o4 / dall-e / tts-1 / ada-002 |
| Alibaba(18) | qwen2.5 全系及更早 |
| Anthropic(10) | claude-3 / 3.5 / 3.7 全系 |
| ByteDance(6) | 豆包 1.x(非 seed) |
| Google(1) | veo-2 |
gpt-4o-mini-tts 正是 tts-1 的替代者,
gpt-4o-transcribe 系列是现役 STT,audio / realtime 也未见下线证据——这些不跟 4o 聊天模型一起删。
claude-opus-5、gpt-5.6、gpt-realtime-2.1、gemini-3.7-flash、
gemini-3.1-flash-lite、gemini-flash-latest、gemini-omni-flash-preview、
deepseek-chat / deepseek-reasoner、glm-4.7-flashx / glm-5v-turbo、
qwen3.8-max / qwen3.7-flash / qwen3-vl-*、grok-4.3 / 4.5 / 4.6 等。
glm-5.3 —— 8 / 28 / 缓存 2 元每百万tokens(1M 单档,与 GLM-5.2 同价)doubao-seed-2-0-pro-260215 —— 3.2 / 16 / 0.64 元,且官方带三档上下文分档,已生成 billing_exprdoubao-seedance-2-5-260628 —— 70 元每百万tokens(480p/720p 输入不含视频基准档)qwen-image-3.0 0.18 元/张 · qwen-image-3.0-pro 0.25 元/张wan2.7-image 0.20 元/张 · wan2.7-image-pro 0.50 元/张meshy-7 —— 图生3D含纹理 30 积分 = $0.60(与 meshy-6 同价)relay/channel/task/doubao/constants.go 的 videoPriceTable 逐条吻合(46/28、51/31、26/16),
现已按官方基准档录入。
/deprecated.json —— 清理了哪些、为什么,以及
哪些从同步源删掉后本地内置也没有兜底(30 个)。这类模型若仍被调用,
new-api 会报「价格未配置」而不是静默高价,均为已下线机型。/tier_fixed.json —— 9 个原按最高规格收费的千问模型,已全部改为官方分档计费。
suspected_overcharge.json 现已归零。/pending_price.json —— 已清空:原先的 8 个待补价机型
已全部用浏览器在官方价格页查到并录入。/provenance.json 记录每个键来自哪个源。
老源当年为保守计费,对分档模型统一取了 最贵上下文档 / 思考档输出 / 最贵模态,
而 model_ratio 只能存一个数,于是普通的短上下文、非思考、纯文本调用也按最贵档结算。
现已按百炼官方中国内地价表(浏览器实抓 2026-08-24)改为分档 / 分模态计费。
| 模型 | 类型 | 原输入价 | 现基准价 | 降幅 |
|---|---|---|---|---|
qwen-omni-turbo | 分模态 | $3.5714 | $0.0571 | 62.5× |
qwen-omni-turbo-realtime | 分模态 | $3.5714 | $0.2286 | 15.6× |
qwen3-omni-flash | 分模态 | $2.2571 | $0.2571 | 8.8× |
qwen3-omni-flash-realtime | 分模态 | $2.7000 | $0.3143 | 8.6× |
qwen-flash | 上下文分档 | $0.1714 | $0.0214 | 8.0× |
qwen-plus | 上下文分档 | $0.6857 | $0.1143 | 6.0× |
qwen3-coder-plus | 上下文分档 | $2.8571 | $0.5714 | 5.0× |
qwen3-coder-flash | 上下文分档 | $0.7143 | $0.1429 | 5.0× |
qwen3-vl-plus | 上下文分档 | $0.4286 | $0.1429 | 3.0× |
分模态用的是表达式的 ai(音频输入)/ img(图片输入)/ ao(音频输出)变量——
引擎会自动把它们从 p 里扣除,不会重复计费。文本输出价还会按「本次输入是否含多模态」在两档间切换:
qwen-omni-turbo:
tier("base", p * 0.057143 + ai * 3.57143 + img * 0.214286
+ c * (ai > 0 || img > 0 ? 0.642857 : 0.228571) + ao * 7.14286)
qwen-plus 官方还分非思考 / 思考两种输出价(≤128K 档是 2 元 vs 8 元),
用 param("enable_thinking") 读请求体区分。保守取值:只有显式传
enable_thinking=false 才走便宜档,缺省按思考档计价,避免客户端默认开思考却按便宜档结算。
pricing/unified/_verify_tierfix。
USD 计价,new-api 约定 1 倍率 = $2 / 百万 tokens model_ratio = usd_input_per_m / 2 completion_ratio = usd_output / usd_input cache_ratio = usd_cache_hit / usd_input model_price = USD/次(按张、按次)或 USD/秒(视频,new-api 再乘 seconds)
provenance.json 里标注来源,需要精确对齐内地价的请自行复核。
custom,路径填 /full_ratio_config.json25 条 billing_expr 已通过 new-api 引擎的编译与官方 SmokeTestExpr 校验。