统一模型倍率源

合并「各厂商官方价源」与「岚图报价单源」,清理已下线机型、补充同系列新机型后的单一入口。 440 个模型键,其中 25 个走官方分档 / 分模态计费表达式。

主入口

/full_ratio_config.json —— new-api ratio_sync 的 type1 格式:

{"success": true, "data": {
  "model_ratio": {...}, "completion_ratio": {...}, "cache_ratio": {...},
  "model_price": {...}, "billing_mode": {...}, "billing_expr": {...}
}}

合并规则

来源说明
各厂商官方价源
2026-04-26
Anthropic / Google / OpenAI 官方定价页 + Qwen / Doubao 官方文档,覆盖面广
岚图报价单源
2026-08-24
图灵中科报价单的官网参考价格列,逐条核过官方模型 ID,带官方分档表达式
冲突取舍 报价单源胜出——它更新、模型 ID 逐条核实过,且对官方有上下文分档的模型带 billing_expr,比老源的「取最贵档」单值更准。实际冲突 5 条,全部是档位口径差异。

已清理(73 个)

只清厂商已下线的代际;仍在服务的 gemini-2.5-*gpt-5.xqwen3-*、豆包 seed 1.x 一律保留。

厂商清理内容
OpenAI(38)gpt-3.5 / gpt-4 / gpt-4o 聊天线 / gpt-4.1 / o1 / o3 / o4 / dall-e / tts-1 / ada-002
Alibaba(18)qwen2.5 全系及更早
Anthropic(10)claude-3 / 3.5 / 3.7 全系
ByteDance(6)豆包 1.x(非 seed)
Google(1)veo-2
现役音频/实时线已排除在清理外gpt-4o-mini-tts 正是 tts-1 的替代者, gpt-4o-transcribe 系列是现役 STT,audio / realtime 也未见下线证据——这些不跟 4o 聊天模型一起删。

已新增(35 个)

claude-opus-5gpt-5.6gpt-realtime-2.1gemini-3.7-flashgemini-3.1-flash-litegemini-flash-latestgemini-omni-flash-previewdeepseek-chat / deepseek-reasonerglm-4.7-flashx / glm-5v-turboqwen3.8-max / qwen3.7-flash / qwen3-vl-*grok-4.3 / 4.5 / 4.6 等。

原先查不到价的 8 个已用浏览器在各家官方价格页逐一查到,全部按内地人民币官方价 ÷7 录入: 顺带补回了豆包 Seedance 全系。之前因报价单按元/秒计价、与 new-api 的 token 计费口径不符而跳过; 官方价格页确认 Seedance 就是按元/百万tokens 计价,且各档数值与 new-api relay/channel/task/doubao/constants.govideoPriceTable 逐条吻合(46/28、51/31、26/16), 现已按官方基准档录入。

必看的三份报告

/provenance.json 记录每个键来自哪个源。

按最高规格收费 → 官方分档(9 个)

老源当年为保守计费,对分档模型统一取了 最贵上下文档 / 思考档输出 / 最贵模态, 而 model_ratio 只能存一个数,于是普通的短上下文、非思考、纯文本调用也按最贵档结算。 现已按百炼官方中国内地价表(浏览器实抓 2026-08-24)改为分档 / 分模态计费。

模型类型原输入价现基准价降幅
qwen-omni-turbo分模态$3.5714$0.057162.5×
qwen-omni-turbo-realtime分模态$3.5714$0.228615.6×
qwen3-omni-flash分模态$2.2571$0.25718.8×
qwen3-omni-flash-realtime分模态$2.7000$0.31438.6×
qwen-flash上下文分档$0.1714$0.02148.0×
qwen-plus上下文分档$0.6857$0.11436.0×
qwen3-coder-plus上下文分档$2.8571$0.57145.0×
qwen3-coder-flash上下文分档$0.7143$0.14295.0×
qwen3-vl-plus上下文分档$0.4286$0.14293.0×

分模态用的是表达式的 ai(音频输入)/ img(图片输入)/ ao(音频输出)变量—— 引擎会自动把它们从 p 里扣除,不会重复计费。文本输出价还会按「本次输入是否含多模态」在两档间切换:

qwen-omni-turbo:
tier("base", p * 0.057143 + ai * 3.57143 + img * 0.214286
     + c * (ai > 0 || img > 0 ? 0.642857 : 0.228571) + ao * 7.14286)

qwen-plus 官方还分非思考 / 思考两种输出价(≤128K 档是 2 元 vs 8 元), 用 param("enable_thinking") 读请求体区分。保守取值:只有显式传 enable_thinking=false 才走便宜档,缺省按思考档计价,避免客户端默认开思考却按便宜档结算。

已逐场景验证:32 个场景(各档位边界、各模态、思考/非思考)跑 new-api 计费引擎, 算出的价与百炼官方内地价全部精确一致。校验程序见 pricing/unified/_verify_tierfix

口径

USD 计价,new-api 约定 1 倍率 = $2 / 百万 tokens
model_ratio      = usd_input_per_m / 2
completion_ratio = usd_output / usd_input
cache_ratio      = usd_cache_hit / usd_input
model_price      = USD/次(按张、按次)或 USD/秒(视频,new-api 再乘 seconds)
国产模型存在「中国内地人民币价」与「国际美元价」两种口径。老源与报价单源用的是内地价; 新增的智谱 / 阿里条目取自 models.dev 的国际价(偏高,属保守),已在 provenance.json 里标注来源,需要精确对齐内地价的请自行复核。

在 new-api 里接入

  1. 渠道管理 → 新建一个禁用渠道,BaseURL 填本站域名
  2. 系统设置 → 上游倍率同步 → 选中该渠道,endpoint 选 custom,路径填 /full_ratio_config.json
  3. 预览差异 → 确认后应用同步

25 条 billing_expr 已通过 new-api 引擎的编译与官方 SmokeTestExpr 校验。