统一模型倍率源

合并「各厂商官方价源」与「岚图报价单源」,清理已下线机型、补充同系列新机型后的单一入口。 351 个模型键,其中 35 个走官方分档 / 分模态计费表达式。

主入口

/full_ratio_config.json —— new-api ratio_sync 的 type1 格式:

{"success": true, "data": {
  "model_ratio": {...}, "completion_ratio": {...}, "cache_ratio": {...},
  "model_price": {...}, "billing_mode": {...}, "billing_expr": {...}
}}

合并规则

来源说明
各厂商官方价源
2026-04-26
Anthropic / Google / OpenAI 官方定价页 + Qwen / Doubao 官方文档,覆盖面广
岚图报价单源
2026-08-24
图灵中科报价单的官网参考价格列,逐条核过官方模型 ID,带官方分档表达式
冲突取舍 报价单源胜出——它更新、模型 ID 逐条核实过,且对官方有上下文分档的模型带 billing_expr,比老源的「取最贵档」单值更准。实际冲突 5 条,全部是档位口径差异。

已清理(78 个)

只清厂商已下线的代际;仍在服务的 gemini-2.5-*gpt-5.xqwen3-*、豆包 seed 1.x 一律保留。

厂商清理内容
OpenAI(38)gpt-3.5 / gpt-4 / gpt-4o 聊天线 / gpt-4.1 / o1 / o3 / o4 / dall-e / tts-1 / ada-002
Alibaba(18)qwen2.5 全系及更早
Anthropic(10)claude-3 / 3.5 / 3.7 全系
ByteDance(6)豆包 1.x(非 seed)
Google(1)veo-2
现役音频/实时线已排除在清理外gpt-4o-mini-tts 正是 tts-1 的替代者, gpt-4o-transcribe 系列是现役 STT,audio / realtime 也未见下线证据——这些不跟 4o 聊天模型一起删。

已新增(35 个)

claude-opus-5gpt-5.6gpt-realtime-2.1gemini-3.7-flashgemini-3.1-flash-litegemini-flash-latestgemini-omni-flash-previewdeepseek-chat / deepseek-reasonerglm-4.7-flashx / glm-5v-turboqwen3.8-max / qwen3.7-flash / qwen3-vl-*grok-4.3 / 4.5 / 4.6 等。

原先查不到价的 8 个已用浏览器在各家官方价格页逐一查到,全部按内地人民币官方价 ÷7 录入: 顺带补回了豆包 Seedance 全系。之前因报价单按元/秒计价、与 new-api 的 token 计费口径不符而跳过; 官方价格页确认 Seedance 就是按元/百万tokens 计价,且各档数值与 new-api relay/channel/task/doubao/constants.govideoPriceTable 逐条吻合(46/28、51/31、26/16), 现已按官方基准档录入。

必看的三份报告

/provenance.json 记录每个键来自哪个源。

按最高规格收费 → 官方分档(11 个)

老源当年为保守计费,对分档模型统一取了 最贵上下文档 / 思考档输出 / 最贵模态, 而 model_ratio 只能存一个数,于是普通的短上下文、非思考、纯文本调用也按最贵档结算。 现已按百炼官方中国内地价表(浏览器实抓 2026-08-24)改为分档 / 分模态计费。

模型类型原输入价现基准价降幅
qwen-omni-turbo分模态$3.5714$0.057162.5×
qwen-omni-turbo-realtime分模态$3.5714$0.228615.6×
qwen3-omni-flash分模态$2.2571$0.25718.8×
qwen3-omni-flash-realtime分模态$2.7000$0.31438.6×
qwen-flash上下文分档$0.1714$0.02148.0×
qwen-plus上下文分档$0.6857$0.11436.0×
qwen3-coder-plus上下文分档$2.8571$0.57145.0×
qwen3-coder-flash上下文分档$0.7143$0.14295.0×
qwen3-vl-plus上下文分档$0.4286$0.14293.0×
qwen-turbo思考档输出输出 $0.4286 → $0.08575.0×
qwen3-livetranslate-flash-realtime分模态文本输出 $34.29 → $9.143.75×

最后两个是补检出的:最初的检出器只比对输入价,漏掉了「只有输出被抬高」的情况 (qwen-turbo 输入是对的,输出取了思考档;qwen3-livetranslate 输入输出都取了音频价)。 补上输出侧比对后又捞出这 2 个,现已一并修正。

分模态用的是表达式的 ai(音频输入)/ img(图片输入)/ ao(音频输出)变量—— 引擎会自动把它们从 p 里扣除,不会重复计费。文本输出价还会按「本次输入是否含多模态」在两档间切换:

qwen-omni-turbo:
tier("base", p * 0.057143 + ai * 3.57143 + img * 0.214286
     + c * (ai > 0 || img > 0 ? 0.642857 : 0.228571) + ao * 7.14286)

qwen-plus 官方还分非思考 / 思考两种输出价(≤128K 档是 2 元 vs 8 元), 用 param("enable_thinking") 读请求体区分。保守取值:只有显式传 enable_thinking=false 才走便宜档,缺省按思考档计价,避免客户端默认开思考却按便宜档结算。

已逐场景验证:32 个场景(各档位边界、各模态、思考/非思考)跑 new-api 计费引擎, 算出的价与百炼官方内地价全部精确一致。校验程序见 pricing/unified/_verify_tierfix

老源全量对账

对老源里 models.dev 覆盖不到的条目做了一次全量对账,数据源是各厂官方价格页(浏览器实抓 2026-08-25): 百炼「模型价格」、火山方舟「模型价格·在线推理常规档」、OpenAI / Google / Anthropic 官方定价页。

厂商结果
阿里(150)127 在官方表中匹配到(含日期快照/-latest 别名继承)。 34 个按官方基准档校正34 个别名继承分档表达式,66 个核对一致。 5 个是真历史模型(qwq-32b-preview 等),官方表已无。
字节(52)27 匹配,20 个按官方价校正(豆包 seed 1.x / 2.0 系列原先高 3–4 倍)。 图像 / 3D / 向量模型逐个核对全部一致
OpenAI / Google / Anthropic(70)18 个经别名解析比对 models.dev,17 个一致。 其余在官方页逐条核对:gpt-4o-transcribe $2.50/$10、sora-2 $0.10/秒、 veo-3.0 $0.40/秒、claude-opus-4/4.1 $15/$75、claude-sonnet-4 $3/$15 —— 与本源全部一致
对账中新发现并已处理:
Claude Sonnet 5 价格订正:Anthropic 官方页明确 「$2/$10 的试用价已转为标准价,原定 2026-09-01 涨到 $3/$15 的计划取消」。 报价单原本取的是已取消的涨价后价格,现已改为 $2 / $10 / 缓存 $0.20。 Claude 四款现与官网现价逐条吻合。

对账后已验证覆盖率从 51% 提升到 74%(323/435)。 剩余 112 个多为各厂官方页已不再单列的历史快照,明细见 /bailian_reconciliation.json/volcengine_reconciliation.json/foreign_reconciliation.json

模型名一律带厂商前缀

PixVerse / Runway / Tripo 的官方 model 取值是裸串——PixVerse 文生视频接口写的是 now supports v3.5/v4/v4.5/v5/v5.5/v5.6/v6/c1,Tripo 是 v3.1-20260211 / P1-20260311, Runway 是 gen4.5 / aleph2。各家 API 只服务自家模型,不需要命名空间; 但汇到多厂商网关里,既看不出厂商也可能与他家撞名。

因此本源统一改成带厂商前缀的键名,全源已无裸名

本源键名(对外)上游真实 model 取值(对内)
pixverse-c1c1
pixverse-v6v6
runway-aleph2aleph2
runway-gen4.5gen4.5
runway-gen4_turbogen4_turbo
runway-gen4_imagegen4_image
runway-gen4_image_turbogen4_image_turbo
tripo-v3.1-20260211v3.1-20260211
tripo-p1-20260311P1-20260311
这 9 个必须在渠道里配「模型映射」,把左边映射成右边。否则 new-api 会把 pixverse-c1 原样发给上游,PixVerse 认不出会报错。 机器可读的映射表见 /upstream_model_name.json。 其余模型的键名与上游一致,无需映射。

日期快照别名已清理

厂商常同时提供「浮动名」和「版本固定快照名」(claude-haiku-4-5claude-haiku-4-5-20251001),老源把快照全收了,导致大量重复。已清理 82 个

哪个是正名按厂商而定:OpenAI / Anthropic / Google / 阿里保留浮动名; 字节火山方舟与 Tripo 的官方 ID 本身就带日期doubao-seedance-2-0-260128), 无日期名反而是老源自造的,删的是那个。

另有 9 个日期快照与浮动名官方价确实不同,全部保留 —— 阿里的旧快照会保留下线时的旧价,例如 qwen-vl-ocr 是 0.3 元而 qwen-vl-ocr-2024-10-285.0 元,差 16.7 倍。 当成同价别名删掉会让这些快照按便宜价结算。明细见 /deduplicated_aliases.json

口径

USD 计价,new-api 约定 1 倍率 = $2 / 百万 tokens
model_ratio      = usd_input_per_m / 2
completion_ratio = usd_output / usd_input
cache_ratio      = usd_cache_hit / usd_input
model_price      = USD/次(按张、按次)或 USD/秒(视频,new-api 再乘 seconds)
国产模型存在「中国内地人民币价」与「国际美元价」两种口径。老源与报价单源用的是内地价; 新增的智谱 / 阿里条目取自 models.dev 的国际价(偏高,属保守),已在 provenance.json 里标注来源,需要精确对齐内地价的请自行复核。

在 new-api 里接入

  1. 渠道管理 → 新建一个禁用渠道,BaseURL 填本站域名
  2. 系统设置 → 上游倍率同步 → 选中该渠道,endpoint 选 custom,路径填 /full_ratio_config.json
  3. 预览差异 → 确认后应用同步

65 条 billing_expr 已通过 new-api 引擎的编译与官方 SmokeTestExpr 校验。