合并「各厂商官方价源」与「岚图报价单源」,清理已下线机型、补充同系列新机型后的单一入口。 351 个模型键,其中 35 个走官方分档 / 分模态计费表达式。
/full_ratio_config.json
—— new-api ratio_sync 的 type1 格式:
{"success": true, "data": {
"model_ratio": {...}, "completion_ratio": {...}, "cache_ratio": {...},
"model_price": {...}, "billing_mode": {...}, "billing_expr": {...}
}}
/model_ratio.json · /completion_ratio.json
· /cache_ratio.json · /model_price.json/billing_mode.json · /billing_expr.json
—— 官方有上下文分档的模型| 来源 | 说明 |
|---|---|
| 各厂商官方价源 2026-04-26 |
Anthropic / Google / OpenAI 官方定价页 + Qwen / Doubao 官方文档,覆盖面广 |
| 岚图报价单源 2026-08-24 |
图灵中科报价单的官网参考价格列,逐条核过官方模型 ID,带官方分档表达式 |
| 冲突取舍 | 报价单源胜出——它更新、模型 ID 逐条核实过,且对官方有上下文分档的模型带
billing_expr,比老源的「取最贵档」单值更准。实际冲突 5 条,全部是档位口径差异。 |
只清厂商已下线的代际;仍在服务的 gemini-2.5-*、gpt-5.x、
qwen3-*、豆包 seed 1.x 一律保留。
| 厂商 | 清理内容 |
|---|---|
| OpenAI(38) | gpt-3.5 / gpt-4 / gpt-4o 聊天线 / gpt-4.1 / o1 / o3 / o4 / dall-e / tts-1 / ada-002 |
| Alibaba(18) | qwen2.5 全系及更早 |
| Anthropic(10) | claude-3 / 3.5 / 3.7 全系 |
| ByteDance(6) | 豆包 1.x(非 seed) |
| Google(1) | veo-2 |
gpt-4o-mini-tts 正是 tts-1 的替代者,
gpt-4o-transcribe 系列是现役 STT,audio / realtime 也未见下线证据——这些不跟 4o 聊天模型一起删。
claude-opus-5、gpt-5.6、gpt-realtime-2.1、gemini-3.7-flash、
gemini-3.1-flash-lite、gemini-flash-latest、gemini-omni-flash-preview、
deepseek-chat / deepseek-reasoner、glm-4.7-flashx / glm-5v-turbo、
qwen3.8-max / qwen3.7-flash / qwen3-vl-*、grok-4.3 / 4.5 / 4.6 等。
glm-5.3 —— 8 / 28 / 缓存 2 元每百万tokens(1M 单档,与 GLM-5.2 同价)doubao-seed-2-0-pro-260215 —— 3.2 / 16 / 0.64 元,且官方带三档上下文分档,已生成 billing_exprdoubao-seedance-2-5-260628 —— 70 元每百万tokens(480p/720p 输入不含视频基准档)qwen-image-3.0 0.18 元/张 · qwen-image-3.0-pro 0.25 元/张wan2.7-image 0.20 元/张 · wan2.7-image-pro 0.50 元/张meshy-7 —— 图生3D含纹理 30 积分 = $0.60(与 meshy-6 同价)relay/channel/task/doubao/constants.go 的 videoPriceTable 逐条吻合(46/28、51/31、26/16),
现已按官方基准档录入。
/deprecated.json —— 清理了哪些、为什么,以及
哪些从同步源删掉后本地内置也没有兜底(30 个)。这类模型若仍被调用,
new-api 会报「价格未配置」而不是静默高价,均为已下线机型。/tier_fixed.json —— 9 个原按最高规格收费的千问模型,已全部改为官方分档计费。
suspected_overcharge.json 现已归零。/pending_price.json —— 已清空:原先的 8 个待补价机型
已全部用浏览器在官方价格页查到并录入。/provenance.json 记录每个键来自哪个源。
老源当年为保守计费,对分档模型统一取了 最贵上下文档 / 思考档输出 / 最贵模态,
而 model_ratio 只能存一个数,于是普通的短上下文、非思考、纯文本调用也按最贵档结算。
现已按百炼官方中国内地价表(浏览器实抓 2026-08-24)改为分档 / 分模态计费。
| 模型 | 类型 | 原输入价 | 现基准价 | 降幅 |
|---|---|---|---|---|
qwen-omni-turbo | 分模态 | $3.5714 | $0.0571 | 62.5× |
qwen-omni-turbo-realtime | 分模态 | $3.5714 | $0.2286 | 15.6× |
qwen3-omni-flash | 分模态 | $2.2571 | $0.2571 | 8.8× |
qwen3-omni-flash-realtime | 分模态 | $2.7000 | $0.3143 | 8.6× |
qwen-flash | 上下文分档 | $0.1714 | $0.0214 | 8.0× |
qwen-plus | 上下文分档 | $0.6857 | $0.1143 | 6.0× |
qwen3-coder-plus | 上下文分档 | $2.8571 | $0.5714 | 5.0× |
qwen3-coder-flash | 上下文分档 | $0.7143 | $0.1429 | 5.0× |
qwen3-vl-plus | 上下文分档 | $0.4286 | $0.1429 | 3.0× |
qwen-turbo | 思考档输出 | 输出 $0.4286 → $0.0857 | 5.0× | |
qwen3-livetranslate-flash-realtime | 分模态 | 文本输出 $34.29 → $9.14 | 3.75× | |
最后两个是补检出的:最初的检出器只比对输入价,漏掉了「只有输出被抬高」的情况
(qwen-turbo 输入是对的,输出取了思考档;qwen3-livetranslate 输入输出都取了音频价)。
补上输出侧比对后又捞出这 2 个,现已一并修正。
分模态用的是表达式的 ai(音频输入)/ img(图片输入)/ ao(音频输出)变量——
引擎会自动把它们从 p 里扣除,不会重复计费。文本输出价还会按「本次输入是否含多模态」在两档间切换:
qwen-omni-turbo:
tier("base", p * 0.057143 + ai * 3.57143 + img * 0.214286
+ c * (ai > 0 || img > 0 ? 0.642857 : 0.228571) + ao * 7.14286)
qwen-plus 官方还分非思考 / 思考两种输出价(≤128K 档是 2 元 vs 8 元),
用 param("enable_thinking") 读请求体区分。保守取值:只有显式传
enable_thinking=false 才走便宜档,缺省按思考档计价,避免客户端默认开思考却按便宜档结算。
pricing/unified/_verify_tierfix。
对老源里 models.dev 覆盖不到的条目做了一次全量对账,数据源是各厂官方价格页(浏览器实抓 2026-08-25): 百炼「模型价格」、火山方舟「模型价格·在线推理常规档」、OpenAI / Google / Anthropic 官方定价页。
| 厂商 | 结果 |
|---|---|
| 阿里(150) | 127 在官方表中匹配到(含日期快照/-latest 别名继承)。
34 个按官方基准档校正,34 个别名继承分档表达式,66 个核对一致。
5 个是真历史模型(qwq-32b-preview 等),官方表已无。 |
| 字节(52) | 27 匹配,20 个按官方价校正(豆包 seed 1.x / 2.0 系列原先高 3–4 倍)。 图像 / 3D / 向量模型逐个核对全部一致。 |
| OpenAI / Google / Anthropic(70) | 18 个经别名解析比对 models.dev,17 个一致。
其余在官方页逐条核对:gpt-4o-transcribe $2.50/$10、sora-2 $0.10/秒、
veo-3.0 $0.40/秒、claude-opus-4/4.1 $15/$75、claude-sonnet-4 $3/$15
—— 与本源全部一致。 |
qwen-vl-plus-2025-07-10 原先低于官方价 5 倍(少收),已校正qwen3.5-omni 四款(plus / flash / 各自 realtime)原先取音频价,已改为分模态计价qwen-turbo 输出取了思考档(3元,应为非思考 0.6元)—— 最初的检出器只比对输入价,漏掉了这类gemini-2.0-flash(2026-06-01)、
veo-3.0(2026-06-30)、imagen-4.0(2026-08-17)对账后已验证覆盖率从 51% 提升到 74%(323/435)。
剩余 112 个多为各厂官方页已不再单列的历史快照,明细见
/bailian_reconciliation.json、
/volcengine_reconciliation.json、
/foreign_reconciliation.json。
PixVerse / Runway / Tripo 的官方 model 取值是裸串——PixVerse 文生视频接口写的是
now supports v3.5/v4/v4.5/v5/v5.5/v5.6/v6/c1,Tripo 是 v3.1-20260211 / P1-20260311,
Runway 是 gen4.5 / aleph2。各家 API 只服务自家模型,不需要命名空间;
但汇到多厂商网关里,既看不出厂商也可能与他家撞名。
因此本源统一改成带厂商前缀的键名,全源已无裸名:
| 本源键名(对外) | 上游真实 model 取值(对内) |
|---|---|
pixverse-c1 | c1 |
pixverse-v6 | v6 |
runway-aleph2 | aleph2 |
runway-gen4.5 | gen4.5 |
runway-gen4_turbo | gen4_turbo |
runway-gen4_image | gen4_image |
runway-gen4_image_turbo | gen4_image_turbo |
tripo-v3.1-20260211 | v3.1-20260211 |
tripo-p1-20260311 | P1-20260311 |
pixverse-c1 原样发给上游,PixVerse 认不出会报错。
机器可读的映射表见 /upstream_model_name.json。
其余模型的键名与上游一致,无需映射。
厂商常同时提供「浮动名」和「版本固定快照名」(claude-haiku-4-5 与
claude-haiku-4-5-20251001),老源把快照全收了,导致大量重复。已清理 82 个。
哪个是正名按厂商而定:OpenAI / Anthropic / Google / 阿里保留浮动名;
字节火山方舟与 Tripo 的官方 ID 本身就带日期(doubao-seedance-2-0-260128),
无日期名反而是老源自造的,删的是那个。
qwen-vl-ocr 是 0.3 元而
qwen-vl-ocr-2024-10-28 是 5.0 元,差 16.7 倍。
当成同价别名删掉会让这些快照按便宜价结算。明细见
/deduplicated_aliases.json。
USD 计价,new-api 约定 1 倍率 = $2 / 百万 tokens model_ratio = usd_input_per_m / 2 completion_ratio = usd_output / usd_input cache_ratio = usd_cache_hit / usd_input model_price = USD/次(按张、按次)或 USD/秒(视频,new-api 再乘 seconds)
provenance.json 里标注来源,需要精确对齐内地价的请自行复核。
custom,路径填 /full_ratio_config.json65 条 billing_expr 已通过 new-api 引擎的编译与官方 SmokeTestExpr 校验。