Kimi K3百万Token输出定价100元 DeepSeek V4-Pro缓存命中输入降至0.025元
7月,大模型API市场再度出现价格分化。月之暗面推出Kimi K3旗舰模型,每百万Token输出定价100元,较前代上涨2至3倍;而DeepSeek V4-Pro则在5月宣布永久降价75%,缓存命中后每百万Token输入仅0.025元,两大旗舰产品价差拉大至数倍。行业定价权博弈正从明面走向深水区。
两套定价哲学:价值定价与成本定价
在国产大模型中,Kimi K3与DeepSeek V4-Pro分别代表截然不同的策略。前者锚定高端智力生产力的稀缺性,站上价格高位;后者定位普惠AI基础设施,靠规模取胜。分化背后,是全行业对可持续商业化路径的试探。
Token是AI模型处理文本的基本单位,可视为词元;缓存命中指在API调用中复用已有计算结果,能显著降低推理成本。是石科技联合创始人毛运航指出,当前定价本质上在试探客户承受区间:下限看算力租赁成本,上限看模型稀缺度与实际产出价值。
三阶段演变:从普降、回调到彻底分化
南京某AI智能体创业公司创始人张源(化名)将Token价格变化归纳为三个阶段。2025年初,MoE(混合专家模型)架构与量化蒸馏技术成熟,全行业普降,主流产品从数十元跌至个位数,但价格战也让中小厂商跌破盈亏线。2025年下半年至2026年初,云端GPU租金上涨与Agent应用爆发导致算力供不应求,倒逼厂商集体回调定价。2026年5月至今,市场彻底走向分化,两套定价哲学并行。
毛运航认为,2026年付费逻辑发生根本转变:模型能力跨过生产力临界点,Token消耗指数级上涨,国产算力规模化落地,API付费逻辑成立,行业正式进入定价探索的深水区。
暗箱博弈:缓存、降智与计量标准缺失
报价分化只是表层。台面之下,缓存命中率暗箱操作、模型私自降智减配、Token底层计量单位不统一等问题,让大模型计费成为事后才能算清的账。全行业尚未形成统一的计量规范与账单标准。监管尺度、定价权分配、用户权益保障三者如何平衡,成为当前AI产业绕不开的核心考题。
C端同样分层:阶梯付费从49元到2299元
API市场的分层映射至C端,主流模型纷纷推出“基础免费+高阶付费”的阶梯体系。月费跨度与模型品类直接相关,视频模型阶梯尤为陡峭。
- Kimi分四档:49元至699元
- 豆包分三档:最高500元
- 海螺AI拉出六档,至尊版高达2299元/月
一涨一降之间,国产大模型API定价从混沌走向分层,标志AI商业化进入深水区探索。

大模型API市场账单透明度缺失 缓存与计量标准成关注焦点
近期,大模型API市场虽然在价格页面明确标注每百万Token单价,但多位业内人士指出,当前更紧迫的问题在于计量规范与账单标准的缺失。用户在实际调用前无法预知有效输入输出量、缓存命中率等关键信息,导致实际支出与纸面标价之间存在显著脱节。
采购规模庞大 账单明细难以追溯
一家头部生活电商平台产品负责人向记者透露,其公司年度API采购预算超过8000万元,接入近320个模型、18家供应商,覆盖智能客服、代码生成、Agent等十余个场景。然而当问及每笔费用的具体用途时,该负责人无奈表示“账单透明度并未跟上采购规模”。
标价透明却难知真实成本
据一家Token工厂创始人观察,当前各大模型厂商虽均标注了每百万Token价格,但用户无法在调用前预知有效输入输出量和平台缓存命中率。延迟、吞吐量、可靠性等核心性能指标同样未公开披露,用户支付更高费用未必能换取更优质服务。
缓存机制差异拉大价差
第三方AI Infra公司创始人向记者指出,不同平台的缓存命中率差异悬殊——高的可达80%至90%,低的不足50%甚至为零;部分服务商即便命中缓存也仍按原价收费。缓存机制只作用于输入部分,当用户提出重复或高度相似问题时,模型直接调取此前已生成的答案,无需重新计算,成本可骤降至未命中的几十分之一。
“能否享受这一调优成果如同摸盲。”——该创始人表示,同一模型、同一问题,不同平台的真实价差最高可达10倍。
模型“暗地减配” 用户权益难保障
多位受访者证实,部分服务商将原版高精度模型大幅压缩为低精度版本部署,价格公示页却依然标注原版名称和参数;业务繁忙时段甚至动态切换至低精度运行。用户花钱买了“头等舱”,实际坐的却是“经济舱”,却难以察觉和维权。
技术能力参差不齐 根源在于缺乏自研基础
清程极智联合创始人师天麾表示,国内自研推理引擎的公司屈指可数,多数服务商不具备对多类型显卡集群的部署与调优能力。普通用户只能以纸面价格为唯一参考,迫使服务商维持表面低价,导致价格与真实成本脱节。
Token定义不统一 公平计费困难
Token并非标准统一的计量单位。不同模型使用截然不同的分词器——分词器是模型将输入文本切分为最小处理单位(Token)的算法工具。同样一段中文、代码或表格数据,拆分出的Token数量可能差异较大,这意味着Token计费本身无法公平反映实际资源消耗。但分词器技术路线的差异由底层架构决定,无法强制统一。
价格与能力脱节 采购风险上升
当前市场均为线性计价,而大模型能力一旦跨越临界点会出现数量级跃迁,能力提升数十倍乃至上百倍,Token定价却不会同步增长。仅凭报价单做出采购决策,正变得越来越“危险”。此外,部分厂商热衷“打榜”为能力背书,但评测数据集泛滥,偶有作弊。有受访者表示已不再依靠榜单数据,而是在实操中根据经验自行判断模型优劣。
监管方向:信息公开为第一要务
多位受访者认为,Token市场尚处早期,严管为时过早。监管核心应是打击恶意低价直销、利用垄断地位不当涨价、价格联盟串通等破坏公平竞争的行为。短期应优先推动建立标准化的账单披露规范,让用量和费用可追溯、可横向比对。
“就像家庭安装电表,用户有权知道钱花在哪了。”——师天麾建议,政策应要求服务商公开透明信息,让第三方机构具备评测和监督能力。
国家发展和改革委员会宏观经济研究院研究员杨祥雪、魏巍发文建议:建指数、立样本,形成词元价格运行监测的“月度仪表盘”;明规则、晒账单,推动词元计费从“平台自定”走向“公开可查”;划边界、建基准,提升算力和模型价格行为的竞争评估能力。
未来趋势:分层定价精细化服务
有被访人士判断,未来Token价格体系将逐步走向稳定。模型与芯片类型将逐步收敛,文本、视频、多模态等不同品类各自对应独立定价区间。长期来看,Token计费将蜕变为底层基础设施支出:普通用户通过订阅套餐付费,高端定制化调用成本甚至可能超过个人工资,而通用型基础服务可接近免费。整个行业最终走向分层、稳定、精细方向。
被访的政策研究专家提出,制度建设应分步推进:短期建立计量口径、账单字段等基础信息披露规范,核心是“轻价格管制、重信息披露”;中长期划定竞争边界、建立成本基准及设立系统性预警。
