推理模型定价公布
DeepSeek-R2 定位复杂推理任务,输入价格高于通用模型,但输出价格与 V3 持平,延续了「输出不加价」策略。
证据来源:待补充官方公告或价格页快照Digital price archive / beta
国产大模型 API 定价变更时间线库,追踪模型、厂商、价格单位与关键市场节点。公开数据均以人工审核和原始来源为准。
Chronological evidence
Index / 30 records
注意:数据库暂无已发布记录,当前展示界面演示数据。
DeepSeek-R2 定位复杂推理任务,输入价格高于通用模型,但输出价格与 V3 持平,延续了「输出不加价」策略。
证据来源:待补充官方公告或价格页快照V3 输入价格降至 ¥1/百万 tokens,输出价格降至 ¥2/百万 tokens,缓存命中价格降至 ¥0.1/百万 tokens。较上线价降幅约 50%。
证据来源:待补充官方公告或价格页快照GLM-4-Plus 作为智谱新旗舰,定价略高于 GLM-4-Flash,面向对推理质量有更高要求的企业场景。同时 GLM-4-Flash 维持免费调用。
证据来源:待补充官方公告或价格页快照智谱确认 GLM-4-Flash 继续保持免费调用,覆盖输入输出全部环节,不限量。这一策略自 2024 年中延续至今。
证据来源:待补充官方公告或价格页快照Qwen3-235B 采用 MoE 架构,总参数 235B、激活参数仅 22B。API 定价分三档:轻量版免费,标准版按 token 计费,企业版包月。
证据来源:待补充官方公告或价格页快照Qwen-Max 输入价格从 ¥4/百万 tokens 降至 ¥2.8/百万 tokens,输出从 ¥12/百万 tokens 降至 ¥8.4/百万 tokens。同步下调 Qwen-Plus 价格。
证据来源:待补充官方公告或价格页快照月之暗面发布 Kimi K2,采用 MoE 架构,API 定价采取激进策略,输入 ¥3/百万 tokens、输出 ¥9/百万 tokens,面向长上下文推理场景。
证据来源:待补充官方公告或价格页快照阶跃星辰发布 Step-2-16K,延续此前的中等定价策略,面向需要深度推理的开发者场景。与 Step-1 系列形成价格梯度。
证据来源:待补充官方公告或价格页快照字节豆包推出 256K 上下文版本,输入定价 ¥1.5/百万 tokens,输出 ¥5/百万 tokens。依托火山引擎基础设施,价格延续亲民路线。
证据来源:待补充官方公告或价格页快照MiniMax 推出 abab7 系列,分为轻量版和标准版两档。标准版定价与行业平均水平持平,轻量版面向高频低延迟场景。
证据来源:待补充官方公告或价格页快照腾讯混元 Turbo 版本价格下调约 40%,进一步拉平与 DeepSeek、通义的价格差距。混元 Standard 版本维持原价。
证据来源:待补充官方公告或价格页快照百度发布 ERNIE 4.5,API 定价采用分级策略:基础版免费,专业版按 token 计费,企业版提供独立部署。与此前 4.0 系列形成代际差。
证据来源:待补充官方公告或价格页快照百度确认 ERNIE-Lite 持续免费调用,覆盖个人开发者和中小团队。ERNIE-Speed 也维持低价策略。
证据来源:待补充官方公告或价格页快照DeepSeek-V3 发布,定价 ¥2/百万 tokens(输入)、¥8/百万 tokens(输出),缓存命中 ¥0.5/百万 tokens。以开源模型+低价 API 策略进入市场。
证据来源:待补充官方公告或价格页快照V2.5 作为 V2 到 V3 的过渡版本,定价与 V2 持平,强化了代码和数学能力,为 V3 积累用户。
证据来源:待补充官方公告或价格页快照DeepSeek-V2 发布,API 价格降至 ¥1/百万 tokens(输入)、¥2/百万 tokens(输出),较 V1 降价超过 90%,引发行业连锁反应。
证据来源:待补充官方公告或价格页快照智谱宣布 GLM-4-Flash 永久免费调用,不限量、不限速,面向个人开发者和中小团队。这一策略显著提升了智谱的开发者生态。
证据来源:待补充官方公告或价格页快照智谱发布 GLM-4 系列,包含标准版、Air 和 Flash 三档。标准版定价 ¥100/百万 tokens,Air 版 ¥1/百万 tokens,Flash 版免费。
证据来源:待补充官方公告或价格页快照通义千问发布 Qwen2 系列,Qwen2-72B 定价 ¥4/百万 tokens(输入)、¥12/百万 tokens(输出),同时提供更小规格的免费模型。
证据来源:待补充官方公告或价格页快照Qwen-Max 价格下调约 30%,输入价格降至 ¥4/百万 tokens,输出降至 ¥12/百万 tokens。标志着国内大模型价格战正式开始。
证据来源:待补充官方公告或价格页快照百度宣布 ERNIE 4.0 系列全面降价,降幅最高达 50%。同时 ERNIE-Speed 和 ERNIE-Lite 维持免费或超低价策略。
证据来源:待补充官方公告或价格页快照腾讯混元大模型 API 正式对外开放,Pro 版定价 ¥3.5/百万 tokens(输入)、¥10.5/百万 tokens(输出),Standard 版更便宜。
证据来源:待补充官方公告或价格页快照MiniMax 发布 abab6.5 系列,包含 32K 和 4K 两个版本。32K 版定价 ¥5/百万 tokens(输入)、¥15/百万 tokens(输出),强调长文本能力。
证据来源:待补充官方公告或价格页快照月之暗面 Kimi 推出 128K 上下文版本 API,定价 ¥6/百万 tokens(输入)、¥18/百万 tokens(输出),主打超长文档处理。
证据来源:待补充官方公告或价格页快照字节豆包大模型 API 通过火山引擎开放,定价采取极具竞争力的低价策略,Pro 版 ¥0.8/百万 tokens(输入)、¥2/百万 tokens(输出)。
证据来源:待补充官方公告或价格页快照阶跃星辰发布 Step-1 系列模型 API,定价中等偏高,面向需要深度思考和复杂推理的企业客户。
证据来源:待补充官方公告或价格页快照智谱发布 ChatGLM3,同时开源和开放 API 调用。API 定价为行业初期水平,输入 ¥5/百万 tokens,输出 ¥10/百万 tokens。
证据来源:待补充官方公告或价格页快照阿里云通义千问大模型 API 正式开放,提供多规格模型选择。初期定价较高,后续随竞争加剧持续下调。
证据来源:待补充官方公告或价格页快照百度文心一言 API 正式开放,初期仅面向企业客户。定价信息未公开,采用邀请制和定制报价。
证据来源:待补充官方公告或价格页快照智谱发布 ChatGLM2,API 定价延续第一代策略,小幅调整。彼时国内大模型 API 市场尚处于早期探索阶段。
证据来源:待补充官方公告或价格页快照Evidence protocol
收集、比对、人工审核、公开发布。完整的方法、字段标准和勘误机制已经预留。
阅读收录方法