核心背景与定价格局
随着AI coding和openClaw爆火,国内大模型需求暴涨,厂商纷纷调整定价策略,价格战从“分钱”进入“厘钱”时代,每百万Token的差价可能导致年成本相差数十万。本文覆盖智谱AI、稀宇科技、小米、月之暗面、阿里云、腾讯、字节跳动七大主流厂商,从API按量计费、订阅套餐、免费额度等维度拆解。
七大厂商主力模型与定价概览
- 智谱AI(GLM):清华KEG孵化,GLM-4-Plus输入输出均5元/百万Token(直降90%),GLM-4-Flash完全免费,Coding Plan分Lite(49元/月)、Pro(149元/月)、Max(469元/月)三档,适配编程场景。
- 稀宇科技(MiniMax):多模态能力突出,M2.7输入2.1元、输出8.4元/百万Token,语音合成2元/万字符起,视频生成2元/个起,阿里云百炼渠道提供100万Token免费额度。
- 小米(MiMo):2026年1月开放API,MiMo-V2-Pro支持1M上下文,≤256K档输入7元、输出21元,Token Plan以Credit点数计费,Lite套餐39元/月含0.6亿Credits,TTS限时免费。
- 月之暗面(Kimi):长上下文优势明显,K2.6输入6.5元、输出27元/百万Token,缓存命中仅1.1元,Code Plan分Andante(49元/月)等四档,额度7天刷新。
- 阿里云(Qwen/千问):MaaS平台规模大,qwen3-max按上下文阶梯定价,0-32K档输入2.5元、输出10元,新用户享超7000万免费Token,资源包预付费更划算。
- 腾讯(混元):2026年3-4月两轮涨价,HY 2.0 Think输入最高5.3元、输出21.2元/百万Token,Hunyuan-lite完全免费,首次开通享100万Token免费包。
- 字节跳动(豆包):Seed系列定价激进,Seed-1.6-Flash输入仅0.075元/百万Token,Seed-2.0-Pro输入3.2元、输出16元,新客1000万Token包仅19.9元。
细分场景定价横评
- 旗舰模型:阿里qwen3-max(0-32K档)综合性价比最低,Kimi K2.6输出最贵但缓存成本极低,小米MiMo-V2-Pro支持1M上下文但加价幅度大。
- 轻量/免费模型:智谱GLM-4-Flash、腾讯Hunyuan-lite完全免费,字节Seed-1.6-Flash输入价全场最低,阿里qwen-long是长文本性价比之王。
- Coding订阅套餐:智谱、Kimi的套餐适配编程场景,小米Credit体系更灵活,轻度编程可选49元档,重度用户选智谱Max或Kimi Allegro。
行业趋势与选型建议
价格战进入“厘钱”阶段,腾讯率先涨价或引发行业跟进;缓存机制、阶梯定价成标配。选型上:零成本试水选智谱GLM-4-Flash或腾讯Hunyuan-lite;大规模高并发选字节Seed-1.6-Flash或阿里qwen-turbo;超长文本处理选智谱GLM-4-Long或阿里qwen-long;代码生成选字节Seed-2.0-Code或智谱Coding Plan Pro;多模态应用选阿里qwen3-omni-flash或小米MiMo-V2-Omni。
总结
2026年国内大模型市场呈现“旗舰降价、轻量免费、订阅兴起”三大趋势,阿里qwen3-max、智谱GLM-4-Plus性价比突出,免费模型降低开发者门槛,订阅套餐适配细分场景。腾讯涨价预警下,当前入手更划算,建议以官网最新价格为准。