国产大模型商业模式大变局:上架电商,出海不只卖token
2026-09-09 07:19 南方都市报
MiniMax也在为后续更多推理算力需求寻找更多算力可能性,M3和H3在同步推进国产芯片适配,公司很快将有大规模国产算力集群上线,并逐步承担真实生产流量,同时提高整体利用率、降低单位Token成本。此前MiniMax已对最新模型开始价格的调整,其7月底开源的H3三周下载量超2400万次、主打定价约为同类旗舰的三分之一。
采用模型架构和训练的革新,国产大模型也实现了降本。以阿里发布并同步开源的千问最新模型 Qwen3.8-Flash为例,该模型训练成本较前一代模型Qwen3.7-Plus骤降近90%,推理成本同样大幅下降,每百万Tokens输入仅1元,输出3元,价格最低为DeepSeek-V4-Flash的1/3。
尽管多家模型厂商都在通过各类技术革新降本,但一个更清晰的共识正在浮现:价格不是未来竞争的主战场,智能本身才是,更高的模型能力才是营收与增长真正的引擎。但针对这一共识,模型厂商也选择了不同的切入点来叙事、争夺定价权。
智谱董事会秘书肖磊在财报电话会议上将智谱的调用量和定价做对比,称整个MaaS平台Token调用量较今年年初整体增长超过40倍,但整体API平均定价提升了大概101%,增长不完全是由价格弹性驱动。
智谱董事长刘德兵也进一步预期,未来行业会出现两条价格曲线:同等智能基准上价格一定会持续下降,比如Flash系列(轻量、高速、低成本)的模型。但对于真正能开拓新任务边界、显著提高任务成功率的前沿旗舰模型,仍然存在溢价空间,甚至有进一步提价的可能。换言之,智谱认为能不能提价、敢不敢提价,取决于能力是否稀缺,能力决定了厂商站在哪一条价格曲线上。
