据央视新闻、新华社等权威媒体报道,近期多家模型厂商宣布永久下调算力价格,其中DeepSeek与小米MiMo降价尤为显著,最高降幅接近99%。从“高端稀缺资源”到“数字水电”,算力正经历着跨时代的身份蜕变,为千行百业的智能化转型铺平道路。
在这场算力普惠浪潮中,DeepSeek率先抢跑。2026年5月下旬,DeepSeek将其旗舰模型V4-Pro此前高达75%的临时优惠价格永久保留,API官方定价直接降至原价的四分之一,输入(缓存命中)低至0.025元/百万tokens,输出也仅需6元/百万tokens。
紧随其后,小米旋即高调跟进。5月27日,小米正式宣布MiMo-V2.5系列API价格永久下调,最高降幅达惊人的99%,同时取消复杂的上下文长度分档计费规则,开发者不仅价格更低,在相同预算下还可获得5至8倍的调用额度,极大降低了日常高频问答、网页设计、代码编程等多场景的AI使用成本。这正是小米技术实力打底的结果——依靠自研模型架构和KVCache存储压缩等技术,将运行成本压到极低。
受此推动,腾讯云、阿里云等主流平台也纷纷降价或调整产品策略。腾讯云智能体开发平台宣布DeepSeek-V4系列模型最高降幅达97.5%,其中缓存命中价格由0.001元/千tokens骤降至0.000025元/千tokens。三大运营商也从“流量经营”向“算力经营”转型,推出词元套餐推动AI算力清晰定价和标准化计费,阿里云、华为云等同样为中小企业降低了上云门槛与使用成本。
在供给端,降价的驱动力来源于国产芯片技术突破、大模型在算法领域的持续演进,以及全国一体化算力体系建设的规模化效应——三者合力带来的结构性降本,具备了长期性和普惠性特征。
降价并非全行业的共同图景。中低端Token(通用对话、轻量推理)已出现结构性过剩,开始激烈卷价格;而高端Token(千亿级模型、复杂推理、多模态生成)价格依然坚挺且有上涨趋势。美国持续收紧的出口封锁政策加剧了国内高端算力的紧缺性,使得A800、昇腾910等国产卡大量抛向中端算力租赁市场,而真正能支撑前沿模型研发的高端算力正变得越来越稀缺。
目前,算力价格分化正成为行业新常态。算力普惠降低的是基础层门槛,让创意验证、产品小规模部署等成为可能;前沿技术攻坚所需的高端算力,仍属于稀缺的战略资源。这一分层格局的形成,也意味着算力行业正褪去纯概念的炒作,进入技术与资本分层竞争的新阶段。