5月27日,小米旗下MiMo大模型团队发布公告,对V2.5系列模型API实施永久性降价,最高降幅达99%,不再区分上下文窗口长度。与此同时,TokenPlan计费体系同步优化,同等价格下Token用量提升至原来的5至8倍。本次调价已于北京时间5月27日零时正式生效,全球同步执行。
公告发布后,小米集团创始人、董事长兼CEO雷军迅速在微博转发并回应:“欢迎更多开发者接入XiaomiMiMo大模型”。这也是继5月22日DeepSeek宣布V4-Pro永久降价75%之后,又一家国产大模型厂商加入“永久降价”阵营。
小米技术官方微博表示,本次价格调整背后,离不开团队在推理系统上的持续优化。基于SGLangHiCache完整支持SWA(SlidingWindowAttention),将KVCache在GPU显存、CPU内存、SSD等多级存储之间的数据搬运量降低至优化前的近1/7,并将可缓存token数量提升至优化前的近5倍,显著提升了缓存命中率和推理效率。
值得关注的是,此次调价后MiMo-V2.5-Pro的定价(输入命中0.025元、未命中3元、输出6元)与DeepSeek-V4-Pro永久降价后的价格完全一致。