首页 > 业界 > 关键词  > 小米最新资讯  > 正文

小米自研大模型MiMo-V2.5系列API降价:降99% 不再区分上下文长度

2026-05-27 08:37 · 稿源: 快科技

快科技5月27日报道,小米公司今日宣布,其自主研发的MiMo-V2.5系列大模型应用程序编程接口(API)将实施永久性价格调整。

据了解,相较于初始的API定价,MiMo-V2.5系列的新价格最高降幅可达99%,且不再根据上下文窗口长度进行区分收费。

此次调价已于北京时间5月27日零时起在全球范围内同步生效。

具体而言,本次降价覆盖了MiMo-V2.5和MiMo-V2.5 Pro两个版本。

小米自研大模型MiMo-V2.5系列API降价

其中,MiMo-V2.5 Pro在输入缓存命中情况下的价格降至每百万tokens 0.025元,降幅最高达99%;MiMo-V2.5的输入缓存命中价格降至每百万tokens 0.02元,降幅最高达98%。

在输出价格方面,MiMo-V2.5 Pro降至每百万tokens 6元,降幅最高为86%;MiMo-V2.5则降至每百万tokens 2元,降幅最高达93%。

除了API价格的下调,MiMo的Token Plan计费体系也进行了重要优化。

优化后的Token Plan在保持原有价格不变的基础上,用量提升至原来的5至8倍,同时引入了Credits概念,使得计费规则更加清晰易懂。

小米自研大模型MiMo-V2.5系列API降价

小米方面表示,此次价格调整得益于技术团队在推理系统上的持续改进。

据悉,小米基于SGLang HiCache技术,全面支持SWA(滑动窗口注意力机制),将KV缓存数据在GPU显存、CPU内存及固态硬盘等多级存储之间的搬运量降低至优化前的近七分之一,同时将可缓存token数量提升至优化前的近5倍,显著提升了缓存命中率与推理效率。

此外,小米还通过优化专家并行方案和输入长度分桶策略,进一步增强了集群的输入吞吐能力,在保障服务质量的前提下,持续降低了单位token的服务成本。

举报

  • 相关推荐
  • 小米宣布MiMo端侧模型通过备案:未来3年AI投入不低于600亿元

    小米技术官微今日正式宣布,小米MiMo端侧模型已顺利通过国家大模型备案,备案号为Beijing-XiaoMiPengPaiAI-202509080119。 据官方介绍,小米MiMo是小米自研大模型,已完成大语言、多模态、语音等全系列模型矩阵闭环,构建起完整的技术底座。通过端云协同的方式,MiMo将全面赋能小米人车家全生态”战略,持续推动AI技术从数字世界走向物理世界,在更多现实场景中落地。 在小米�

  • 小米MIX Fold 5首发!玄戒O3八月登场:基于3nm工艺打造

    小米将于8月发布旗舰折叠屏MIX Fold 5,其核心是深度整合了自研芯片、操作系统与AI大模型。该机首发史上最强自研芯片玄戒O3,基于台积电3nm工艺,采用取消传统大核的“超大核+钛核+小核”三集群新架构,主频突破4GHz,旨在提升多任务处理能力。此前,首发玄戒O1的小米15S Pro已填补了国内3nm移动处理器市场空白,奠定了小米在高端芯片领域的技术地位。

  • 豆包图像创作模型Seedream 5.0 Pro API上线:像素级编辑、专业级可控

    今天,火山引擎正式开放豆包图像创作模型Seedream 5.0 Pro的API服务,企业开发者可以直接接入这套专业绘图能力,适配广告、电商、教育、跨境等各类批量出图场景。 这款模型最大变化是告别单纯出图,深度贴合真实设计流程,四大核心能力解决企业批量制图痛点。 首先是交互式精准编辑,不用反复改写提示词,直接圈选、点选画面局部,支持草图转成品、单独换材质、拆分

  • 价格战一触即发!奥特曼放话OpenAI降价75%:被DeepSeek等中国AI逼的

    OpenAI创始人兼首席执行官萨姆奥特曼在社交媒体上公开表示,公司旗舰模型GPT-5.6 Sol的定价已是竞争对手Anthropic Claude Fable 5的一半,并称OpenAI很乐意降价75%。 此次价格战信号发出之际,正值Anthropic在企业客户和开发者市场加速扩张,中国AI低价模型持续施压。 GPT-5.6系列于7月10日正式发布,旗舰版Sol(太阳)定价为每百万输入Token 5美元(约合34元人民币)、输出30美元(约合204

  • 超越Opus 4.7美国顶级大模型 Kimi K3即将发布:2.5万亿怪兽级AI

    这个月会有多款国产重量级大模型发布,除了DeepSeek V4正式版之外,最受关注的当属月之暗面Kimi K3,最新内测显示其超越了美国顶级大模型Opus 4.7。 Kimi官方昨晚实际上都预告了K3的发布,显示会从今天开始有充值优惠活动,但很快又把页面下架,即便如此K3的发布也就是这一两天的事了。 至于Kimi K3的性能水平,有提前测试的网友给出了一些对比结果,跑分结果超越了Opus 4.7、

  • 小米发布并开源Xiaomi-Robotics-U0:380亿参数具身生成大模型!生成效率提升83倍

    今日,小米正式发布并全量开源380亿参数多模态自回归具身生成基础模型Xiaomi-Robotics-U0,是行业首个可统一覆盖四类核心具身生成任务的一体化方案。 该模型打破以往机器人场景、轨迹、视频生成模型相互割裂的行业现状,能够自主生成、扩增机器人训练所需图像与视频数据,解决真机采集极端、危险、长尾场景数据成本高、难度大的痛点。 依托自研FlashAR 推理加速方案,�

  • 当大模型公司开始造手机

    喧嚣的国内AI赛道,阶跃星辰一直是相对低调的那一家。可随着智谱、MiniMax首批限售股解禁,月之暗面连拿融资,估值逼近300亿美元,这家自诩“静水深流”的公司,似乎也已按捺不住心中的浪涌。 7月13日,阶跃星辰一口气打出了三张牌:大模型原生AI终端品牌STEPX、智能体原生操作系统Step AOS,以及个人智能体阶跃Amoo。 作为STEPX的首款产品,搭载Step AOS、内置Amoo的全球首款大

  • 对标iPhone Ultra!小米MIX Fold 5更多配置:首发自研3nm玄戒O3、售价或万元起

    小米即将推出自家的新一代旗舰折叠屏手机,预计正式命名为MIX Fold 5,这款新机定位顶级高端赛道,有望和苹果将要发布的首款折叠屏iPhone Ultra展开直接的正面竞争。 从最新曝出的供应链消息来看,小米的新款折叠屏采用了全新的机身设计方案,和传闻中苹果iPhone Ultra的产品思路高度契合,很可能走行业内少见的宽折叠路线,而非三星Galaxy Z Fold系列和此前小米MIX Fold 4一直沿

  • 百度智能云完成64B世界模型512卡训练验证 支撑大模型高效Scale

    百度百舸基于通用GPU集群,在无NVLink/HPN条件下完成512卡Cosmos3-Super 64B模型训练,实现97.48%近乎线性扩展效率。验证大模型训练效率不仅靠硬件,更依赖框架、网络与基础设施的系统协同,AI Infra工程优化成为释放算力、支撑世界模型训练的关键路径。

  • 苹果研发AI模型压缩技术:把270亿参数大模型装进iPhone

    苹果正与硅谷初创公司PrismML进行早期洽谈,后者宣称能将大型AI模型压缩至可在iPhone上本地运行。若技术验证成功,此举将强化苹果的隐私主张,并为其进展缓慢的Siri升级提供关键支撑。 PrismML首席执行官表示,苹果已开始评估其技术。洽谈尚处于早期阶段,前景虽不明朗,但进展顺利”。 消息发布正值苹果推出iOS 27公测版次日这是苹果大幅改版Siri后首次面向公众的广泛测�

今日大家都在搜的词: