罗福莉加入小米后首秀,解释 MiMo-V2-Flash 模型如何做到推理速度飞快

罗福莉加入小米后首秀,解释 MiMo-V2-Flash 模型如何做到推理速度飞快
2025年12月17日 10:47 IT之家

IT之家 12 月 17 日消息,2025 小米人车家全生态合作伙伴大会于今日举行,Xiaomi MiMo 大模型负责人罗福莉迎来入职后首秀。

小米昨日晚间惊喜发布了 Xiaomi MiMo-V2-Flash 开源 MoE 模型,总参数量 309B,活跃参数量 15B,专为智能体 AI 设计,专注于快。不少IT之家小伙伴体验后发现,该模型推理速度非常快。

罗福莉解释称,MiMo-V2-Flash 围绕极致推理效率设计了模型结构,通过 3 层 MTP 推理加速并行 Token 验证,实现了 2.0~2.6 倍的推理速度提升

MiMo-V2-Flash 凭借总参数 309B(激活 15B),实现了代码和 Agent 评测基准上全球开源模型 Top2,且初步具备模拟世界的能力,可通过 HTML 写操作系统、模拟太阳系、画一棵圣诞树等。

罗福莉还谈到了下一代智能体系统,认为下一代智能体系统不是一个“语言模拟器”,而是一个真正能够理解世界、并与之共存的“智能体”。

2025 小米“人车家全生态”合作伙伴大会专题
2025 小米“人车家全生态”合作伙伴大会专题
2025 小米“人车家全生态”合作伙伴大会专题2025 小米“人车家全生态”合作伙伴大会专题
新浪科技公众号
新浪科技公众号

“掌”握科技鲜闻 (微信搜索techsina或扫描左侧二维码关注)

创事记

科学探索

科学大家

苹果汇

众测

专题

官方微博

新浪科技 新浪数码 新浪手机 科学探索 苹果汇 新浪众测

公众号

新浪科技

新浪科技为你带来最新鲜的科技资讯

苹果汇

苹果汇为你带来最新鲜的苹果产品新闻

新浪众测

新酷产品第一时间免费试玩

新浪探索

提供最新的科学家新闻,精彩的震撼图片