小米刚发布的新App和模型,用起来好爽啊

前两天我还寻思着,小米 MiMo 模型都半年没动静了。

但最近新手机又要发布,怎么都得同步跟着新品整波大活吧。

结果说什么来什么。

今天凌晨 4 点 50 分,小米就把 MiMo-V2.6 系列模型和端了上来,一共有 Pro 和 Flash 两个版本。

配套而来的,还有MiMo桌面客户端。

不是我说,搞大模型技术的大佬们,都不用睡觉的吗。

机哥也把官方发布的技术稿翻完了。

接下来把大伙比较关心的几个点,拉出来聊聊。

先说钱的事。

MiMo-V2.6 原封不动沿用了 V2.5 系列的定价。

缓存命中的情况下,Pro 输入是 0.025 元,Flash 是 0.02 元,这跟涨价前的 DeepSeek 一样。

能力涨了一大截,价格却一分没动。

只能说阿米在性价比这一块,依旧玩得老练。

然后是机哥也比较好奇的跑分和能力。

在「AA 综合智能指数」上,上一代 MiMo-V2.5-Pro 只有 26 分。

放在今天这张榜上看,属实是路边一条。

但现在,阿米打了翻身仗。

MiMo-V2.6-Pro 拿了 46 分,超过了 Kimi K3 和 GLM-5.3,成为了现在最强的开源模型。

不过有一说一。

Claude Fable 5.1 和 GPT-6 Astra,依然是闭源模型最高的山。

MiMo-V2.6-Pro 跟这两位头号玩家,还是有差距的。

在考验修 Bug 能力的 DeepSWE 测试上。

Pro 71.9,Flash 67.9,已经能贴着Claude Opus 5 的 74 和 GPT-5.6 Sol 走了。

其他像是操作电脑的、看图写代码的、知识推理的跑分,都能跟几个国际顶级模型,打个有来有回。

小米也做了几个真实环境任务的展示。

比如用新模型搓一个 3D 开放世界游戏。

根据用户的文字描述或参考图片,整一个 Blender 可用的三维建模。

甚至是充当具身智能的大脑。

识别和理解用户指令,去操控机器人干活。

这么看下来,以前大伙用 MiMo-V2.5 系列干活或写代码,总觉得差点意思的话。

现在换到 2.6 系列,应该体验会好不少。

而且 Flash 和 Pro 的差距没那么大,在大多数任务上,用性价比更高的 Flash 完全没问题。

再结合 V2.6 两个模型的参数量来看。

这俩的底子应该没大改,真正让 MiMo-2.6 系列模型能力大涨的,是「大规模强化训练」。

机友们可以理解为,扔给模型一堆真实任务让它去做。

做对了就给过,做错了打回重做,就这样一直来回做题。

前几天罗福莉还直播公开了整个训练过程和成本,Pro 烧了大概 262 万美元,Flash 烧了 85 万美元。

最后各种 benchmarks 的分数提升,还是相当明显的。

之前大伙都说,DeepSeek 是后训练的神。

我看现在 MiMo 也是不遑多让。

关键这么强的模型,小米没有藏着掖着。

整套端到端 RL 训练框架、权重、技术报告全部开源,所有人都能把模型下载、魔改乃至商用。

相当于把整个流程怎么训练,都告诉大伙了。

当然对于咱们这些普通用户来说,最爽的肯定还是 API 定价。

能力比 DeepSeek V4.1 稍强,但价格更低。

机友们要是想体验的话,现在就可以去下载同步上线的 MiMo 官方桌面客户端。

或者在 OpenCode 里,MiMo-V2.6-Flash 也免费使用七天。

最后就是直接在第三方 Agent 客户端,调用 MiMo 的 API 了。

机友们可以先花个几块钱先试试能力。

觉得不错再考虑开 Token Plan。

那对于小米来说,咱们都知道小米并非单纯的模型公司,它有着完整的人车家生态,后续如果能把 MiMo 模型合理运用到各个小米产品上。

所谓的主动智能,似乎也离咱们的生活不远了呢。

图片来自网络

本文来自大风号,仅代表大风号自媒体观点。