据 SiliconANGLE 报道,小米公司 2026 年 9 月 22 日宣布发布并开源 MiMo-V2.6 系列生成式人工智能模型,该系列包含两个原生全模态模型,称在智能、效率与成本之间取得平衡。
该系列由旗舰模型 MiMo-V2.6-Pro 和更小、更高效的 Flash 版本组成。小米同时表示正在推出精简的 Pro-UltraSpeed 变体,该变体在同等质量下输出速度最高可达 Pro 的 20 倍。小米将 Pro 和 Flash 描述为原生“全模态”模型,同一系列可接受文本、图像、视频和音频输入,上下文窗口为 100 万 token。Pro 公布的架构列出 6.81 亿参数视觉编码器,其中包括 3.08 亿参数 AudioTokenizer 和 1.27 亿参数音频 patch 编码器,可区分语音。
小米称,这一设计使较大的模型能够满足当前不断增长的代理式人工智能用例和任务指令需求,尤其是计算机使用场景。例如,计算机使用代理可以读取任务指令,读取用户界面截图或视频,进行推理,然后在一个模型循环内决定下一步。编码或设计代理可以在同一会话中,把源代码和较长的代码仓库上下文与截图、UI 模型稿和参考图像结合起来。在商业用途中,模型可以摄入大量文档,包括通话音频、截图、日志和笔记等多模态组件,无需借助工具拆分转录内容或编排每一种模态。在公告博客中,小米展示了模型构建游戏世界、基于 Blender 的 3D 建模、具身仿真以及视频-音乐工作流的表现。
评测方面,小米称 V2.6-Pro 在 Artificial Analysis 智能指数上得分 46.32,领先 Kimi K3 和 Qwen3.8 Max,是发布时该对比中排名最高的开源或开放权重模型。不过,在综合指标上,该模型仍落后于市场上最先进的旗舰专有闭源模型 Claude Fable 5.1 和 GPT-6 Astra。在代理任务测试中,V2.6-Pro 结果接近或偶尔超过领先闭源系统:在 AutomationBench 上得 53.1,Claude Opus 5 为 50.3;在 Agents' Last Exam 上得 31.6,与 Opus 5 持平;在 Terminal Bench 2.1 上得 89.9,略高于 Opus 5 的 89.1。
价格和可用性方面,小米表示 V2.6 系列将保留 MiMo-V2.5 的标准应用程序接口定价,模型卡还列出可通过该公司的 AI Studio、MiMo Desktop 和 MiMo Code 使用。Pro 和 Flash 也可在 OpenRouter 上通过统一 API 使用,提供 105 万 token 上下文。V2.6-Flash 每 100 万输入 token 收费 0.14 美元,输出 token 收费 0.28 美元;Pro 分别为 0.435 美元和 0.87 美元;Pro-UltraSpeed 在 20 倍生成速度下分别升至 4.35 美元和 8.70 美元。
小米称,计入缓存 token 成本显著降低的因素,Pro 在可比智能水平下的成本约为海外模型的二十分之一到六十分之一。作为对比,OpenAI 的 GPT-6 Astra 和 Anthropic 的 Claude Fable 5.1 每百万 token 输入和输出收费为 10 至 50 美元。对于缓存密集型代理,这一差距会进一步扩大,但相关商业比较更少取决于每 token 价格,而更多取决于每任务价格,后者由可靠性和成功完成任务所需的循环次数决定。