小米开源最新多模态大模型 Xiaomi MiMo-VL-7B-2508-数智化转型网szhzxw.cn

小米大模型团队宣布开源最新一代多模态大模型 Xiaomi MiMo-VL-7B-2508，包含 RL 与 SFT 两个版本。数字化转型网www.szhzxw.cn

官方数据显示，新版模型在学科推理、文档理解、图形界面定位及视频理解四项核心能力上全面刷新纪录，其中 MMMU 基准首次突破70分大关，ChartQA 升至94.4，ScreenSpot-v2达92.5，VideoMME 提升至70.8。

此番迭代通过优化强化学习稳定性与监督微调流程，使模型在内部 VLM Arena 评分从1093.9跃升至1131.2。数字化转型网www.szhzxw.cn

尤为引人关注的是，用户可在提问时通过“/no_think”指令自由切换“思考”与“非思考”模式:前者全程展示推理链条，控制成功率100%，后者直接生成答案，响应更快，成功率99.84%。

MiMo-VL-7B-RL-2508
- 推荐用户在大多数情况下体验使用该模型。
- 开源地址:https://huggingface.co/XiaomiMiMo/MiMo-VL-7B-RL-2508
MiMo-VL-7B-SFT-2508数字化转型网www.szhzxw.cn
- 用户可以根据实际需求，基于此模型进行SFT以及RL。相比于上一版SFT模型，该模型的RL稳定性更高。
- 开源地址:https://huggingface.co/XiaomiMiMo/MiMo-VL-7B-SFT-2508

声明：本文来自网络，版权归作者所有。文章内容仅代表作者独立观点，不代表数字化转型网立场，转载目的在于传递更多信息。如有侵权，请联系我们。数字化转型网www.szhzxw.cn

本文由数字化转型网（www.szhzxw.cn）转载而成，来源于网络；编辑/翻译：数字化转型网（Professionalism Achieves Leadership 专业造就领导者）鲍勃

小米开源最新多模态大模型 Xiaomi MiMo-VL-7B-2508