Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • 强化 AI 学习
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • 社区
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: Xiaomi MiMo – 小米开源的首个推理大模型
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • 强化 AI 学习
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • 社区
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > Xiaomi MiMo – 小米开源的首个推理大模型
AIGC 资讯

Xiaomi MiMo – 小米开源的首个推理大模型

站外新闻
最近更新: 2026年6月8日 上午6:14
SHARE

Xiaomi MiMo是什么

Xiaomi MiMo 是小米开源的首个推理(Reasoning)大模型,支持提升模型在复杂推理任务中的表现。模型基于联动预训练和后训练,挖掘大量富推理语料并采用创新的强化学习算法,显著提升数学推理和代码生成能力。MiMo 仅用 7B 参数规模,在公开测评集上超越 OpenAI 的 o1-mini 和阿里 Qwen 的 QwQ-32B-Preview 等更大规模模型。Xiaomi MiMo包含4 个模型版本,预训练模型MiMo-7B-Base、监督微调模型MiMo-7B-SFT、强化学习模型MiMo-7B-RL和MiMo-7B-RL-Zero已开源至 HuggingFace,为开发者提供强大的推理工具。

阅读目录
  • Xiaomi MiMo是什么
  • Xiaomi MiMo的主要功能
  • Xiaomi MiMo的技术原理
  • Xiaomi MiMo的项目地址
  • Xiaomi MiMo的应用场景

小米最新发布的开源大语言模型MiMo-V2-Flash,采用5:1比例的滑动窗口注意力(窗口大小128)与全局注意力交替,减少KV缓存近6倍,兼顾长文本性能与效率。支持并行预测多个token,平均接受长度2.8-3.6,推理速度提升2-2.6倍,尤其优化编码任务效率。在多项基准测试中媲美DeepSeek-V3.2、Kimi-K2等头部开源模型。

Xiaomi MiMo

Xiaomi MiMo的主要功能

  • 强大的数学推理能力:解决复杂的数学问题,提供准确的推理路径和答案。
  • 高效的代码生成能力:生成高质量的代码,适用于多种编程任务。
  • 优化的推理性能:基于预训练和后训练的联动提升推理能力,用 7B 参数规模超越更大规模的模型,展现出高效的推理性能。

Xiaomi MiMo的技术原理

  • 预训练阶段:着重挖掘富推理语料,合成约 200B tokens 的推理数据,确保模型见过更多推理模式。基于三阶段训练,逐步提升训练难度,总训练量达到 25T tokens,模型在不同难度的任务中逐步提升能力。
  • 后训练阶段:
    • 强化学习算法:推出 Test Difficulty Driven Reward 算法,缓解困难算法问题中的奖励稀疏问题,提升模型在复杂任务中的表现。
    • 数据重采样策略:引入 Easy Data Re-Sampling 策略,稳定强化学习(RL)训练过程。
    • 高效训练框架:设计 Seamless Rollout 系统,加速 RL 训练(2.29 倍)和验证(1.96 倍),提升训练效率。
  • 模型架构优化:针对推理任务优化模型架构,确保在有限参数规模下实现高效推理能力。

Xiaomi MiMo的项目地址

  • GitHub仓库:https://github.com/XiaomiMiMo
  • HuggingFace模型库:https://huggingface.co/XiaomiMiMo
  • 技术论文:https://github.com/XiaomiMiMo/MiMo/blob/main/MiMo-7B-Technical-Report.pdf

Xiaomi MiMo的应用场景

  • 教育领域:辅助数学解题和编程学习,提供解题步骤和代码示例。
  • 科研与学术:协助逻辑推理和算法开发,帮助验证假设和设计实验。
  • 软件开发:生成和优化代码,辅助代码调试和问题解决。
  • 智能客服:解答复杂问题,提升问答系统效率。
  • 游戏娱乐:提供策略建议和智力谜题解答,增加游戏趣味性。
OpenAI发布GPT-5.5:编程、科研、办公全面超越,AI智能体时代加速到来
Skywork R1V4-Lite:昆仑万维开源轻量级多模态智能体,单图驱动视觉推理新范式
GPT-4.5 通过图灵测试胜率73%超真人!AI如何学会‘完美撒谎’颠覆信任
OpenHands – AI编程工具,多智能体协作实现代码编写、命令运行等
NMT – 阿里联合 UC Berkeley 推出的多任务学习框架
分享
Email 复制链接 打印
Share
上一篇 SWE-1 – Windsurf推出的首个软件工程 AI 模型系列
下一篇 福棠·百川 – 百川智能联合北京儿童等推出的儿科大模型
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

快手OneRec:颠覆传统推荐!端到端生成式AI系统引爆观看时长与GMV
AI 工具 AIGC 资讯
Kimi-Researcher:月之暗面端到端强化学习Agent,深度研究基准测试超Claude 4 Opus
AI 工具 AIGC 资讯
华为盘古大模型5.5震撼发布:7180亿参数Ultra MoE领衔,五大模型重塑产业智能
AI 工具 AIGC 资讯
腾讯清华重磅开源MindOmni:强化学习驱动的多模态推理生成模型,重塑视觉AI边界
AI 工具 AIGC 资讯

相关推荐

GPTs 系列介绍 [译]

宝玉的分享
AIGC 资讯

ArtCrafter – 清华联合鹏城实验室和联想共同推出的文本到图像风格迁移框架

站外新闻
流光脑波AI大脑占位特色图
AIGC 资讯最新趋势

奥尔特曼最新反思:AI对白领岗位的冲击远低于预期,短期失业潮并未出现

站外新闻
AI就业影响 openai 白领岗位 萨姆·奥尔特曼 裁员
AI 工具AIGC 资讯

谷歌发布Gemini 3.1 Flash Live:实时语音AI新标杆,情绪感知与低延迟引爆多语言交互革命

站外新闻
Gemini SynthID水印 实时语音模型 语音交互 谷歌AI
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

Agent AI AI Agent AIGC AI大模型 AI安全 AI工具 AI智能体 AI绘画 AI编程 AI编程助手 AI编程工具 AI编程模型 AI视频生成 AI音乐生成 Anthropic chatgpt Claude Claude Code DeepSeek Gemini GPT-5.3 Instant GPT-5.3-Codex-Spark GPT-5.4 MCP协议 meta Midjourney MiniMax MoE架构 MoE模型 openai prompt Qwen3 RAG SWE-Bench xAI 上海人工智能实验室 世界模型 人工智能 人物 代码生成 企业级AI 全模态大模型 具身智能 命令行工具 图像生成 图像生成模型 多智能体 多模态 多模态AI 多模态大模型 多模态模型 大模型 大模型应用 大语言模型 字节跳动 小红书 展台 开源 开源AI 开源AI工具 开源大模型 开源工具 开源平台 开源框架 开源模型 开源项目 强化学习 微软 扩散模型 教程 数字人 文本转语音 早报 昆仑万维 智谱AI 月之暗面 清华大学 知识管理 科大讯飞 端侧AI 美团 腾讯 腾讯混元 自然语言处理 英伟达 蚂蚁集团 视觉语言模型 视频生成 视频生成模型 语音合成 谷歌 谷歌AI 谷歌DeepMind 通义千问 阶跃星辰 阿里巴巴 阿里通义 面壁智能 香港大学
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.