Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: Macaron-V1 – MindLab 推出的后训练多能力模型系统
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > Macaron-V1 – MindLab 推出的后训练多能力模型系统
AIGC 资讯

Macaron-V1 – MindLab 推出的后训练多能力模型系统

站外新闻
最近更新: 2026年7月22日 下午7:45
SHARE

Macaron-V1是什么

Macaron V1 是 MindLab 推出的后训练多能力模型系统,基于 GLM 5.2 基座,通过强化学习对约 0.5% 核心参数进行 LoRA 微调。系统独创 Mixture-of-LoRA(MoL)架构,挂载 Chat、Agent、Coding、UI 四个独立专家,由 Router 按需激活,彻底消除能力干扰。Macaron V1提供旗舰版 Venti与轻量版 Tall,覆盖对话、智能体、编程与交互式 UI 生成,实测生成速度达 320 字/秒。

阅读目录
  • Macaron-V1是什么
  • Macaron-V1的主要功能
  • Macaron-V1的技术原理
  • 如何使用Macaron-V1
  • Macaron-V1的核心优势
  • Macaron-V1的同类竞品对比
  • Macaron-V1的应用场景

Macaron V1

Macaron-V1的主要功能

  • MoL 后训练架构:冻结基座,仅训练 0.5% 核心参数,四个独立 LoRA 专家隔离优化,互不干扰,新增能力只需再挂一个 LoRA。
  • 双模型变体:旗舰 Venti(748B,基于 GLM 5.2,原生 1M 上下文扩展至 2M);轻量 Tall(35B,基于 Qwen 3.6,本地部署优化)。
  • 三大配套系统:UI4A通用生成式 UI 架构,渲染交互式视图、REPL Harness持久 Python 环境,模型自写工具并提升为全局工具、MinT自研训练平台,仅传递 Adapter,支持百万级目录与万亿参数。
  • 自建评测基准:Macaron ChatBench支持长上下文诚实对齐与 LivingBench动态沙盒环境,验证持续理解与任务重规划。
  • 极致生成速度:API 实测 320 字/秒,34.3 秒完成 10,975 字长文。

Macaron-V1的技术原理

  • MoL(Mixture-of-LoRA)架构:冻结 GLM 5.2 基座全部权重,仅提取约 0.5% 的核心参数构建四个独立的 LoRA 专家模块,分别专精 Chat、Agent、Coding、UI 四大能力方向。每个专家在隔离的适配空间中独立优化,彻底消除多能力联合训练时常见的”按下葫芦浮起瓢”式相互干扰问题。用户输入经显式 Router Tool 路由至对应专家,实现按需激活与资源高效利用。
  • LongStraw 长上下文扩展:基于自研 LongStraw 技术,将 GLM 5.2 原生 1M 上下文窗口扩展至 2M。核心机制是将共享提示词复用为常驻状态,避免长序列中重复计算带来的开销,大幅降低长上下文推理的资源消耗与延迟,使模型在处理超长文档、多轮复杂对话时保持高效稳定。
  • MinT 分布式训练平台:MindLab 自研的后训练基础设施,核心设计突破传统分布式训练中 Actor 与 Learner 需传递完整权重的瓶颈,改为仅传递轻量 Adapter。这一设计天然契合 MoL 架构,支持百万级 Adapter 目录管理,端到端可覆盖万亿参数规模模型的强化学习训练,显著降低通信带宽与存储压力。
  • 真实环境驱动的奖励函数:区别于依赖人工标注或静态基准的训练范式,Macaron 强调来自真实产品环境的奖励信号。团队自建 Macaron ChatBench 与 LivingBench 两个动态评测基准:前者考察长上下文中的诚实对齐与任务完成能力,后者在包含动态噪声、动态环境与动态用户的沙盒中验证模型的持续理解、信息验证与任务重规划能力,确保模型在真实交互中持续进化。

如何使用Macaron-V1

Macaron V1 处于内测阶段,可通过 macaron 网关 https://mintcn.macaron.xin 调用 API。

Macaron-V1的核心优势

  • 能力隔离不互扰:MoL 架构让各专家独立优化,彻底避免多能力混训时的性能此消彼长。
  • 极低成本扩展:新增能力仅需挂载新 LoRA,无需重新训练整个模型,灵活组合。
  • 超长上下文支持:LongStraw 技术将上下文扩展至 2M,且通过状态复用降低长序列开销。
  • 真实环境进化:自建动态评测基准,模型在模拟真实噪声与动态用户的环境中持续迭代。
  • 生成速度领先:实测 320 字/秒,远超市面主流模型,首 token 响应后持续稳定输出。

Macaron-V1的同类竞品对比

维度 Macaron V1 GPT 5.5
训练范式 后训练(基于 GLM 5.2) 端到端预训练 + RL
参数效率 仅训练 0.5% 参数(LoRA) 全参数训练
能力扩展 挂载新 LoRA 即可,灵活组合 需重新训练整个模型
架构特色 MoL 多专家隔离,互不干扰 单一模型端到端优化
上下文长度 2M(LongStraw 扩展) 128K-1M
生成速度 320 字/秒 中等
UI 生成 原生支持(UI4A) 不支持
自写工具 原生支持(REPL Harness) 不支持
ChatBench 58.3 55.5
LivingBench 64.0 61.9
PinchBench 94.0 89.0
TerminalBench 2.1 87.6 83.4
UI4ABench 87.8 72.1

Macaron-V1的应用场景

  • 企业级复杂任务处理:Venti 面向高阶场景,提供稳定可靠的推理与执行能力。
  • 智能 Agent 开发:支持工具调用、任务规划与动态环境交互,适用于自动化工作流。
  • 代码生成与工程化:覆盖代码生成、调试、算法开发及 SWE 任务,TerminalBench 2.1 得分 87.6。
  • 交互式 UI 自动生成:通过 UI4A 渲染可交互界面,适用于前端原型与可视化表达。
  • 本地轻量部署:Tall 版本低成本、开箱即用,适合个人开发者与边缘设备集成。
Open-LLM-VTuber – AI数字人语音交互项目,支持实时语音对话和视觉感知
OpenAI大整合:聊天、办公、编程三合一,全新ChatGPT桌面应用上线
LLaVA-OneVision-1.5重磅发布:低成本高性能多模态模型,全栈开源助力AI应用爆发
Graphiti – 开源AI动态知识图谱生成框架
Chat2SVG – 文本描述实现高质量矢量图形的生成框架
分享
Email 复制链接 打印
Share
上一篇 全息流体渐变通用占位特色图 ​三星计划投资 Mistral AI,力求打破美国科技巨头的垄断
下一篇 [AI生图咒语] 机械少女探险家 Lira 全套三视图角色设定图
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

[AI生图咒语] cute rubber duck boy cha 高清生图提示词
产品与广告
[AI生图咒语] Using the reference 2D c 高清生图提示词
产品与广告
[AI生图咒语] Referencing a specific p 高清生图提示词
动漫与插画
[AI生图咒语] 大唐贵妃杨玉环高清超写实宫廷肖像摄影
产品与广告

相关推荐

AIGC 资讯

2GB内存也能跑大模型!谷歌Gemini Go正式下凡,入门级安卓机迎来AI普惠

站外新闻
AI 工具AIGC 资讯

谷歌重磅开源MedASR:医疗语音识别专用大模型,5000小时临床数据训练,识别率再突破

站外新闻
Conformer架构 MedASR 临床对话转录 医疗语音识别 谷歌开源
AIGC 资讯

WorldMem – 南洋理工联合北大和上海 AI Lab 推出的世界生成模型

站外新闻
全息流体渐变通用占位特色图
AIGC 资讯

阿里新一代大模型千问3. 8 将至:预览版抢先登陆阿里云与Qoder,正式版拟近期开源

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent 多模态大模型 AI绘画 EvoLink灵感 GPT Image 2 字节跳动 开源模型 开源工具 早报 具身智能 openai 大语言模型 开源大模型 强化学习 阿里通义 腾讯混元 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成 chatgpt 大模型
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.