Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: LLaDA – 人大高瓴AI联合蚂蚁推出的扩散大语言模型
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > LLaDA – 人大高瓴AI联合蚂蚁推出的扩散大语言模型
AIGC 资讯

LLaDA – 人大高瓴AI联合蚂蚁推出的扩散大语言模型

站外新闻
最近更新: 2026年6月9日 上午7:01
SHARE

LLaDA是什么

LLaDA(Large Language Diffusion with mAsking)是中国人民大学高瓴AI学院李崇轩、文继荣教授团队和蚂蚁集团共同推出的新型大型语言模型,基于扩散模型框架而非传统的自回归模型(ARM)。LLaDA基于正向掩蔽过程和反向恢复过程建模文本分布,用Transformer作为掩蔽预测器,优化似然下界实现生成任务。LLaDA在预训练阶段使用2.3万亿标记的数据,基于监督微调(SFT)提升指令遵循能力。LLaDA在可扩展性、上下文学习和指令遵循等方面表现出色,在反转推理任务中解决传统ARM的“反转诅咒”问题。其8B参数版本在多项基准测试中与LLaMA3等强模型相当,展现了扩散模型作为自回归模型替代方案的巨大潜力。

阅读目录
  • LLaDA是什么
  • LLaDA的主要功能
  • LLaDA的技术原理
  • LLaDA的项目地址
  • LLaDA的应用场景

LLaDA

LLaDA的主要功能

  • 高效生成文本:能生成高质量、连贯的文本内容,适用于写作、对话、内容创作等场景。
  • 强大的上下文学习能力:根据上下文快速适应新任务。
  • 指令遵循能力:能更好地理解和执行人类指令,适用于多轮对话、问答和任务执行等场景。
  • 双向推理能力:解决传统自回归模型的“反转诅咒”,在正向和反向推理任务中均表现出色,例如诗歌补全任务。
  • 多领域适应性:在语言理解、数学、编程、中文理解等多个领域表现出色,具有广泛的适用性。

LLaDA的技术原理

  • 扩散模型框架:基于正向掩蔽过程(逐渐将文本中的标记掩蔽)和反向恢复过程(逐步恢复被掩蔽的标记)建模文本分布。支持模型用非自回归的方式生成文本,避免传统自回归模型的顺序生成限制。
  • 掩蔽预测器:用普通的Transformer架构作为掩蔽预测器,输入部分掩蔽的文本序列,预测所有掩蔽标记。让模型能捕捉双向依赖关系,而不仅仅是单向的左到右生成。
  • 优化似然下界:基于优化似然下界训练模型,在生成建模中是原理性的,确保模型在大规模数据和模型参数下的可扩展性和生成能力。
  • 预训练与监督微调:LLaDA基于预训练和监督微调(SFT)相结合的方式。预训练阶段用大规模文本数据进行无监督学习,SFT阶段基于标注数据提升模型的指令遵循能力。
  • 灵活的采样策略:在生成过程中,LLaDA支持多种采样策略(如随机掩蔽、低置信度掩蔽、半自回归掩蔽等),平衡生成质量和效率。

LLaDA的项目地址

  • 项目官网:https://ml-gsai.github.io/LLaDA
  • GitHub仓库:https://github.com/ML-GSAI/LLaDA
  • arXiv技术论文:https://arxiv.org/pdf/2502.09992

LLaDA的应用场景

  • 多轮对话:用于智能客服、聊天机器人等,支持流畅的多轮交流。
  • 文本生成:适用于写作辅助、创意文案等,能生成高质量文本。
  • 代码生成:帮助开发者生成代码片段或修复错误,提升编程效率。
  • 数学推理:解决数学问题,提供解题步骤,可用于教育领域。
  • 语言翻译:实现多语言翻译,促进跨文化交流。
Leffa – Meta 开源的图像生成框架,精确控制人物的外观和姿势
PanoDreamer – 单张图像生成连贯360° 3D场景的新方法
阿里通义Qwen3.7-Max旗舰大模型发布:全能智能体基座,编程推理全面领先,定义AI Agent新标杆
Google DeepMind发布Lyria 3:AI音乐生成模型重大突破,一句话生成带人声的30秒完整歌曲
Pixtral Large – Mistral AI开源的超大多模态模型
分享
Email 复制链接 打印
Share
上一篇 Sonic – 腾讯联合浙大推出的音频驱动肖像动画框架
下一篇 OpenThinker-32B – 斯坦福、UC 伯克利等机构联合开源的推理模型
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

OpenAI扩大ChatGPT家长通知,青少年暴力违规将触发提醒
AIGC 资讯
GPT‑5.4 – OpenAI推出面向专业工作的旗舰AI模型
AIGC 资讯
​YouTube 收紧政策,严打低质 AI 内容
AIGC 资讯
小鹏甩出TuringViT视觉编码器:只用十分之一数据,却把SOTA基线甩在身后
AIGC 资讯

相关推荐

AIGC 资讯

讯飞星火X1 – 科大讯飞推出的首个全国产深度推理大模型

站外新闻
AIGC 资讯

Markdown-to-Image – 开源的在线 Markdown 转海报编辑器

站外新闻
AIGC 资讯

GitHub MCP Server – GitHub推出基于 MCP 的服务器工具

站外新闻
AIGC 资讯

Promptic – 轻量级LLM应用开发框架,通过一行代码切换不同LLM

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent openai 多模态大模型 AI绘画 字节跳动 开源模型 开源工具 早报 具身智能 大语言模型 MoE架构 开源大模型 强化学习 阿里通义 Anthropic 腾讯混元 多模态AI 大模型 开源框架 AI智能体 教程 chatgpt AI工具 扩散模型 AI视频生成 蚂蚁集团 开源
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.