Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: LLaDA2.2-flash – InclusionAI 开源的扩散语言模型
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > LLaDA2.2-flash – InclusionAI 开源的扩散语言模型
AIGC 资讯

LLaDA2.2-flash – InclusionAI 开源的扩散语言模型

站外新闻
最近更新: 2026年7月28日 上午11:55
SHARE

LLaDA2.2-flash是什么

LLaDA2.2-flash是InclusionAI开源的扩散语言模型(dLLM),采用MoE架构,总参数量约100B,原生支持128K上下文。模型通过多轮并行去噪拟合答案,引入莱文斯坦编辑实现序列的增删改能力。模型在7项Agent基准上平均得分53.83,逼近同规模自回归模型Ling-2.6-flash的55.74分,同时保持1.64倍解码吞吐优势。

阅读目录
  • LLaDA2.2-flash是什么
  • LLaDA2.2-flash的主要功能
  • LLaDA2.2-flash的技术原理
  • 如何使用LLaDA2.2-flash
  • LLaDA2.2-flash的核心优势
  • LLaDA2.2-flash的项目地址
  • LLaDA2.2-flash的同类竞品对比
  • LLaDA2.2-flash的应用场景

LLaDA2.2-flash

LLaDA2.2-flash的主要功能

  • 扩散式并行生成:通过块并行解码同时处理多个Token位置,实现高吞吐文本生成。
  • 莱文斯坦编辑:在去噪过程中支持KEEP、SUBSTITUTE、DELETE、INSERT四种编辑操作,突破定长替换限制。
  • 长上下文处理:原生支持128K上下文窗口,适配长程软件工程、工具调用轨迹等复杂场景。
  • Agent任务执行:支持代码修复、API交互、多轮工具调用等需要持续纠错的环境反馈任务。
  • MoE高效推理:采用混合专家架构,通过块路由机制控制长上下文下的推理成本。

LLaDA2.2-flash的技术原理

  • 扩散语言模型范式:与自回归模型从左到右逐Token生成不同,LLaDA2.2先确定一批待填补的噪声位置,通过多轮去噪逐步拟合出完整序列,多个位置协同推进具备反复打磨潜力。
  • 莱文斯坦编辑机制:用最长公共子序列(LCS)将生成草稿与目标序列对齐,构建KEEP、SUBSTITUTE、DELETE、INSERT四类编辑指令。DELETE移除冗余Token并左移后续序列,INSERT在当前位置前创建[MASK]等待后续填充,使模型具备非等长序列修正能力。
  • L-EBPO强化学习:提出基于莱文斯坦编辑证据下界的块级策略优化算法,外层优化多轮Agent交互的轨迹级决策,内层负责单次生成中Block内的插入和删除,通过恢复编辑轨迹使梯度覆盖结构决策,环境奖励来自工具调用正确性、输出格式有效性和任务完成度。
  • 块路由机制(Block Routing):针对MoE在长上下文块扩散中的专家并集膨胀问题,通过Token赛马取Block级准入分数,从256个路由专家中选出Top-48组成候选池,再在每个Token在池内执行Top-k路由,使专家工作集获得可预测的O(C)上界。

挖挖GitHub

微信关注回复“开源”,加入AI开源项目交流群

如何使用LLaDA2.2-flash

  • 硬件准备:本地部署LLaDA2.2-flash需配备至少4张A100-80GB或同等显存GPU支持BF16全精度加载,若使用FP8量化或处理128K长上下文场景则需相应预留更多显存资源。
  • 模型下载:通过ModelScope SDK下载模型时,执行from modelscope import snapshot_download; model_dir = snapshot_download("inclusionAI/LLaDA2.2-flash")可自动完成约206GB模型文件的下载。
  • Git克隆:若采用Git LFS方式获取模型,运行git lfs install初始化大文件支持,执行git clone https://modelscope.cn/models/inclusionAI/LLaDA2.2-flash.git拉取完整模型仓库。
  • 模型加载:用Transformers加载模型时,调用AutoModelForCausalLM.from_pretrained(model_path, trust_remote_code=True, device_map="auto")并务必设置trust_remote_code=True启用自定义扩散解码逻辑。
  • 精度设置:模型加载完成后,执行model = model.to(torch.bfloat16)将其转换为BF16精度,随后调用model.eval()将模型切换至评估推理模式。
  • 分词器加载:同步加载对应分词器AutoTokenizer.from_pretrained(model_path, trust_remote_code=True),确保分词规则与模型配置完全匹配。
  • 输入构造:构造用户提示后,通过tokenizer.apply_chat_template([{"role": "user", "content": prompt}], add_generation_prompt=True, tokenize=True, return_tensors="pt")将对话格式化为模型所需的输入张量。
  • 参数配置:调用model.generate()时配置关键扩散解码参数:block_length=32控制每步并行去噪Token数量,threshold=0.5设定去噪置信度阈值,editing_threshold=0.0关闭主动编辑,temperature=0.0启用贪心解码,gen_length=512设定最大生成长度。
  • 结果解码:生成完成后,使用tokenizer.decode(generated_tokens[0], skip_special_tokens=True)将Token序列解码为可读文本并输出最终结果。

LLaDA2.2-flash的核心优势

  • 高吞吐解码:BF16平均解码吞吐量达到同规模自回归模型Ling-2.6-flash的1.64倍,FP8量化后还可再提升18.6%。
  • 结构化自我纠错:莱文斯坦编辑使模型具备增删改能力,SWE-bench Verified解决率从35.8提升至44.4,绝对增益8.6个百分点。
  • 原生长上下文:通过持续预训练从8K扩展到128K,非外推方式,适配Agent长程交互需求。
  • 开源可复现:采用Apache-2.0协议,模型与训练细节均已公开,支持本地完整复现。
  • MoE推理效率:块路由机制将每Block专家工作集控制在固定容量内,显著降低HBM流量与通信成本。

LLaDA2.2-flash的项目地址

  • GitHub仓库:https://github.com/inclusionAI/LLaDA2.X
  • ModelScope地址:https://modelscope.cn/models/inclusionAI/LLaDA2.2-flash

LLaDA2.2-flash的同类竞品对比

对比维度 LLaDA2.2-flash Ling-2.6-flash
架构范式 采用扩散语言模型(dLLM)结合 MoE 架构,通过多轮并行去噪生成序列。 采用自回归(AR)结合 MoE 架构,从左到右逐 Token 顺序生成文本。
序列编辑能力 原生支持莱文斯坦编辑,具备 KEEP、SUBSTITUTE、DELETE、INSERT 四种增删改操作。 无原生序列编辑能力,生成后修正需依赖外部重采样或后处理。
强化学习策略 使用 L-EBPO 算法,在环境反馈中联合优化轨迹级决策与块内编辑动作。 采用标准 RLHF 或传统强化学习框架进行对齐与优化。
Agent 基准均分 在 7 项 Agent 基准测试中平均得分为 53.83。 在相同 7 项 Agent 基准测试中平均得分为 55.74,高出 1.91 分。
解码吞吐量 BF16 平均解码吞吐量达到 Ling-2.6-flash 的 1.64 倍,FP8 量化后再提升 18.6%。 作为自回归基准模型,解码吞吐受逐 Token 生成方式限制。
上下文窗口 通过持续预训练原生支持 128K 上下文,非位置外推方式。 上下文能力未在公开技术报告中详细披露具体训练方式。

LLaDA2.2-flash的应用场景

  • 软件工程Agent:模型原生支持莱文斯坦编辑的增删改能力,可胜任代码修复、Bug定位、函数补全等需要非等长文本编辑的复杂编程任务。
  • 多轮工具调用:在API交互与MCP协议执行中,模型能够动态修正参数、增删字段,适配需要持续纠错的复杂Agent工作流。
  • 长文档处理:、原生128K上下文窗口,模型可高效完成长文本分析、报告生成与知识提取,无需依赖位置外推。
  • 科研与实验复现:作为开源的MoE扩散语言模型,LLaDA2.2-flash为学术界提供了自回归路线之外的可复现研究基座与替代技术路径。
Nemotron-Labs-Diffusion – 英伟达开源的三模式语言模型
StableAvatar: 复旦微软联手,音频驱动虚拟人视频生成革命,无需后处理即可生成无限长度高清视频
苹果联手初创公司,力推 AI 模型压缩技术,让 iPhone 也能跑大型 AI!
Qwen-AgentWorld – 通义千问推出的原生语言世界模型
BlockDance – 复旦联合字节推出的扩散模型加速方法
分享
Email 复制链接 打印
Share
上一篇 SearchOS – 蚂蚁集团等开源的多智能体搜索协作框架
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

SearchOS – 蚂蚁集团等开源的多智能体搜索协作框架
AIGC 资讯
UniWorld-View – 兔展智能联合北大等开源的世界模型
AIGC 资讯
全息流体渐变通用占位特色图
OpenAI 想把 ChatGPT 塞进你的眼镜:布罗克曼盯上可穿戴,API 仍是早期雏形
AIGC 资讯
CoGenAV – 通义联合深圳技术大学推出的多模态语音表征模型
AIGC 资讯

相关推荐

全息流体渐变通用占位特色图
AIGC 资讯

8800 万美元加注开源:Ollama跑进85%财富 500 强,喊出”全体上车”

站外新闻
AI 工具AIGC 资讯

阿里Qwen3-Omni-Flash全模态大模型重磅发布:支持119种语言+实时音视频交互,AI交互体验再升级

站外新闻
AIGC Qwen3-Omni-Flash 全模态大模型 多模态AI 阿里通义
AI 工具AIGC 资讯

重磅!小米MiMo V2系列2026年6月全面下线,开发者速迁至V2.5高性能版

站外新闻
AI开放平台 MiMo 小米 模型迭代
AIGC 资讯

DeepSeek-R1-Lite – 深度求索推出的新一代AI推理模型,媲美OpenAI o1-preview

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent GPT Image 2 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成 chatgpt 大模型
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.