Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: Add-it – 英伟达推出无需训练的图像编辑技术
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > Add-it – 英伟达推出无需训练的图像编辑技术
AIGC 资讯

Add-it – 英伟达推出无需训练的图像编辑技术

站外新闻
最近更新: 2026年7月14日 上午1:18
SHARE

Add-it是什么

Add-it是NVIDIA推出的无需训练的图像编辑技术,能根据文本指令在图像中添加对象。这项技术基于扩展扩散模型的注意力机制,整合场景图像、文本提示和生成图像的信息,实现结构一致性和自然的对象放置。Add-it在真实和生成图像的插入基准测试中表现优异,优于监督学习方法,且在超过80%的情况下更受人类偏好。

阅读目录
  • Add-it是什么
  • Add-it的主要功能
  • Add-it的技术原理
  • Add-it的项目地址
  • Add-it的应用场景

Add-it

Add-it的主要功能

  • 对象插入:根据文本指令在图像中无缝插入新对象。
  • 结构保持:在添加新对象的同时保持原始场景的结构一致性。
  • 自然融合:确保新对象与现有场景自然融合,看起来协调。
  • 无需训练:不需要针对特定任务的微调或训练。
  • 性能优越:在多个基准测试中取得了最先进的结果,包括新构建的“Additing Affordance Benchmark”。
  • 逐步生成:能逐步生成图像,最终图像更好地适应用户在每一步的偏好。
  • 非真实感图像处理:能处理非真实感(如卡通或艺术风格)的源图像。

Add-it的技术原理

  • 结构转移:将源图像的结构注入目标图像,保持场景的一致性。
  • 扩展自注意力块:扩展自注意力机制,让目标图像能从文本提示和源图像中提取关键信息,每个源分别加权,实现更精准的对象放置。
  • 主题引导潜在混合:用主题引导的潜在混合技术保留源图像的精细细节,如纹理和阴影,确保新对象与场景的自然融合。
  • 加权扩展注意力机制:基于加权机制,确保在整合信息时,不同来源的信息得到适当的重视,实现更自然的对象放置。
  • 无需额外训练:用预训练的扩散模型,无需额外的训练步骤,实现高质量的图像编辑。

Add-it的项目地址

  • 项目官网:research.nvidia.com/labs/par/addit
  • GitHub仓库:https://github.com/NVlabs/addit
  • arXiv技术论文:https://arxiv.org/pdf/2411.07232

Add-it的应用场景

  • 广告和营销:在广告图像中添加产品或品牌元素,创建更具吸引力的广告材料。
  • 内容创作:艺术家和设计师快速将想象中的对象或场景融入到现有的艺术作品中。
  • 电影和游戏制作:在电影或游戏的背景中添加虚拟角色或物体,增强视觉效果。
  • 新闻媒体:在新闻报道中,添加或替换图像中的特定元素。
  • 社交媒体:用户在社交媒体上分享的图片中添加文本描述的对象,增加互动性和趣味性。
Decart AI开源Lucy Edit Dev:一句话指令即可编辑视频,保留原生运动与构图的革命性AI模型
Mini-Omni – 开源的端到端实时语音对话大模型
FlashFace – 阿里联合香港大学推出的高保真AI写真工具
LM Studio – 开源、傻瓜、一站式部署本地大模型 (LLM) 的应用平台
阿里云百炼CLI全面开源:一行命令编排AI Agent全栈能力,引爆开发者生态
分享
Email 复制链接 打印
Share
上一篇 DINO-X – IDEA 研究院推出的通用视觉大模型
下一篇 In-Context LoRA – 阿里通义推出的基于DiTs的图像生成框架
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

FeyNoBg – Feyn Labs 开源的自动背景去除模型
AIGC 资讯
Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型
AIGC 资讯
全息流体渐变通用占位特色图
微软云端隐忧:千亿营收背后的增速换挡与杠杆风险
AIGC 资讯
全息流体渐变通用占位特色图
微信公众号推出 AI”一键排版”:自动分段、生成小标题、匹配配图三步到位
AIGC 资讯

相关推荐

AIGC 资讯

CogVLM2 – 智谱AI推出的新一代多模态大模型

站外新闻
AIGC 资讯

Infinity – 字节跳动推出的高分辨率图像生成模型

站外新闻
AIGC 资讯

澳大利亚官员警告:部分 AI 模型已学会在实验中“作弊与欺骗”

站外新闻
AIGC 资讯

LLM2LLM – 通过迭代数据增强提升大语言模型的技术

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent GPT Image 2 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成 chatgpt 大模型
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.