Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: Add-it – 英伟达推出无需训练的图像编辑技术
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > Add-it – 英伟达推出无需训练的图像编辑技术
AIGC 资讯

Add-it – 英伟达推出无需训练的图像编辑技术

站外新闻
最近更新: 2026年7月14日 上午1:18
SHARE

Add-it是什么

Add-it是NVIDIA推出的无需训练的图像编辑技术,能根据文本指令在图像中添加对象。这项技术基于扩展扩散模型的注意力机制,整合场景图像、文本提示和生成图像的信息,实现结构一致性和自然的对象放置。Add-it在真实和生成图像的插入基准测试中表现优异,优于监督学习方法,且在超过80%的情况下更受人类偏好。

阅读目录
  • Add-it是什么
  • Add-it的主要功能
  • Add-it的技术原理
  • Add-it的项目地址
  • Add-it的应用场景

Add-it

Add-it的主要功能

  • 对象插入:根据文本指令在图像中无缝插入新对象。
  • 结构保持:在添加新对象的同时保持原始场景的结构一致性。
  • 自然融合:确保新对象与现有场景自然融合,看起来协调。
  • 无需训练:不需要针对特定任务的微调或训练。
  • 性能优越:在多个基准测试中取得了最先进的结果,包括新构建的“Additing Affordance Benchmark”。
  • 逐步生成:能逐步生成图像,最终图像更好地适应用户在每一步的偏好。
  • 非真实感图像处理:能处理非真实感(如卡通或艺术风格)的源图像。

Add-it的技术原理

  • 结构转移:将源图像的结构注入目标图像,保持场景的一致性。
  • 扩展自注意力块:扩展自注意力机制,让目标图像能从文本提示和源图像中提取关键信息,每个源分别加权,实现更精准的对象放置。
  • 主题引导潜在混合:用主题引导的潜在混合技术保留源图像的精细细节,如纹理和阴影,确保新对象与场景的自然融合。
  • 加权扩展注意力机制:基于加权机制,确保在整合信息时,不同来源的信息得到适当的重视,实现更自然的对象放置。
  • 无需额外训练:用预训练的扩散模型,无需额外的训练步骤,实现高质量的图像编辑。

Add-it的项目地址

  • 项目官网:research.nvidia.com/labs/par/addit
  • GitHub仓库:https://github.com/NVlabs/addit
  • arXiv技术论文:https://arxiv.org/pdf/2411.07232

Add-it的应用场景

  • 广告和营销:在广告图像中添加产品或品牌元素,创建更具吸引力的广告材料。
  • 内容创作:艺术家和设计师快速将想象中的对象或场景融入到现有的艺术作品中。
  • 电影和游戏制作:在电影或游戏的背景中添加虚拟角色或物体,增强视觉效果。
  • 新闻媒体:在新闻报道中,添加或替换图像中的特定元素。
  • 社交媒体:用户在社交媒体上分享的图片中添加文本描述的对象,增加互动性和趣味性。
颠覆传统模式!美国将改革 2000 亿美元科研预算,重心转向个体与AI
Kimi K3 开源首夜至少 18 家美国企业火速部署
CustomCrafter – 腾讯联合浙大推出的自定义视频生成框架
ASAM – vivo公司推出的AI图像分割模型
你的数据正在“喂养”AI:谷歌隐私设置静默更新,如何守护个人信息?
分享
Email 复制链接 打印
Share
上一篇 DINO-X – IDEA 研究院推出的通用视觉大模型
下一篇 In-Context LoRA – 阿里通义推出的基于DiTs的图像生成框架
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

FeyNoBg – Feyn Labs 开源的自动背景去除模型
AIGC 资讯
Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型
AIGC 资讯
全息流体渐变通用占位特色图
微软云端隐忧:千亿营收背后的增速换挡与杠杆风险
AIGC 资讯
全息流体渐变通用占位特色图
微信公众号推出 AI”一键排版”:自动分段、生成小标题、匹配配图三步到位
AIGC 资讯

相关推荐

AI 工具AIGC 资讯

GPT-Realtime-Translate:OpenAI 实时语音翻译模型,70+语言端到端直译,成本仅为人类同传万分之一

站外新闻
AIGC OpenAI API 同声传译 实时语音翻译 端到端模型
AI 工具AIGC 资讯

大晓机器人Kairos 3.0-4B开源:全球首个端侧具身世界模型,推理速度提升72倍!

站外新闻
世界模型 具身智能 大晓机器人 机器人控制 端侧部署
全息流体渐变通用占位特色图
AIGC 资讯

估值一年翻倍!AI网关巨头OpenRouter获谷歌1.13亿美元投资,揭示多模型调度万亿市场

站外新闻
AI网关 OpenRouter 企业AI
AIGC 资讯

微软确认开发Copilot AI超级应用,整合聊天、编程与智能代理能力

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney GPT Image 2 prompt AI Agent 写实人像 多模态大模型 EvoLink灵感 AI绘画 字节跳动 时尚大片 杂志排版 开源工具 开源模型 产品设计 商业海报 皮克斯风格 3D动画 色彩分析 AI生图 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 MoE架构 多模态AI
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.