Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: EAFormer – 复旦推出的AI文本分割框架
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > EAFormer – 复旦推出的AI文本分割框架
AIGC 资讯

EAFormer – 复旦推出的AI文本分割框架

站外新闻
最近更新: 2026年7月19日 上午11:48
SHARE

EAFormer是什么

EAFormer是复旦推出的AI文本分割框架。擅长在照片中找到文字,并且能很精确地把文字从背景中分离出来。即使文字的边缘很模糊或者背景很复杂,EAFormer也能做得很好。对于想要从图片中去除文字或者编辑文字的人来说非常有用。EAFormer是一个能让我们轻松处理图片中文字的智能助手。

阅读目录
  • EAFormer是什么
  • EAFormer的主要功能
  • EAFormer的技术原理
  • EAFormer的项目地址
  • EAFormer的应用场景

EAFormer

EAFormer的主要功能

  • 找文本:在照片或图片里,EAFormer能快速找到所有的文字。
  • 描边角:不仅能找到文字,还能特别准确地描绘出文字的边缘,哪怕是弯弯曲曲的地方。
  • 改背景:如果你想把图片里的文字去掉,换上新的背景,EAFormer让文字看起来像是从未有过一样。
  • 学新招:如果EAFormer碰到了新的或不同语言的文字,能很快学会并提高识别能力。

EAFormer的技术原理

  • 文本边缘提取器:利用Canny算法检测图像中的边缘,并结合轻量级文本检测模型来过滤非文本区域的边缘,只保留文本区域的边缘信息。
  • 边缘引导编码器:基于SegFormer框架构建,通过对称交叉注意力层在编码过程中融入边缘信息,增强模型对文本边缘的感知能力。
  • MLP解码器:采用多层感知机(MLP)层来融合特征并预测最终的文本mask,实现文本区域的精确分割。
  • 损失函数设计:使用文本检测损失和文本分割损失两种交叉熵损失进行优化,通过超参数平衡两者权重,简化了超参数选择的复杂性。
  • 数据集重新标注:针对COCO_TS和MLT_S等数据集的标注质量问题,进行了重新标注,确保评估结果的可靠性和模型训练的准确性。
  • 特征融合策略:在边缘引导编码器中,通过设计的对称交叉注意机制仅在第一层融合边缘信息,避免了在所有层中融合边缘信息可能带来的性能下降。
  • 轻量级文本检测器:在文本边缘提取器中使用,包括基于ResNet的骨干网络和MLP解码器,用于提取文本区域特征并辅助边缘过滤。

EAFormer

EAFormer的项目地址

  • GitHub仓库:https://hyangyu.github.io/EAFormer/
  • arXiv技术论文:https://arxiv.org/abs/2407.17020

EAFormer的应用场景

  • 场景文本识别:在自然场景或图片中识别和分割文本,用于信息提取或数据挖掘。
  • 图像编辑:辅助图像编辑软件精确地擦除或替换图像中的文本,保持背景的自然和连贯性。
  • 广告屏蔽:在视频流或图像中自动检测并遮挡广告或其他不希望出现的文本。
  • 版权保护:帮助识别和保护版权文本,防止未经授权的复制或分发。
  • 文档处理:自动化文档扫描和数字化过程中的文本识别,提高文档处理的效率和准确性。
开源3D AI桌面伴侣Super Agent Party:微信QQ/B站直播全渠道一键部署,集桌宠、智能助手、知识库于一身
OmniSVG – 复旦大学联合 StepFun 推出端到端多模态矢量图形生成模型
MultiTalk:美团等联合推出AI视频生成框架,音频驱动多人对话,口型精准同步
SeniorTalk – 智源联合南开开源的超高龄老年人中文对话语音数据集
谷歌重磅开源!Computer Use Preview:用自然语言指挥AI操控浏览器,零代码实现网页自动化
分享
Email 复制链接 打印
Share
上一篇 WiseFlow – 开源的AI信息挖掘工具
下一篇 Imagen 3 – Google推出的AI图像生成模型
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

FeyNoBg – Feyn Labs 开源的自动背景去除模型
AIGC 资讯
Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型
AIGC 资讯
全息流体渐变通用占位特色图
微软云端隐忧:千亿营收背后的增速换挡与杠杆风险
AIGC 资讯
全息流体渐变通用占位特色图
微信公众号推出 AI”一键排版”:自动分段、生成小标题、匹配配图三步到位
AIGC 资讯

相关推荐

AIGC 资讯

X-Dancer – 字节等机构推出音乐驱动的人像舞蹈视频生成框架

站外新闻
AIGC 资讯

Stable Diffusion 3.5 – Stability AI最新开源的图像生成模型

站外新闻
AIGC 资讯

ViTPose – 基于 Transformer 架构的人体姿态估计模型

站外新闻
AI 工具AIGC 资讯

月之暗面开源Kimi Linear架构:6倍解码提速、长文本处理效率革命

站外新闻
Kimi Delta Attention Kimi Linear 大模型长文本处理 月之暗面 混合线性注意力
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent GPT Image 2 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成 chatgpt 大模型
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.