Markdown-to-Image – 开源的在线 Markdown 转海报编辑器
Markdown-to-Image是什么 Markdown-to-Image是开源的Markdown 转海报编辑器,作为React组件能将Markdown文本内容转换成图…
TÜLU 3 – Ai2 推出的系列开源指令遵循模型
TÜLU 3是什么 TÜLU 3是艾伦人工智能研究所(Ai2)推出的一系列开源指令遵循模型,包括8B和70B两个版本,未来计划推出405B版本。模型在性能上超越Llama…
微软全面引入AI挖掘Windows漏洞,后续安全补丁修复数量将大幅增加
微软Windows与设备部门执行副总裁Pavan Davuluri在博客发文透露,Windows团队正全面利用AI挖掘漏洞,后续Patch Tuesday安全更新将包含更…
SenseNova-Vision – 商汤开源的理解生成统一视觉大模型
SenseNova-Vision是什么 SenseNova-Vision 是商汤开源的理解生成统一视觉大模型,将目标检测、图像分割、深度预测、3D重建等经典视觉任务原生融…
EchoMimicV2 – 阿里推出的开源数字人项目,能生成完整数字人半身动画
EchoMimicV2是什么 EchoMimicV2是阿里蚂蚁集团推出的半身人体AI数字人项目,基于参考图片、音频剪辑和手部姿势序列生成高质量动画视频,确保音频内容与半身…
《智能体个人信息保护自律公约》正式发布,腾讯百度等31家企业首批签署
7月13日午间,在2026中国互联网大会“网民权益和个人信息保护论坛”上,《智能体个人信息保护自律公约》正式发布。腾讯、百度、美团、连尚集团等31家行业头部企业作为首批代…
米哈游AI陪伴软件《BSide: Olivia Lin》开启抢先体验,支持MIDI上传生成音乐视频
米哈游旗下AI陪伴互动软件《BSide: Olivia Lin》在Steam平台开启抢先体验。该应用需绑定米哈游通行证并支持与Steam账户关联,定位并非游戏,而是一款融…
FlipSketch – 萨里大学推出的文本引导生成无约束草图动画的AI系统
FlipSketch是什么 FlipSketch 是萨里大学推出的创新系统,能将静态绘图转变为文本引导的草图动画。技术基于三个关键创新实现:微调草图风格的帧生成、用噪声细…
StoryTeller – 字节、上海交大、北大共同推出的全自动长视频描述生成一致系统
StoryTeller是什么 StoryTeller是字节跳动、上海交通大学和北京大学共同推出的系统,能基于音频视觉角色识别技术改善长视频描述的质量和一致性。系统结合低级…
韩国编制 2027 财年 800 万亿韩元创纪录预算,AI芯片税收成主要财源
韩国政府宣布将编制 2027 财年规模超过 800 万亿韩元(约合3. 6 万亿元人民币)的创纪录财政预算,资金来源将主要依靠蓬勃发展的AI芯片产业带来的税收增长。相比 …
旗舰模型需求激增,OpenAI紧急解锁GPT-5.6Sol算力限制
由于旗舰模型GPT-5.6Sol的市场需求在过去48小时内出现爆发式激增,OpenAI今日宣布临时取消面向Plus、Pro及Business订阅用户的5小时使用限制,以应…
DELIFT – 数据高效语言模型指令微调算法
DELIFT是什么 DELIFT(Data Efficient Language model Instruction Fine-Tuning)是基于高效数据优化语言模型指…
HART – 麻省理工学院推出的自回归视觉生成模型
HART是什么 HART(Hybrid Autoregressive Transformer)是麻省理工学院研究团队推出的自回归视觉生成模型。能直接生成1024×1024…
阶跃星辰发布 Step Edge 系列终端模型,实现本地高效多模态处理
近日,阶跃星辰正式发布了面向手机、车载等终端设备的 Step Edge 系列终端模型,包括基础版、Audio 版、GUI 版和 Gen 版四大版本。该系列模型可在本地处理…
蚂蚁集团连发两款开源安全模型,为大模型与智能体套上“紧箍咒”
7月13日,蚂蚁AI安全实验室宣布开源智能体安全护栏SingGuard-NSFA,并同步披露多模态安全护栏SingGuard的详细信息。两款模型分别面向“自主执行的智能体…
WebDreamer – 基于大语言模型模拟网页交互增强网络规划能力的框架
WebDreamer是什么 WebDreamer是俄亥俄州立大学和Orby AI研究团队推出的基于模型规划的网络智能体,基于大型语言模型(LLMs),特别是GPT-4o,…
