FlipSketch – 萨里大学推出的文本引导生成无约束草图动画的AI系统
FlipSketch是什么 FlipSketch 是萨里大学推出的创新系统,能将静态绘图转变为文本引导的草图动画。技术基于三个关键创新实现:微调草图风格的帧生成、用噪声细…
StoryTeller – 字节、上海交大、北大共同推出的全自动长视频描述生成一致系统
StoryTeller是什么 StoryTeller是字节跳动、上海交通大学和北京大学共同推出的系统,能基于音频视觉角色识别技术改善长视频描述的质量和一致性。系统结合低级…
韩国编制 2027 财年 800 万亿韩元创纪录预算,AI芯片税收成主要财源
韩国政府宣布将编制 2027 财年规模超过 800 万亿韩元(约合3. 6 万亿元人民币)的创纪录财政预算,资金来源将主要依靠蓬勃发展的AI芯片产业带来的税收增长。相比 …
旗舰模型需求激增,OpenAI紧急解锁GPT-5.6Sol算力限制
由于旗舰模型GPT-5.6Sol的市场需求在过去48小时内出现爆发式激增,OpenAI今日宣布临时取消面向Plus、Pro及Business订阅用户的5小时使用限制,以应…
DELIFT – 数据高效语言模型指令微调算法
DELIFT是什么 DELIFT(Data Efficient Language model Instruction Fine-Tuning)是基于高效数据优化语言模型指…
HART – 麻省理工学院推出的自回归视觉生成模型
HART是什么 HART(Hybrid Autoregressive Transformer)是麻省理工学院研究团队推出的自回归视觉生成模型。能直接生成1024×1024…
阶跃星辰发布 Step Edge 系列终端模型,实现本地高效多模态处理
近日,阶跃星辰正式发布了面向手机、车载等终端设备的 Step Edge 系列终端模型,包括基础版、Audio 版、GUI 版和 Gen 版四大版本。该系列模型可在本地处理…
蚂蚁集团连发两款开源安全模型,为大模型与智能体套上“紧箍咒”
7月13日,蚂蚁AI安全实验室宣布开源智能体安全护栏SingGuard-NSFA,并同步披露多模态安全护栏SingGuard的详细信息。两款模型分别面向“自主执行的智能体…
WebDreamer – 基于大语言模型模拟网页交互增强网络规划能力的框架
WebDreamer是什么 WebDreamer是俄亥俄州立大学和Orby AI研究团队推出的基于模型规划的网络智能体,基于大型语言模型(LLMs),特别是GPT-4o,…
职场社交变“AI重灾区”?研究显示LinkedIn长篇垃圾内容占比高达41%
随着生成式人工智能的普及,社交媒体正在被AI内容淹没。根据数据分析公司 Pangram 的最新研究,在字数超过250字的社交媒体长篇帖子中,每四篇就有一篇是由…
哈啰试水AI校园社交,推出精准交友产品“Match”
据读佳消息,7月13日,哈啰在高校社交赛道祭出新动作,推出一款专为大学生打造的AI精准交友产品“Match”。该产品目前已在上海多所高校试点冷启动一个多月,吸引了超过1万…
商汤开源SenseNova-Vision统一视觉大模型,单模型横扫四大核心视觉任务
商汤科技正式发布并全面开源"日日新SenseNova-Vision"理解生成统一视觉大模型,这是商汤日日新大模型体系的重要视觉能力升级。商汤表示,行业以往的"统一视觉"多…
Kandinsky-3 – 开源的文本到图像生成框架,适应多种图像生成任务
Kandinsky-3是什么 Kandinsky-3是基于潜在扩散模型的文本到图像(T2I)生成框架,支持高质量和逼真度在图像合成。Kandinsky-3能适应多种图像生…
抖音电商将豆包纳入抖店结算序列,GEO全面进入成交归因时代
抖音电商近日完成重要战略调整,在最新修订的《商家技术服务费管理规范》及《技术服务费费率标准》中,正式将大模型应用“豆包”写进技术服务费规则,该规范于2026年7月15日正…
CAVIA – 苹果、得克萨斯、谷歌联合推出的多视角视频生成框架
CAVIA是什么 CAVIA是苹果公司、得克萨斯大学奥斯汀分校、谷歌联合推出的多视角视频生成框架,能将单一输入图像转换成多个时空一致的视频序列。框架基于引入视角集成注意力…
Flex3D – Meta GenAI和牛津大学共同推出的两阶段3D生成框架
Flex3D是什么 Flex3D是Meta的GenAI团队和牛津大学研究团队推出的创新的两阶段3D生成框架,能基于任意数量的高质量输入视图,解决从文本、单张图片或稀疏视图…
