深圳理工大学要逐步取消大学英语:AI能翻译,但教不会你”不卑不亢”
近日,深圳理工大学教务长、澳门大学前校长赵伟公开发布教改信息: 2026 年入学的学生将进入全新实验班,学校计划逐步取消原有的大学英语公共必修课,替换为全新的跨文化交流特…
mPLUG-DocOwl 1.5 – 阿里开源的多模态大型语言模型
mPLUG-DocOwl 1.5是什么 mPLUG-DocOwl 1.5是由阿里巴巴集团推出的多模态大型语言模型,专注于OCR-free(无需光学字符识别)的文档理解。模…
motion-anything – Open Design 开源的本地优先动效引擎
motion-anything是什么 motion-anything 是 Open Design 团队开源的本地优先动效引擎,定位为免费版 Figma Motion + …
LingBot-Vision – 蚂蚁灵波科技开源的通用视觉基座模型
LingBot-Vision是什么 LingBot-Vision 是蚂蚁灵波科技开源的通用视觉基座模型,业内首创以边界结构为预训练目标,采用几何建模方式实现空间感知训练范…
Muse Image – Meta 超级智能实验室推出的AI图像生成模型
Muse Image是什么 Muse Image 是 Meta 超级智能实验室推出的首个自研 AI 图像生成模型,采用 Agent 架构,与 Muse Spark 协作进…
FinRobot – 开源 AI Agent 平台,解决金融领域应用的综合解决方案
FinRobot是什么 FinRobot是开源的AI代理平台,专注于金融领域的应用。基于大型语言模型(LLMs)来构建能进行复杂分析和决策的金融专业AI代理。平台通过金融…
英伟达Vera CPU来了:专为AI代理从零设计,速度快1. 5 倍,OpenAI和Anthropic都要用
AI搜索初创公司Perplexity宣布计划采用英伟达全新推出的CPU芯片Vera。这款芯片并非英伟达传统GPU产品线的延伸,而是为迎接AI代理时代从零开始设计的全新架构…
美国放行GPT-5.6,OpenAI多款重磅模型本周上线
美国商务部近日正式解除对OpenAI先进AI模型GPT-5. 6 的发布限制,批准其进行大规模公开推广。这一决策标志着此前针对该模型实施的临时管控措施正式宣告结束。Ope…
具身智能新突破:蚂蚁集团开源LingBot-Vision,让机器人拥有“空间感”
在具身智能领域,如何让机器人像人类一样精准感知物理空间,一直是一个核心难题。近日,蚂蚁集团旗下的具身智能公司Robbyant正式开源了LingBot-Vision模型家族…
DeepSeek V3 – DeepSeek开源的最新版 AI 模型,编程能力超越Claude
DeepSeek V3是什么 DeepSeek V3是知名私募巨头幻方量化旗下人工智能公司深度求索(DeepSeek)开源的最新版AI模型,在多语言编程能力上的进步显著。…
3DHM – 3D人体动作生成框架,单张图片生成任意视频动作
3DHM是什么 3DHM(3D Human Motions)是先进的3D人体动作生成技术,加州大学伯克利分校的研究人员推出。能从单张人物照片生成具有3D控制的动态人体视频…
Diff-Instruct – 从预训练扩散模型中迁移知识的通用框架
Diff-Instruct是什么 Diff-Instruct是先进的知识转移方法,用于从预训练的扩散模型中提取知识,指导其他生成模型的训练。它基于一种新的散度度量——积分…
VidTok – 微软开源的视频分词器,支持连续和离散分词化
VidTok是什么 VidTok(Video Tokenizer)是微软开源的先进的视频分词器,通过高效的算法将视频内容转换成一系列“视频词”。支持连续和离散分词化,具有…
美国政府松绑GPT-5.6:商务部正式放行,OpenAI本周全面推出
据Axios报道,美国商务部已正式批准OpenAI大规模发布其先进AI模型GPT-5.6,预计本周内完成最后准备工作后正式向公众推出。此前出于国家安全考量,美国政府曾要求…
Infinity – 字节跳动推出的高分辨率图像生成模型
Infinity是什么 Infinity是字节跳动推出的基于位级自回归建模的视觉生成模型,能根据语言指令生成高分辨率、逼真的图像。Infinity通过无限词汇量的标记器、…
强强联手:SpaceXAI 与 Cursor 联手打造 AI 模型,性能或直追 GPT-5.5
在人工智能领域竞争愈发激烈的背景下,科技界迎来了一次重磅合作。据悉,SpaceXAI 正与代码编辑器 Cursor 展开深度技术联手,共同开发一款全新的 AI 模型。有消…
