Kairos-HomeWorld – 大晓机器人推出的全屋三维可交互世界模型
Kairos-HomeWorld是什么 Kairos-HomeWorld 是大晓机器人联合香港中文大学与深圳河套学院推出的全球首个全屋三维可交互世界模型。模型通过四阶段分…
AgentSociety – 清华大学推出的社会模拟器
AgentSociety是什么 AgentSociety 是清华大学推出的基于大语言模型(LLM)的社会模拟器,通过构建具有“类人心智”的智能体来模拟复杂的社会行为和现象…
ABot-Earth0.5 – 高德推出的全球首个3D原生城市世界模型
ABot-Earth0.5 是什么 ABot-Earth0.5是阿里巴巴集团旗下高德推出的全球首个3D原生城市世界模型,定位为自动化3D城市工厂。用户输入单张卫星图像或文…
DoraCycle – 新加坡国立大学推出多模态领域适应的统一生成模型
DoraCycle是什么 DoraCycle 是新加坡国立大学 Show Lab 推出多模态领域适应的统一生成模型,通过两个多模态循环(text-to-image-to-…
HumanDiT – 浙大联合字节推出的姿态引导人体视频生成框架
HumanDiT是什么 HumanDiT 是浙江大学和字节跳动联合提出的姿态引导的高保真人体视频生成框架。基于扩散变换器(Diffusion Transformer,Di…
ReasonIR-8B – Meta AI 推出专为推理密集型检索任务设计的模型
ReasonIR-8B是什么 ReasonIR-8B 是 Meta AI 推出的专为推理密集型检索任务设计的模型。基于 LLaMA3.1-8B 训练,采用双编码器架构,将…
ReasonGraph – 开源可视化与分析LLMs推理过程的AI工具
ReasonGraph是什么 ReasonGraph 是用在可视化和分析大语言模型(LLMs)推理过程的开源网络平台。ReasonGraph支持超过 50 种主流模型(如…
Satori – 开源的大语言推理模型,具备自回归搜索和自我纠错能力
Satori是什么 Satori是 MIT、哈佛大学等机构研究者推出的 7B 参数的大型语言模型,专注于提升推理能力。基于Qwen-2.5-Math-7B,Satori通…
Miracle F1 – 美图 WHEE 推出的 AI 图像生成模型
Miracle F1是什么 Miracle F1 是美图 WHEE 推出的全新AI图像生成模型。具备强大的图像生成能力,能像摄影师、建筑师和画家一样精准地处理光影、空间和…
SuperGPQA – 豆包大模型联合 M-A-P 开源的知识推理基准测试集
SuperGPQA是什么 SuperGPQA 是字节跳动豆包大模型团队联合 M-A-P 推出的全面覆盖 285 个研究生级学科、包含 26529 道专业题目的知识推理基准…
BitsAI-CR – 字节跳动推出的自动化代码审查工具
BitsAI-CR是什么 BitsAI-CR是字节跳动团队推出的基于大型语言模型(LLM)的自动化代码审查工具,通过两阶段处理流程实现高效代码审查:RuleChecker…
Textoon – 阿里通义实验室推出的文本提示生成2D卡通人物工具
Textoon是什么 Textoon是阿里巴巴集团通义实验室推出的创新项目,首个能根据文本提示生成Live2D格式2D卡通角色的方法。基于先进的语言和视觉模型,能在一分钟…
MV-MATH – 中科院推出的基准数据集,评估模型处理多视觉信息的数学推理能力
MV-MATH是什么 MV-MATH 是中科院自动化所提出的新基准数据集,评估多模态大语言模型(MLLMs)在多视觉场景中的数学推理能力。数据集包含2009个高质量的数学…
Chirp 3 – 谷歌云推出的高清语音合成模型
Chirp 3是什么 Chirp 3 是谷歌云推出的高清语音合成模型,专为生成自然、生动的语音而设计。支持 248 种声音和 31 种语言,能捕捉人类语调的细微差别,语音…
MangaNinja – 基于参考图像的线稿着色技术
MangaNinja是什么 MangaNinja是基于参考图像的线稿上色方法,具备精准匹配和细致控制的能力。通过创新的补丁重排模块和点驱动控制方案,提升了上色的准确性与图…
Hummingbird-0 – Tavus 推出的AI口型同步模型
Hummingbird-0是什么 Hummingbird-0 是 Tavus 推出的AI口型同步模型。基于 Phoenix-3 模型开发,支持实现零样本学习,无需额外训练…
