MiniMax计划推出新一代大模型 参数规模2.7万亿
日有消息称,稀宇科技(MiniMax)正在紧锣密鼓地筹备其新一代大模型的发布工作。据了解,该模型的参数规模将达到2. 7 万亿,这一量级标志着其在复杂任务处理及逻辑推理能…
Genesis – CMU 联合 20 多所研究机构开源的生成式物理引擎
Genesis是什么 Genesis是卡内基梅隆大学、马里兰大学、斯坦福大学、麻省理工学院等研究机构联合推出的开源生成式物理引擎,能模拟世界万物。Genesis能用简单的…
Moffee – 开源的Markdown转PPT工具
Moffee是什么 Moffee是开源的Markdown转PPT工具,支持用户使用Markdown语法快速创建专业的幻灯片。Moffee自动处理布局、分页和样式,支持实时…
GroundingBooth – Adobe联合多所高校推出主题和文本到图像的定制框架
GroundingBooth是什么 GroundingBooth 是一个先进的文本到图像定制框架,由华盛顿大学圣路易斯分校、Adobe和普渡大学的研究团队共同推出。基于文…
Claude Dev – AI编程助手,基于Claude 3.5 Sonnet模型
Claude Dev是什么 Claude Dev是一个集成在Visual Studio Code中的AI编程助手,基于Anthropic公司的Claude 3.5 Son…
AniPortrait – 腾讯开源的照片对口型视频生成框架
AniPortrait是什么 AniPortrait是腾讯开源的照片对口型AI视频生成框架,类似于此前阿里推出的EMO,能够通过音频和一张参考肖像图片生成高质量的动画。A…
AgentGen – 微软联合港大推出的提高AI大模型规划能力的框架
AgentGen是什么 AgentGen是香港大学与微软联合推出的AI项目框架,通过自动生成多样化环境和任务,显著提升了大语言模型(LLM)的规划能力。AgentGen利…
screenpipe – 搭建个性化AI助手的软件,捕捉屏幕和音频录音
screenpipe是什么 screenpipe是一款基于AI技术,全天候监控用户电脑屏幕和麦克风的开源软件。通过捕捉屏幕活动和音频,用AI进行智能分析,提升工作效率和保…
CodeFormer – AI照片修复工具,轻松去除图片和视频马赛克
CodeFormer是什么 CodeFormer是一款由南洋理工大学和商汤科技联合开发的AI照片和视频修复工具。融合了变分自动编码器(VQGAN)和Transformer…
Moshi – 法国AI实验室Kyutai开发的实时音频多模态模型
Moshi是什么 Moshi是由法国的的人工智能研究实验室Kyutai推出的一款端到端实时音频多模态AI模型,拥有听、说、看的能力,并能模拟70种不同的情绪和风格进行交流…
GOT-OCR2.0 – 开源的端到端OCR模型,多语言多模态识别,多样化输入输出
GOT-OCR2.0是什么 GOT-OCR 2.0是一种先进的光学字符识别(OCR)模型,推动OCR技术进入2.0时代。GOT-OCR 2.0端到端的模型由高压缩编码器和…
AniDoc – 2D动画上色AI模型,基于视频扩散模型自动将草图序列转换成彩色动画
AniDoc是什么 AniDoc是香港科技大学、蚂蚁集团、南京大学、浙江大学和香港大学共同推出的简化2D动画上色AI模型,基于视频扩散模型自动将草图序列转换成彩色动画,遵…
OpenAI语音助手大升级:GPT-Live全双工模型上线,ChatGPT终于能”边听边说”了
OpenAI正式发布基于GPT-Live架构的全新ChatGPT语音体验,标志着其语音技术迎来一次重大架构跃迁。相比 2024 年推出的Advanced Voice Mo…
浦语灵笔 – 开源的多模态大模型,性能媲美GPT-4V
浦语灵笔IXC-2.5是什么 浦语灵笔IXC-2.5是上海人工智能实验室推出的新一代多模态大模型,具备7B规模的大型语言模型后端。能处理长达96K的长上下文,支持超高分辨…
智谱完成约314亿港元配售 资金将用于大模型技术研发与算力建设
AI大模型独角兽企业智谱宣布完成约314.1亿港元配售。本次募集的资金将主要用于基座模型研发、算力基础设施建设、商业化拓展以及全球生态布局,为智谱下一阶段的模型研发与前沿…
markmap – 解析Markdown生成可视化思维导图的工具
markmap是什么 markmap 是一个将 Markdown 文本转换为思维导图的工具。基于 Markdown 的语法结构,实时生成可视化的思维导图,帮助用户直观的组…
