Grok 推出 Automations 功能:定时跑、邮件一到就触发,还能替你回信
把一件重复的活儿交代一次,然后就再也不用管了——这大概是每个人都幻想过的偷懒方式。xAI刚刚让它成了现实。Grok正式推出Automations(自动化任务)功能:你只需…
谷歌测试Gemini语音自定义功能,新增速度、活力等四项调节选项
谷歌正在为 Gemini 开发全新的语音自定义功能,允许用户通过多个参数调整AI助手的声音表现。据 Google 应用测试版代码分析显示,谷歌计划推出包含“速度、活力、正…
Show-o – 新加坡国立Show Lab联合字节推出的多模态理解与生成的统一模型
Show-o是什么 Show-o是集成了多模态理解和生成的统一Transformer模型。通过结合自回归和离散扩散建模,能灵活处理包括视觉问答、文本到图像生成、文本引导的…
1Password携手Claude推出集成功能 AI能替你登网站了,但密码始终藏在它看不见的地方
密码管理这件事,最怕的就是为了方便把钥匙交给别人。1Password本周四宣布正式接入人工智能助手Claude,给出一个看似矛盾却巧思十足的解法:让AI替你填密码、跑任务…
Suno源代码遭泄露:黑客曝光其大规模抓取音乐数据训练AI模型
生成式AI音乐平台 Suno 遭遇重大安全事件,内部源代码及数据采集信息被泄露,曝光了其用于训练AI音乐模型的大规模数据抓取行为。泄露文件显示,Suno曾通过自动化程序从…
2. 8 万亿参数、 100 万词元上下文,Kimi K3 把开源大模型的天花板顶到了全球最高
世界人工智能大会还没开锣,国产大模型就先放出一颗重磅炸弹。2026世界人工智能大会暨人工智能全球治理高级别会议即将举行之际,月之暗面于16日正式发布新一代模型Kimi K…
医疗AI新突破:云知声发布“U2-Med三医大模型”深耕智慧医疗
云知声近日宣布,在U2 基座模型的基础上完成迭代升级,正式推出行业内首个聚焦医疗、医保及医药领域的专业大模型——“U2-Med三医大模型”。这一创新成果标志着云知声在智慧…
AI旅行平台 Fora 完成6000万美元D轮融资,估值升至10亿美元
人工智能驱动的旅游平台 Fora 宣布完成6000万美元D轮融资,公司估值达到10亿美元,正式跻身独角兽企业行列。本轮融资由 Forerunner 和 Tactile V…
多家银行上线AI主题银行卡,刷卡可获大模型Token和AI权益
多家银行近期推出AI主题信用卡和借记卡产品,将大模型Token、AI会员服务等智能化权益引入传统银行卡体系,试图借助人工智能生态吸引年轻用户和科技从业者。7月15日,中国…
NotebookLM改姓Gemini了:一次更名背后,谷歌给笔记本塞进了会写会跑代码的云电脑
用惯了NotebookLM的人,可能得重新认识这位老朋友了。当地时间16日,谷歌宣布把旗下AI笔记助理NotebookLM正式更名为Gemini Notebook,让它彻…
Google Vids引入Gemini Omni模型 上传自拍+音频就能定制专属数字分身
哪怕OpenAI的Sora可能已经退场,谷歌依旧认定,用户想在AI视频里亲自出镜的那股执念并没有降温。本周四,这家科技巨头给Google Vids甩出一套重磅更新:你只需…
DoorDash推出AI命令行工具dd-cli,可通过智能助手直接点餐
DoorDash推出AI命令行工具 DoorDash CLI(dd-cli)限量测试版,允许开发者通过AI智能助手直接完成外卖订购,包括搜索商家、查找优惠和完成结账等操作…
MimicTalk – 字节联合浙大推出的开源3D数字人头项目
MimicTalk是什么 MimicTalk是浙江大学和字节跳动共同研发推出基于NeRF(神经辐射场)技术,能在极短的时间内,仅需15分钟训练出个性化和富有表现力的3D说…
Wonder Animation – 视频序列转换成3D动画场景的AI解决方案
Wonder Animation是什么 Wonder Animation 是 Autodesk 旗下 Wonder Dynamics 推出的创新 AI 技术,Wonder…
TimeSuite – 上海AI Lab推出的提升MLLMs在长视频理解处理的设计框架
TimeSuite是什么 TimeSuite是上海AI Lab推出的新型框架,能提升多模态大型语言模型(MLLMs)在长视频理解任务中的表现。基于引入高效的长视频处理框架…
EMMA – Waymo推出的端到端自动驾驶多模态模型
EMMA是什么 EMMA是Waymo基于Gemini模型推出的端到端自动驾驶多模态模型,能将原始相机传感器数据直接映射到驾驶特定输出,如规划轨迹、感知对象和道路图元素。E…
