Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: Ruyi – 图森未来推出的图生视频大模型
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > Ruyi – 图森未来推出的图生视频大模型
AIGC 资讯

Ruyi – 图森未来推出的图生视频大模型

站外新闻
最近更新: 2026年7月9日 下午11:48
SHARE

Ruyi是什么

Ruyi是图森未来推出的图生视频大模型,专为在消费级显卡上运行设计,支持多分辨率、多时长视频生成,具备首帧、首尾帧控制、运动幅度控制和镜头控制等特性。Ruyi基于DiT架构,由Casual VAE模块和Diffusion Transformer组成,用在视频数据压缩和生成。Ruyi能降低动漫和游戏内容的开发周期和成本,是ACG爱好者和创作者的理想工具。目前图森未来将Ruyi-Mini-7B版本正式开源。

阅读目录
  • Ruyi是什么
  • Ruyi的主要功能
  • Ruyi的技术原理
  • Ruyi的项目地址
  • Ruyi的应用场景

Ruyi

Ruyi的主要功能

  • 多分辨率、多时长生成:Ruyi支持从最小384×384到最大1024×1024分辨率的视频生成,能处理任意长宽比,最长生成120帧/5秒的视频。
  • 首帧、首尾帧控制生成:基于最多5个起始帧和最多5个结束帧生成视频,用循环叠加生成任意长度的视频。
  • 运动幅度控制:提供4档运动幅度控制,方便用户对整体画面的变化程度进行控制。
  • 镜头控制:提供了上、下、左、右、静止共5种镜头控制,增加视频生成的灵活性。

Ruyi的技术原理

  • 模型架构:Ruyi基于DiT(Diffusion Model with Transformers)架构,由两部分组成:
    • Casual VAE模块:负责视频数据的压缩和解压。
    • Diffusion Transformer:负责压缩后的视频生成。
  • 压缩与编码:Casual VAE模块将空间分辨率压缩至1/8,时间分辨率压缩至1/4,压缩后每个像素由16位的BF16进行表示。
  • 位置编码:DiT部分用3D full attention,在空间上使用2D RoPE(Rotary Positional Encoding)进行位置编码,时间上用sin_cos进行位置编码。
  • 训练损失函数:最终的loss选用DDPM(Denoising Diffusion Probabilistic Models)进行训练。
  • 参数量与训练数据:模型的总参数量约为7.1B,用约200M视频片段进行训练。
  • 训练阶段:整个训练分为四个阶段,从低分辨率预训练到高分辨率微调,逐步提升模型性能。

Ruyi的项目地址

  • GitHub仓库:https://github.com/IamCreateAI/Ruyi-Models
  • HuggingFace模型库:https://huggingface.co/IamCreateAI/Ruyi-Mini-7B

Ruyi的应用场景

  • 动画预制:快速生成动画角色和场景的动态演示,评估动画设计和故事流程。
  • 游戏CG生成:在游戏开发中,自动生成游戏宣传视频或游戏内的动态背景。
  • 电影特效预览:在电影制作中,帮助导演和特效团队预览特效场景,优化后期特效制作。
  • 虚拟主播:生成虚拟主播的动态视频,用于直播、新闻播报或在线教育。
  • 社交媒体内容:为社交媒体平台创建吸引人的动态视频内容,提高用户参与度和品牌曝光。
SkyReels-A1 – 昆仑万维开源的表情动作可控算法
Stagehand – AI网页浏览框架,提供简单和可扩展的网页自动化解决方案
Mistral OCR 4 – Mistral AI 推出的最新一代文档理解模型
SlideChat – 上海AI Lab联合多所高校和机构推出的视觉语言助手
上海AI Lab开源Intern-S2-Preview:35B参数科学大模型,比肩万亿参数,首次实现晶体结构生成
分享
Email 复制链接 打印
Share
上一篇 Grok-2 – xAI公司推出的新一代AI模型
下一篇 InstantID – 高保真的个性化图像合成框架
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

1100 多名 AI 员工联名呼吁美国政府踩刹车,奥尔特曼罕见表态支持
AIGC 资讯
Fresh Burst Sprite Ad Poster
AI 生图 Prompt
Taco Supreme Extreme Poster
AI 生图 Prompt
Toy Figure Character Transformation
AI 生图 Prompt

相关推荐

AI 工具AIGC 资讯

字节跳动Lance开源:3B参数统一模型,一模型搞定图像视频理解生成编辑全链路

站外新闻
AIGC Lance 图像生成 多模态大模型 字节跳动 视频编辑
AIGC 资讯

RAGEN – 训练大模型推理 Agent 的开源强化学习框架

站外新闻
AIGC 资讯

告别会后总结!Halliday G2发布:主打实时 AI 辅助与无摄像头设计

站外新闻
AIGC 资讯

日日新融合大模型 – 商汤科技推出的原生融合模态大模型

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent GPT Image 2 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 写实人像 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成 chatgpt
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.