Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: video-use – Browser Use 团队开源的 AI 视频剪辑 Agent
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > video-use – Browser Use 团队开源的 AI 视频剪辑 Agent
AIGC 资讯

video-use – Browser Use 团队开源的 AI 视频剪辑 Agent

站外新闻
最近更新: 2026年7月7日 下午1:44
SHARE

video-use是什么

Video-use 是 Browser Use 团队开源的 AI 视频剪辑 Agent,通过自然语言对话替代传统时间线操作。用户只需将原始素材放入文件夹并描述需求,Agent 自动完成素材盘点、口癖清除、调色、字幕、动画叠加及自评估,最终输出成片。Video-use 核心创新在于让 LLM 通过音频转录文本(约 12KB),大幅降低 token 成本,专为口播、教程、访谈等结构化内容的高效自动化剪辑设计。

阅读目录
  • video-use是什么
  • video-use的主要功能
  • 如何使用video-use
  • video-use的核心优势
  • video-use的项目地址
  • video-use的同类竞品对比
  • video-use的应用场景

video-use

video-use的主要功能

  • 口癖与死寂清除:自动识别并删除”嗯””啊”等填充词、长停顿及表现不佳的重复拍摄 take。
  • 自动调色:内置 warm_cinematic(暖色电影感)、neutral_punch(中性增强)等预设,支持自定义 ffmpeg 滤镜链。
  • 30ms 音频淡变:每个切点自动添加 30 毫秒淡入淡出,彻底消除切点爆音。
  • 烧录字幕:默认”两词大写”短视频风格,支持长句自然、大字幕强调等自定义字体、颜色、位置。
  • 动画叠加:调用 HyperFrames、Remotion、Manim、PIL+ffmpeg 等引擎生成 B-roll 和动画卡片,由独立子 Agent 并行生成。
  • 自评估循环:渲染后自动检查切点跳帧、音频爆音、字幕遮挡、叠加层对齐等问题,最多修复 3 次。
  • 会话记忆:每次剪辑决策追加到 project.md,下次接续工作时保留之前的偏好和策略。

挖挖GitHub

微信关注回复“开源”,加入AI开源项目交流群

如何使用video-use

  • 克隆仓库:在终端执行 git clone https://github.com/browser-use/video-use ~/Developer/video-use 将项目代码下载到本地开发者目录。
  • 安装依赖:进入项目目录后运行 uv sync 或 pip install -e . 安装 Python 依赖,同时通过 brew install ffmpeg 安装必需的音视频处理工具。
  • 配置 API Key:复制环境变量模板文件 cp .env.example .env,然后编辑 .env 文件填入 ElevenLabs API Key 用于音频转录服务。
  • 注册 Skill:创建符号链接将 video-use 注册到 Agent 的 skills 目录,例如 Claude Code 用户执行 ln -sfn ~/Developer/video-use ~/.claude/skills/video-use。
  • 开始使用:进入存放原始视频素材的文件夹,启动你的编程 Agent,对它说 “edit these into a launch video” 可触发自动剪辑流程。

video-use的核心优势

  • 对话式交互替代手动剪辑:通过自然语言描述需求即可驱动 Agent 完成全流程,无需掌握专业剪辑软件操作。
  • 通用兼容不受 API 限制:不依赖官方开放接口,任何有网页版的视频工具都能被 AI 驱动操控。
  • 极低 token 成本理解视频:通过音频转录文本(约 12KB)替代逐帧视觉分析,让 LLM 高效”阅读”而非”观看”视频。
  • 自动化机械劳动:口癖清除、调色、字幕、动画叠加等重复性工作由 Agent 自动执行,人类仅需确认策略。
  • 标准化输出可复现:剪辑规则固化在代码中,保证同类型内容输出风格一致,避免人工操作差异。
  • 自评估质量保障:渲染后自动检查跳帧、爆音、遮挡等问题并修复,确保成片质量达标后才呈现给用户。

video-use的项目地址

  • GitHub仓库:https://github.com/browser-use/video-use

video-use的同类竞品对比

维度 video-use OpenStoryline (FireRedTeam)
开发团队 Browser Use(海外) 小红书 Super Intelligence 团队 / FireRedTeam(国内)
开源协议 MIT Apache-2.0
Stars 13,749 2,817
核心定位 编程 Agent 对话式剪辑 raw footage 意图驱动式视频创作,从素材搜索到成片
交互方式 命令行对话(Claude Code / Codex) 自然语言对话 + Web 界面 + CLI
内容来源 本地 raw footage(口播、访谈素材) 支持本地素材 + 在线媒体搜索下载
智能脚本 基于音频转录文本理解内容 自动生成故事线、旁白、 Few-shot 风格迁移
动画/特效 HyperFrames / Remotion / Manim / PIL 内置 BGM 智能推荐、AI 转场生成、字体风格匹配

video-use的应用场景

  • 技术博主口播剪辑:快速将多次录制的 raw footage 剪成连贯的发布视频,自动清除口癖和停顿。
  • 教程制作团队:批量处理大量重复性剪辑任务,标准化字幕、调色和动画叠加流程。
  • 产品发布视频:将多段素材按策略自动拼接,统一视觉风格并生成配套 B-roll 动画。
  • 访谈/播客后期:自动识别最佳 take、清除冗余内容,输出带字幕和淡变处理的成片。
  • 内容创作者标准化工作流:将剪辑流程从手动操作转为策略确认,释放时间聚焦内容创作本身。
Claude Fable5使用权限大调整:部分用户失去访问权,Anthropic加速扩容
北京抛出”智能体新政”十策:从驾驭层工程到一人公司,一张 Agent 经济蓝图铺开了
Amodal3R – 南洋理工联合牛津等推出的条件式 3D 生成模型
LingBot-Vision – 蚂蚁灵波科技开源的通用视觉基座模型
RedKnot – 小红书开源的长文本推理加速引擎
分享
Email 复制链接 打印
Share
上一篇 史上首次!苹果手表上线 Siri AI, 11 年语音助手迎来彻底进化
下一篇 性能碾压对手!谷歌 Gemini 3.5 Pro 曝光:史诗级升级定档 7 月 17 日
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

Vibe-Trading – HKUDS 开源的 AI 多智能体金融工作空间
AIGC 资讯
全息流体渐变通用占位特色图
​谷歌AI搜索一年翻倍:43%搜索结果现AI概览,传统网页正被”直接给答案”取代
AIGC 资讯
SenseNova 6.7 Flash-Lite – 商汤推出的多模态智能体模型
AIGC 资讯
火山引擎上线豆包搜索服务,为AI Agent提供可信联网检索能力
AIGC 资讯

相关推荐

AIGC 资讯

AnimateDiff-Lightning – 字节推出的快速生成高质量视频的模型

站外新闻
AIGC 资讯

Heygem – 硅基智能推出的开源数字人模型

站外新闻
AI 工具AIGC 资讯

浙大华为联手发布DeepSeek-R1-Safe:基于昇腾的安全大模型,开源权重防御越狱攻击

站外新闻
AIGC安全 DeepSeek-R1-Safe 华为昇腾 安全大模型 越狱攻击防御
AIGC 资讯

MaskGCT – 趣丸科技联合香港中文大学推出的语音合成大模型

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent GPT Image 2 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成 chatgpt 大模型
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.