技能

video-use

browser-use/video-use

让编码智能体通过对话剪辑原始素材的技能:依据逐词转录剪辑,调色,叠加动画并烧录字幕,渲染后自行检查。

在 GitHub 查看
01作者
Browser Use
03星标
27,870 · 截至 2026年10月3日
04最近更新
2026年10月2日
05许可证
MIT
06适用智能体
Claude Code · Codex · OpenClaw · 任意智能体
07目标模型
ElevenLabs Scribe · FFmpeg · HyperFrames · Remotion · Manim
08内容语言
英文
09领域
电影创作 · AI视频
10阶段
剪辑 · 音频
SC 01概览

它能做什么

把存放原始素材的文件夹交给智能体,技能会用 ElevenLabs Scribe 对每段素材做逐词转录,再压缩成按短语分行的文本,模型主要读这份文本,只在难以判断的剪点才调出胶片条加波形的图片。你确认一份白话版剪辑策略后,它写出剪辑决策表,逐段渲染并按需调色、加短促的音频淡入淡出,再拼接,最后叠加覆盖动画并烧录字幕;动画由并行的子智能体用 HyperFrames、Remotion、Manim 或 PIL 制作。给你预览之前,它会检查每个剪点和音频电平,并把本次会话记录在 project.md 里;技能还附有配乐和音效的混音要点,如在人声下压低音乐、做响度标准化。剪辑依据是语音和停顿,所以更适合口播、教程、访谈和混剪,不太适合有剧本的场景;需要 ffmpeg、Python 依赖和 ElevenLabs API key。

SC 02安装

如何安装

  • 01来自 README

    逐字引用仓库 README 里的安装命令。

    git clone https://github.com/browser-use/video-use ~/Developer/video-use ln -sfn ~/Developer/video-use ~/.claude/skills/video-use
  • 02skills CLI(Claude Code、Codex 等通用)

    Vercel Labs 的开源 skills CLI 会把 GitHub 仓库里的技能装到各个智能体约定的文件夹里。它会让你选择要装哪些技能、装给哪些智能体;默认只装给当前项目,加上 -g 参数则装给你的用户账号。安装前加 --list,可以先看仓库里有什么。

    npx skills add browser-use/video-use
  • 03Claude Code:skills 文件夹

    把技能的文件夹(里面有 SKILL.md 的那一层)复制到 ~/.claude/skills/,所有项目都能用;或复制到仓库里的 .claude/skills/,只在该仓库使用,提交后还能和团队共享。Claude Code 会在会话中读取这些文件夹的变化;如果会话开始时这个文件夹还不存在,运行 /reload-skills。

  • 04Claude Code:插件市场

    有些仓库发布了插件市场,也就是一份 .claude-plugin/marketplace.json。先在 Claude Code 里添加它,再用 /plugin install plugin-name@marketplace-name 安装其中的插件。插件除了技能,还可能带上 hooks 和 MCP 服务器,确认前请先看详情面板。

    /plugin marketplace add browser-use/video-use
  • 05Codex:skills 文件夹或 $skill-installer

    Codex 会从你启动它的目录起,一路到仓库根目录,读取沿途的 .agents/skills;也会读取 $HOME/.agents/skills,对所有仓库生效。把技能文件夹复制到其中一处,或在 Codex 里运行 $skill-installer,让它从仓库安装。Codex 会自动发现新技能,只有没出现时才需要重启。

第一条命令引自作者的 README,其余是从 GitHub 仓库安装技能的通用办法。它们只是模板,不一定适用于这个仓库,比如仓库没有插件市场时,请以 README 为准。

SC 03使用指南

怎么用得更好

适合

  • 剪口播、教程、访谈或旅行素材:按词边界剪掉口头禅、说错重来和空白。
  • 同一段内容拍了多条时,按每个段落挑出最合适的一条,拼成一版成片。
  • 需要烧录字幕、再叠几张动画卡片或图解的短视频宣传片。
  • 用白话反复修改剪辑:你提意见,它重新渲染,不用再转录一遍。

注意

  • 转录依赖 ElevenLabs Scribe,需要 ElevenLabs API key,用量请对照其定价;另需 ffmpeg 和 Python 依赖,用 HyperFrames 或 Remotion 做动画还要 Node.js。
  • 它剪辑的是已有素材并制作叠加图形,本身不根据提示词生成视频;剪辑依据是语音和停顿,没有编剧或镜头衔接方面的流程,所以比起口播、教程和混剪,不太适合有剧本的场景。
  • 智能体听不到声音,只能靠响度测量、波形图和抽帧检查,发布前仍要自己看一遍预览、听一遍声音。

典型流程

01步骤
安装:克隆仓库,把它链接到智能体的 skills 目录,运行 uv sync,安装 ffmpeg,并把 ElevenLabs key 写进 .env。
02步骤
在放原始素材的文件夹里启动智能体,说明目标,例如“把这些剪成一条发布视频”。
03步骤
智能体转录所有素材并读取合并后的转录文本,再就时长、画幅、节奏、调色、字幕和动画向你提问。
04步骤
确认它提出的白话版策略:用哪些镜头、怎么剪、叠什么动画、调色方向和预计时长。
05步骤
它写出剪辑决策表,渲染 720p 预览,并检查每个剪点和音频电平,发现问题最多自检修复三轮。
06步骤
用白话提修改意见,它不重新转录就重新渲染;你确认后生成 edit/final.mp4,并把本次记录写入 project.md。
SC 04适用环节

在影片制作链路里的位置

这个技能覆盖的制作阶段,以及 Pencil0 从哪里接手。

SC 05相关技能

相关技能

  • 技能包

    OpenMontage

    calesthio/OpenMontage

    开源仓库,让编码智能体按分阶段流水线完成视频制作,并附带大批技能文件,讲解视频模型接口、音乐、语音、剪辑与合成的用法。

    • 全流程
    • 生成
    • 剪辑
    62.4kGitHub 星标更新于 2026年9月
  • 官方技能包

    HyperFrames Skills

    heygen-com/hyperframes

    HeyGen 为开源 HTML 转视频框架 HyperFrames 提供的 21 个技能:智能体用代码策划、编写并渲染讲解视频、发布片、字幕和音乐卡点视频,输出可复现的 MP4。

    • 剪辑
    • 全流程
    • 音频
    55.8kGitHub 星标更新于 2026年10月
  • 官方技能包

    AiToEarn 视频智能体技能

    yikart/AiToEarn

    AiToEarn 内容智能体使用的一组视频向 SKILL.md,以短剧解说技能为首,另有视频生成、剪辑、分析、翻译等;它们依赖该平台自带的工具调用。

    • 剪辑
    • 音频
    • 生成
    26.2kGitHub 星标更新于 2026年9月
  • 官方技能包

    Remotion Agent Skills

    remotion-dev/skills

    Remotion 官方维护的一组智能体技能,让编码智能体用 React 代码制作视频,覆盖建项目、写画面标记、字幕、实时预览和渲染输出。

    • 剪辑
    4.8kGitHub 星标更新于 2026年10月
  • 剪映 JianYing Editor Skill

    luoluoluo22/jianying-editor-skill

    让编码智能体用脚本操作桌面版剪映专业版(国内版):导入素材、加字幕、TTS 配音、配乐、特效与关键帧,生成可继续手动编辑的草稿。

    • 剪辑
    • 音频
    3.7kGitHub 星标更新于 2026年9月
  • 官方技能包

    FireRed-OpenStoryline

    FireRedTeam/FireRed-OpenStoryline

    对话式视频剪辑智能体,剪辑流程以技能形式提供,另附两个能在 Claude Code 或 OpenClaw 里安装并驱动它的技能。

    • 剪辑
    • 音频
    3.5kGitHub 星标更新于 2026年7月

这是第三方技能,不由 Pencil0 维护或审计。技能可能在你的机器上运行脚本,安装前请阅读 SKILL.md 和相关脚本。星标、许可证和日期来自 GitHub 快照,可能已过时。