FunClip v2.1.0:本地 AI 视频剪辑的首个版本化发布
FunClip v2.1.0 是项目首个带版本号的 GitHub Release。它把当前本地视频剪辑应用固定为一个可下载、可校验、可回退的版本:先用 FunASR 系列模型识别视频,再按字幕、说话人或大模型选出的片段完成剪辑。
你可以直接使用公开 Space,也可以下载源码在自己的机器上运行;视频、音频和模型权重不需要打包进发布归档。
选择适合剪辑任务的识别路径
| 路径 | 适合场景 | 启动方式 |
|---|---|---|
| Paraformer | 需要精确时间戳、按文本或说话人剪辑,以及中文热词 | python funclip/launch.py |
| Fun-ASR-Nano | 普通话、英语、日语、中文方言与口音的高精度转写;精确按字剪辑仍建议用 Paraformer | python funclip/launch.py -m fun-asr-nano |
| SenseVoice | 多语种识别,同时保留情感和音频事件标签 | python funclip/launch.py -m sensevoice |
| 英文 Paraformer | 需要英文识别与时间戳剪辑 | python funclip/launch.py -l en |
1. 先在线体验
FunClip Hugging Face Space 运行同一套公开应用,适合先验证视频上传、ASR、字幕选择和智能剪辑流程。需要处理私有视频或固定依赖时,再部署本地版本。
2. 下载并校验 v2.1.0
Linux 和 macOS 可以下载 tar.gz;Windows 或通用解压场景可以下载 zip。下面的校验命令只检查当前目录中已经下载的归档:
curl -LO https://github.com/modelscope/FunClip/releases/download/v2.1.0/FunClip-2.1.0.tar.gz
curl -LO https://github.com/modelscope/FunClip/releases/download/v2.1.0/SHA256SUMS
sha256sum -c SHA256SUMS --ignore-missing
tar -xzf FunClip-2.1.0.tar.gz
cd FunClip-2.1.0
python -m pip install -r requirements.txt
python -m pip install -U "funasr>=1.3.29"
python funclip/launch.py
Windows 用户可运行 Get-FileHash -Algorithm SHA256 FunClip-2.1.0.zip,再与 SHA256SUMS 对照。
3. 从字幕剪辑到内容理解剪辑
默认工作流先将视频转成带时间信息的字幕,再让用户按文本或说话人选段。LLM 智能剪辑会把字幕和提示词交给已配置的大模型,返回可直接交给现有剪辑按钮的时间段。
- 字幕足以判断内容时,使用已支持的字幕驱动大模型提供商。
- 动作、画面变化或屏幕事件比字幕更重要时,可选 TwelveLabs Pegasus,让模型同时理解视觉和音频。
- 需要人工精确控制时,直接选择识别文本或说话人,输出目标视频和对应 SRT 字幕。
为什么发布的是源码归档,而不是 wheel
FunClip 是可运行应用,而不是已声明为 Python 库的包;仓库没有用于构建 wheel 的 setup.py 或 pyproject.toml。因此 v2.1.0 提供两个诚实的应用源码归档和一份校验文件:
归档包含 Git 已跟踪的应用源码、文档和依赖清单,不捆绑运行依赖或模型权重;不同模型继续遵循各自的许可证与分发方式。
与 FunASR 1.3.29 的版本关系
FunClip v2.1.0 要求 funasr>=1.3.29。该版本在 SenseVoice 缺少 token 时间戳时,通过 sentence_info 返回每个 VAD 语音区域,让字幕和剪辑客户端获得真实分段边界;同时包含 1.3.28 的实时终稿与短尾语音修复。详情见 FunASR v1.3.29 Release。
先在 Space 跑通一个视频,或下载固定版本部署到自己的机器。遇到问题可提交可复现 issue;如果 FunClip 对你的工作流有帮助,欢迎 Star FunClip 仓库。
查看 FunClip v2.1.0 发布与下载