FunClip v2.1.0:本地 AI 视频剪辑的首个版本化发布

FunClip 本地视频输入、字幕识别和大模型智能剪辑界面

FunClip v2.1.0 是项目首个带版本号的 GitHub Release。它把当前本地视频剪辑应用固定为一个可下载、可校验、可回退的版本:先用 FunASR 系列模型识别视频,再按字幕、说话人或大模型选出的片段完成剪辑。

你可以直接使用公开 Space,也可以下载源码在自己的机器上运行;视频、音频和模型权重不需要打包进发布归档。

选择适合剪辑任务的识别路径

路径适合场景启动方式
Paraformer需要精确时间戳、按文本或说话人剪辑,以及中文热词python funclip/launch.py
Fun-ASR-Nano普通话、英语、日语、中文方言与口音的高精度转写;精确按字剪辑仍建议用 Paraformerpython funclip/launch.py -m fun-asr-nano
SenseVoice多语种识别,同时保留情感和音频事件标签python funclip/launch.py -m sensevoice
英文 Paraformer需要英文识别与时间戳剪辑python funclip/launch.py -l en

1. 先在线体验

FunClip Hugging Face Space 运行同一套公开应用,适合先验证视频上传、ASR、字幕选择和智能剪辑流程。需要处理私有视频或固定依赖时,再部署本地版本。

2. 下载并校验 v2.1.0

Linux 和 macOS 可以下载 tar.gz;Windows 或通用解压场景可以下载 zip。下面的校验命令只检查当前目录中已经下载的归档:

curl -LO https://github.com/modelscope/FunClip/releases/download/v2.1.0/FunClip-2.1.0.tar.gz
curl -LO https://github.com/modelscope/FunClip/releases/download/v2.1.0/SHA256SUMS
sha256sum -c SHA256SUMS --ignore-missing

tar -xzf FunClip-2.1.0.tar.gz
cd FunClip-2.1.0
python -m pip install -r requirements.txt
python -m pip install -U "funasr>=1.3.29"
python funclip/launch.py

Windows 用户可运行 Get-FileHash -Algorithm SHA256 FunClip-2.1.0.zip,再与 SHA256SUMS 对照。

3. 从字幕剪辑到内容理解剪辑

默认工作流先将视频转成带时间信息的字幕,再让用户按文本或说话人选段。LLM 智能剪辑会把字幕和提示词交给已配置的大模型,返回可直接交给现有剪辑按钮的时间段。

为什么发布的是源码归档,而不是 wheel

FunClip 是可运行应用,而不是已声明为 Python 库的包;仓库没有用于构建 wheel 的 setup.pypyproject.toml。因此 v2.1.0 提供两个诚实的应用源码归档和一份校验文件:

归档包含 Git 已跟踪的应用源码、文档和依赖清单,不捆绑运行依赖或模型权重;不同模型继续遵循各自的许可证与分发方式。

v2.1.0 的精确合并源码通过 50 项测试,另有 1 项跳过;干净 Python 3.12 环境中的 6 项发布契约测试覆盖可复现归档、跨文件系统输出、错误 ref 拒绝与发布幂等性。GitHub Actions 首次发布和主动重跑均成功,重跑验证已发布资产一致后不做破坏性修改。

与 FunASR 1.3.29 的版本关系

FunClip v2.1.0 要求 funasr>=1.3.29。该版本在 SenseVoice 缺少 token 时间戳时,通过 sentence_info 返回每个 VAD 语音区域,让字幕和剪辑客户端获得真实分段边界;同时包含 1.3.28 的实时终稿与短尾语音修复。详情见 FunASR v1.3.29 Release

先在 Space 跑通一个视频,或下载固定版本部署到自己的机器。遇到问题可提交可复现 issue;如果 FunClip 对你的工作流有帮助,欢迎 Star FunClip 仓库

查看 FunClip v2.1.0 发布与下载