首页/新闻资讯/正文详情

从2小时会议录像到关键片段:FunClip零代码AI视频剪辑实战笔记

发布时间:2026/9/24 15:57:24 来源:云帆数科 栏目:资讯中心
从2小时会议录像到关键片段:FunClip零代码AI视频剪辑实战笔记
从2小时会议录像到关键片段FunClip零代码AI视频剪辑实战笔记【免费下载链接】FunClipFunASR-powered video transcription, subtitle generation, and LLM-assisted clipping tool with a local Gradio UI.项目地址: https://gitcode.com/GitHub_Trending/fu/FunClipFunClip是一款本地部署的AI视频剪辑工具。它先用FunASR系列模型把长视频的语音转成带时间戳的文本再让你按文本、按说话人或借助大语言模型选中片段裁出对应视频。全程在浏览器里完成不需要剪辑软件也不需要写代码。核心能力语音识别、字幕生成与说话人分离FunClip的路线是一条识别链路加多种裁剪出口。默认模型Paraformer-Large是阿里巴巴开源的中文语音识别模型识别的同时输出每句的起止时间戳任意一段文字都能对应到视频时间轴上。识别结果还可以用CAM模型给每句标注说话人ID访谈和圆桌讨论里能把某个人的发言按ID整段裁出来。SeACo-Paraformer提供热词功能把人名、专业名词预先列出来这些词在识别时更容易被准确命中。语言方面也不局限于中文-l en启动英文识别模型-m还能选择fun-asr-nano覆盖普通话、英语、日语和中文方言或sensevoice额外输出情绪与音频事件标签。v2.0起加入大语言模型智能剪辑由模型先读完整份SRT字幕再自行挑段项目为此提供了prompt配置入口。安装依赖并启动服务环境依赖只有一个Python环境。先克隆仓库并安装依赖git clone https://gitcode.com/GitHub_Trending/fu/FunClip cd FunClip pip install -r ./requirements.txt模型权重在启动时单独下载不包含在源码归档里首次运行请保持联网。若使用fun-asr-nano、sensevoice或字幕兼容路径funasr需升到1.3.29及以上。启动服务后浏览器访问的默认端口是7860python funclip/launch.py英文视频加-l en-p改端口-s生成公网访问链接。如需把字幕烧进画面再额外安装imagemagick否则识别与裁剪不受影响。实战走查给会议录像裁出关键片段这里以从2小时会议录像中提取关键决策为例。先在视频输入区上传录像顺手填好两个可选项热词会议术语、人名和文件输出目录。然后点识别拿到转写文本如果视频里有多人发言改点识别区分说话人每句会多出一个说话人ID。最后选定裁剪目标并点击导出按钮。入口有两个把识别结果中需要的文字片段复制进文本裁剪框或在说话人裁剪框里输入spk0这样的ID。每个文本片段后面可跟[起始偏移, 结束偏移]微调边界。点裁剪得到视频片段点裁剪字幕得到烧录字幕的视频全视频SRT与目标段落SRT会一并产出。同样一条流程也适用于别的素材网课录像按知识点文字切片自媒体口播素材挑出金句识别后就能导出短视频。容易踩的坑专有名词、说话人边界与模型选择专有名词和人名是识别错误的高发区。开工前把它们填进热词框命中会明显好转想不全就先按说话人ID裁剪再手动核对段落边界。说话人分离能覆盖大部分访谈场景但对话来回很快时ID边界仍可能漂移。依赖说话人裁剪的视频导出前把识别结果过一遍别跳过这一步。需要精确按文本裁剪时建议用默认的Paraformer。官方说明当前发布的Fun-ASR-Nano检查点不提供可靠的字符级时间戳会影响文本位置匹配。进阶用法LLM智能剪辑与命令行批处理LLM智能剪辑分两个按钮识别完成后在下拉框选模型deepseek-chat、qwen-plus、gpt-4-turbo、litellm接入的多家模型等填好API密钥点LLM推理让模型通读字幕并给出候选段落再点LLM智能裁剪从输出中提取时间戳完成裁剪。各模型的接入代码在funclip/llm/。多目标裁剪一次完成多个说话人ID用#分隔如spk0#spk2多个文本片段同理每个文本片段支持[起始, 结束]偏移。命令行模式适合批处理funclip/videoclipper.py把流程拆成两阶段先--stage 1产出识别结果与SRT再--stage 2按文本或说话人裁剪python funclip/videoclipper.py --stage 1 --file a.mp4 --output_dir ./output python funclip/videoclipper.py --stage 2 --file a.mp4 --output_dir ./output \ --dest_text 要提取的文本 --output_file ./res.mp4FunClip适合需要在不写代码的前提下切分长视频的人会议组织者、课程制作方、自媒体编辑识别、说话人分离、LLM剪辑全部在本地完成。源码采用MIT许可证参数细节可查README_zh.md遇到问题向仓库提交Issue有prompt心得也可以分享给社区。【免费下载链接】FunClipFunASR-powered video transcription, subtitle generation, and LLM-assisted clipping tool with a local Gradio UI.项目地址: https://gitcode.com/GitHub_Trending/fu/FunClip创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关推荐

django CMS 插件体系深度解析:模型、视图与模板三要素及自定义插件实战
django CMS 插件体系深度解析:模型、视图与模板三要素及自定义插件实战

django CMS 插件体系深度解析:模型、视图与模板三要素及自定义插件实战 【免费下载链接】django-cms The easy-to-use and developer-friendly enterprise CMS powered by Django 项目地址: https://gitcode.com/gh_mirrors/dj/django-cms CMS Plugin&#… · 2026/9/24 15:57:24

PaddleSpeech 几何工具模块 `paddlespeech.t2s.modules.geometry` 解析:shuffle_dim 维度置换原理与 WaveFlow 声码器实践
PaddleSpeech 几何工具模块 `paddlespeech.t2s.modules.geometry` 解析:shuffle_dim 维度置换原理与 WaveFlow 声码器实践

人工智能语音音频 【免费下载链接】PaddleSpeech Easy-to-use Speech Toolkit including Self-Supervised Learning model, SOTA/Streaming ASR with punctuation, Streaming TTS with text frontend, Speaker Verification System, End-to-End Speech Translation and Keyword… · 2026/9/24 15:57:11

ParlAI 对话安全实战:基于 Build it Break it Fix it 对抗式训练的冒犯语言检测
ParlAI 对话安全实战:基于 Build it Break it Fix it 对抗式训练的冒犯语言检测

ParlAI 对话安全实战:基于 Build it Break it Fix it 对抗式训练的冒犯语言检测 【免费下载链接】ParlAI A framework for training and evaluating AI models on a variety of openly available dialogue datasets. 项目地址: https://gitcode.com/gh_mirrors/pa… · 2026/9/24 15:56:52

AI用88小时解开90年难题,人类只讨论了14天
AI用88小时解开90年难题,人类只讨论了14天

2026年9月8日,OpenAI 发布声明说,他们的一个内部模型解开了纳维-斯托克斯问题,一道数学界悬了90多年的题。一万多个AI智能体,88小时,165页论文。就在这个声明公布的两分钟前,一位澳大利亚数学家在自己的社交… · 2026/9/24 16:34:18

Altair Lookup 变换(transform_lookup)完整指南:在图表内实现数据关联与地理可视化增强
Altair Lookup 变换(transform_lookup)完整指南:在图表内实现数据关联与地理可视化增强

数据可视化 【免费下载链接】altair Declarative visualization library for Python 项目地址: https://gitcode.com/gh_mirrors/al/altair 点击查看 免费下载 本文围绕 Altair 中的 Lookup 变换(Chart.transform_lookup / LookupTransform)… · 2026/9/24 16:34:18

EMQX LwM2M 网关安全修复:REGISTER/UPDATE 报告中敏感查询字段的过滤机制
EMQX LwM2M 网关安全修复:REGISTER/UPDATE 报告中敏感查询字段的过滤机制

后端物联网消息队列通信 【免费下载链接】emqx The most scalable and reliable MQTT broker for AI, IoT, IIoT and connected vehicles 项目地址: https://gitcode.com/gh_mirrors/em/emqx 点击查看 免费下载 本篇技术指南围绕 EMQX 开源仓库中的一个安全修复项展… · 2026/9/24 16:34:18

OSS-Fuzz 理想集成指南:如何把 fuzz target 无缝嵌入你的项目
OSS-Fuzz 理想集成指南:如何把 fuzz target 无缝嵌入你的项目

网络安全开发工具CI/CD 【免费下载链接】oss-fuzz OSS-Fuzz - continuous fuzzing for open source software. 项目地址: https://gitcode.com/gh_mirrors/oss/oss-fuzz 点击查看 免费下载 OSS-Fuzz 面向的是拥有不同构建与测试系统的开源项目,无法要求… · 2026/9/24 16:34:18

django CMS 2.2 升级指南:依赖重构、权限增强与向后不兼容变更全解析
django CMS 2.2 升级指南:依赖重构、权限增强与向后不兼容变更全解析

CMS后端 【免费下载链接】django-cms The easy-to-use and developer-friendly enterprise CMS powered by Django 项目地址: https://gitcode.com/gh_mirrors/dj/django-cms 点击查看 免费下载 django CMS 2.2 是一次以"工程化收敛"为核心的版本升级&a… · 2026/9/24 16:34:11

shadcn-vue registry-item.json 完整规范:自定义组件注册表条目字段详解与实战指南
shadcn-vue registry-item.json 完整规范:自定义组件注册表条目字段详解与实战指南

UI组件前端 【免费下载链接】shadcn-vue Vue port of shadcn-ui 项目地址: https://gitcode.com/gh_mirrors/sh/shadcn-vue 点击查看 免费下载 导读 registry-item.json 是 shadcn-vue 组件注册表(registry)生态的核心规范文件,… · 2026/9/24 16:34:05

基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程
基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程

简介:这是一套面向计算机、人工智能、自动化等专业学生与教师的毕业设计级项目资源,围绕YOLOv8实现渔船作业监控系统,可用于毕设、课程设计、大作业或项目立项演示。压缩包共97个文件,约24.21MB,以70个Python源码文件为… · 2026/9/24 0:00:13

1D-CNN时间序列建模实战:从Conv1d原理到工业落地
1D-CNN时间序列建模实战:从Conv1d原理到工业落地

简介:面向时间序列数据建模的一维卷积神经网络完整实现,适合深度学习入门者及需要快速验证时序模型的研究者,能够从音频、文本、传感器或股价等序列中挖掘局部特征与时间依赖。压缩包体积很小,只有3KB,内含3个Python脚… · 2026/9/24 0:00:26

柔软的L:汉语语流中被忽视的舌肌张力控制
柔软的L:汉语语流中被忽视的舌肌张力控制

1. 这个“L”不是字母表里的L,而是舌尖上的L最近在几个方言群和语音教学社群里,反复看到有人发一句:“也说字母L:柔软的长舌”。初看以为是英语发音课笔记,点开才发现全是方言爱好者、播音系学生、语言康复师甚至戏曲演… · 2026/9/24 0:00:44

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码