如何用FunClip把长视频自动剪出精华片段本地AI视频剪辑实战入门【免费下载链接】FunClipFunASR-powered video transcription, subtitle generation, and LLM-assisted clipping tool with a local Gradio UI.项目地址: https://gitcode.com/GitHub_Trending/fu/FunClip一场两小时的会议或访谈结束后最耗时的往往不是剪辑本身而是找到值得保留的片段翻时间轴、记时间点再回剪辑软件里逐段裁切。FunClip把这条链路压缩成一次点击它是一款完全开源、本地部署的自动化视频剪辑工具先用FunASR Paraformer系列模型把整段视频转写成文字并标注每句时间戳你只需从识别结果里复制需要的文字点一下按钮就能拿到对应的视频片段和SRT字幕。安装依赖并启动本地服务FunClip的基础功能只依赖一个Python环境安装一共三条命令git clone https://gitcode.com/GitHub_Trending/fu/FunClip cd FunClip pip install -r requirements.txt首次启动时会单独下载模型权重第一次比之后慢建议在稳定网络下先跑一遍。服务启动参数按素材语言选python funclip/launch.py # 默认中文Paraformer python funclip/launch.py -m fun-asr-nano # 高精度转写支持普通话、英语、日语、7类方言、26种口音 python funclip/launch.py -m sensevoice # 多语种识别输出情绪与音频事件标签 python funclip/launch.py -l en # 英文视频Paraformer-Large是当前识别效果最好的开源中文ASR模型之一Modelscope下载量超过1300万次并支持一体化时间戳预测。注意需要精确按文本裁剪时请保留默认的Paraformer因为发布的Fun-ASR-Nano checkpoint不提供可靠的字符级时间戳。在网页界面完成第一次视频剪辑进入界面后从上传到出片共6步上传视频文件视频与音频识别在同一页面完成可选填写热词专有名词、技术术语、人名都可以填识别时会被优先命中点击「识别」开始语音识别多人出镜时点「识别区分说话人」每句会带上说话人ID把需要的文本段复制到「待裁剪文本」多段用#连接或直接填spk0、spk0#spk3按说话人提取可选调参数开始/结束位置偏移范围 -500 到 1000 毫秒用于在目标段落前后多留或裁掉一点字幕字体大小 10 到 100默认 32颜色四选一点「裁剪」或「裁剪字幕」得到结果除了裁剪出的视频或音频页面还会自动输出两份SRT全视频字幕和目标段落字幕不需要再单独对齐时间轴。三种剪辑方式怎么按素材选文本片段裁剪适合网课、讲座里提取某一段讲法最常用专有名词多时建议配合热词识别准了复制才准。说话人裁剪适合访谈、圆桌底层是CAM说话人识别模型按ID直接抽走某位发言人的全部段落。LLM智能裁剪不知道精彩点在哪时让大模型读完整份SRT再推荐段落适合把长视频做成短视频精华包。前两种在「文本/说话人裁剪」标签页完成第三种在「LLM智能裁剪」标签页。实战场景三类素材的剪法多人访谈只剪一位发言人的部分勾选「识别区分说话人」后识别结果每句带说话人ID。输入spk1就剪出这个人的全部段落输入spk0#spk2则合并两个人的内容。一小时圆桌里某位嘉宾的发言不用逐帧翻找就能单独成片。让大模型帮你挑精彩片段v2.0.0加入LLM剪辑识别完成后在下拉框选模型内置 deepseek-chat、qwen-plus、gpt-3.5-turbo、gpt-4-turbo 等填入apikey点「LLM推理」FunClip会自动把prompt与视频SRT拼接提交再点「AI Clip」按大模型输出的时间戳直接裁剪。默认prompt要求输出不超过4条「1. [开始时间-结束时间] 文本」格式的片段可按你的需求改写。界面提供三种调用方式阿里云百炼qwen系列、OpenAI官方api以及通过g4f集成的免费通道。g4f可能不稳定或返回很慢追求稳定建议自备key。另外内置的pegasus1.5选项走TwelveLabs Pegasus它直接对视频画面音频做理解推理在字幕信息不够动作、场景切换时也能挑出片段使用前需pip install twelvelabs并配置其apikey。命令行调用把裁剪接进批处理不想开浏览器时funclip/videoclipper.py支持两步命令行python funclip/videoclipper.py --stage 1 --file video.mp4 --output_dir ./output python funclip/videoclipper.py --stage 2 --file video.mp4 --output_dir ./output \ --dest_text 要提取的句子 --output_file ./output/res.mp4stage 1 完成识别结果与全量SRT落在./output/stage 2 按文本裁剪还可传--start_ost、--end_ost控制起止偏移。常见报错排查服务起不来或识别结果异常老版本用户先执行pip install -U funasr1.3.29该版本修复了SenseVoice路径下空时间线和短尾语音的问题。视频上传很慢或卡死同一端口的界面开了多个关闭多余窗口只保留一个。裁剪位置与文字对不上复制的文本要和识别结果逐字一致含标点专有名词、人名识别错的加上热词重新识别。字幕烧录不出画面「裁剪字幕」属于可选功能需要系统装好ffmpeg和imagemagick仓库已带字体文件font/STHeitiMedium.ttc。g4f模型无响应或超时该通道本身不稳定换用已填key的qwen或OpenAI系列模型。功能边界与后续可关注的内容先把边界说清楚适合本地私有素材、多段自由剪辑、需要同时产出SRT字幕的场景不适合纯CPU或边缘设备的离线转写FunASR社区另有GGUF运行时、用Fun-ASR-Nano做精确文本裁剪请换Paraformer。后续可以关注仓库施工中清单里有反向时间段选择给出要留的段落、自动选出其余部分和静音段落移除两项未完成功能。v2.1.02026/07/24是项目首个带版本号的发布打包为带SHA-256校验的源码归档发布说明见 docs/releases/v2.1.0.md。源码采用MIT许可模型权重单独下载遵循各模型页面条款。【免费下载链接】FunClipFunASR-powered video transcription, subtitle generation, and LLM-assisted clipping tool with a local Gradio UI.项目地址: https://gitcode.com/GitHub_Trending/fu/FunClip创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
企业数字化 ERP 产品动态
相关推荐
仓颉语言Markdown解析库commonmark4cj:符合CommonMark规范解析与渲染的完整指南 仓颉语言Markdown解析库commonmark4cj:符合CommonMark规范解析与渲染的完整指南 【免费下载链接】commonmark4cj 符合CommonMark规范的Markdown解析库 项目地址: https://gitcode.com/Cangjie-TPC/commonmark4cj
commonmark4cj 是一款用仓颉(Cang… · 2026/9/24 16:22:38
hashlib4cj多类型输入实战:字符串、数组、文件与流数据的哈希计算全解析 hashlib4cj多类型输入实战:字符串、数组、文件与流数据的哈希计算全解析 【免费下载链接】hashlib4cj 项目地址: https://gitcode.com/Cangjie-SIG/hashlib4cj
hashlib4cj 是一个仓颉(Cangjie)语言开源哈希算法库,内置 80… · 2026/9/24 16:22:37
2026 国产汽车电子厂商全景:从座舱域控到车规芯片选型图谱 如果只要一句结论:国内汽车电子企业大致分为四层——座舱与域控 Tier1(德赛西威、华阳通用、亿咖通、车联天下、均胜电子)、智驾方案商(华为乾崑、Momenta、元戎启行、卓驭科技、地平线)、车规芯片(芯驰科技… · 2026/9/24 16:22:12
前期工作小结 从暑假开始到目前,主要做的工作是:阅读学姐的增量学习的论文,以及对论文内的数据进行复现。论文阅读:读完学姐的论文,主要理解 LAUR 增量学习框架——用贝叶斯参数建模缓解灾难性遗忘,BERT/BGE 做特征编码&… · 2026/9/24 17:04:05
video-use 技能实战指南:用对话式 Agent 完成视频剪辑、调色、字幕与动画合成 AI 技能/插件音视频视频处理人工智能 【免费下载链接】video-use Edit videos with coding agents 项目地址: https://gitcode.com/GitHub_Trending/vid/video-use 点击查看 免费下载 导读
video-use 是一个开源、基于对话驱动的视频编辑技能(Skill&am… · 2026/9/24 17:03:59
基于SpringBoot+Vue的美妆产品推荐系统(源代码+文档+PPT+调试+讲解) 温馨提示:本人主页置顶文章(点我)开头有 CSDN 平台官方提供的学长联系方式的名片! 温馨提示:本人主页置顶文章(点我)开头有 CSDN 平台官方提供的学长联系方式的名片! 温馨提示:本人主页置顶文章(点我)开头有 CSDN 平台… · 2026/9/24 17:03:47
openFrameworks 视频播放实战:基于 ofVideoPlayer 的加载、速度控制与像素可视化 openFrameworks 视频播放实战:基于 ofVideoPlayer 的加载、速度控制与像素可视化 【免费下载链接】openFrameworks openFrameworks is a community-developed cross platform toolkit for creative coding in C. 项目地址: https://gitcode.com/gh_mirrors/op/ope… · 2026/9/24 17:03:47
30 分钟配好 Continue:JetBrains 插件安装、离线构建与调参指南 30 分钟配好 Continue:JetBrains 插件安装、离线构建与调参指南 【免费下载链接】continue open-source coding agent 项目地址: https://gitcode.com/GitHub_Trending/co/continue
写代码时总要切到网页版 AI 问一句,答完再切回来贴代码… · 2026/9/24 17:03:47
【Dify】FLUX绘画机器人多模态识别与语音交互自动化 以多模态智能交互为核心的自动化创作方式,正推动AI艺术、教育与硬件结合的快速发展。视觉识别、语音播报与机器人控制的结合,为传统绘画和教学带来了新的可能。
本文梳理FLUX绘画机器人结合多模态识别和语音播报的完整工作流,实现从图片输入、内容识别、创意生成到语音解读… · 2026/9/24 17:03:27
基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程 简介:这是一套面向计算机、人工智能、自动化等专业学生与教师的毕业设计级项目资源,围绕YOLOv8实现渔船作业监控系统,可用于毕设、课程设计、大作业或项目立项演示。压缩包共97个文件,约24.21MB,以70个Python源码文件为… · 2026/9/24 0:00:13
1D-CNN时间序列建模实战:从Conv1d原理到工业落地 简介:面向时间序列数据建模的一维卷积神经网络完整实现,适合深度学习入门者及需要快速验证时序模型的研究者,能够从音频、文本、传感器或股价等序列中挖掘局部特征与时间依赖。压缩包体积很小,只有3KB,内含3个Python脚… · 2026/9/24 0:00:26
柔软的L:汉语语流中被忽视的舌肌张力控制 1. 这个“L”不是字母表里的L,而是舌尖上的L最近在几个方言群和语音教学社群里,反复看到有人发一句:“也说字母L:柔软的长舌”。初看以为是英语发音课笔记,点开才发现全是方言爱好者、播音系学生、语言康复师甚至戏曲演… · 2026/9/24 0:00:44