HotClip — 免费开源的 AI 剪辑 / 直播切片工具,长视频一键切成爆款竖屏短视频

简体中文 | English

HotClip 是一款免费开源的 AI 视频剪辑 / 视频切片工具(Windows / macOS 桌面客户端):把几个小时的直播回放、播客、课程一键切片成竖屏爆款短视频——AI 自动识别高光片段和金句、自动加字幕(逐字点亮)、横屏转竖屏 9:16、剪口播去气口,全程本地运行,无水印、无积分制、不限时长,素材不上传。

切好直接发抖音 / 快手 / B站 / 视频号 / 小红书 / TikTok / Reels / Shorts。不会代码也能用:下载安装包双击即开。AI 负责找高光爆点,最终哪条能发、切在哪里,由你定夺。


界面预览

截图为真实界面(演示素材:一段带货直播回放)。觉得切得准,就点个 ⭐——每颗星都是让更多人不用再给积分制付费的一票。

最近更新

  • v0.8.0(2026-07-20)「照着爆款切、坏片自己修」:参考视频驱动(丢一条想对标的爆款切片,本地实测时长/语速/句长/镜头节奏/钩子形态生成风格画像,选段向对标节奏靠拢,CLI --reference)+ 出片自我修复(质检告警里可自愈的当场修好:首尾静音黑屏自动裁边、响度重归一,修完重检变好才采纳,动作记进 qa.repair 可审计)+ 平台违禁词 lint(120+ 本地规则扫标题/文案/字幕,绝对化用语/医疗宣称/导流话术发布前点名,零上传)+ Hormozi 大字爆点字幕(带货营销风:特大加粗、硬阴影、逐词点亮)+ 抽帧接触表(九帧拼一张带序号九宫格,VLM 批量打分调用数 20→3、帧额度 20→27;审阅台同款「画面速览」,不点播放一眼扫完片段)
  • v0.7.0(2026-07-16)「切完自检、随叫随剪」:出片自我质检(黑屏/长静音/响度/时长/切点半词复核写进 clips.json,每个切点 30ms 淡化防爆音)+ Headless CLI 与官方 Agent Skill(Claude Code / Codex 一句话驱动本地切片)+ 精华合集一键成片(附章节时间戳)+ 高潮前置(钩子句剪到开头)+ 一键双画幅(竖屏+横屏同出)+ 商品讲解模式(带货切片);另含热词词表、一键降噪、字幕安全区预览、纯音频波形成片、AIGC 标识、智能封面、导出可取消与实时进度
  • v0.6.0(2026-07-10)「看得见画面、接得上生态」:六路证据链(+视觉爆点信号 · 表情峰值 · 弹幕热度)+ 双语字幕烧录 + 本地 MCP Server(Claude 一句话驱动切片)+ 录播监听 7×24 无人值守 + 发布文案/SRT/EDL 时间线三件交付套件 + 时长档/偏好记忆/标题即点即改
  • v0.5.0(2026-07-09)「选得准、批量稳」:切片审阅台(导出前应用内看片,波形时间轴拖手柄逐词微调切点)+ 镜头切点吸附(TransNetV2,切点吸到真实镜头切换)+ 品牌样式模板(高亮色/字号/位置/logo水印)+ 端侧两级漏斗(本地小模型初筛,长视频 LLM 成本降一个量级);另含开场钩子黄金3秒烧录、响度标准化 -14 LUFS
  • v0.4.3(2026-07-06)工程底座:转写结果本地缓存(同文件重开秒进挑爆点)+ clips.json 处理产出回执(AI 对每条片做了什么,可审计) 完整更新历史见 Releases

🚧 项目状态

「导入 → AI 找爆点 → 竖屏+逐字字幕成片」三步全流程可下载可用,并已长出说话人分离、气泡特效字幕、气口跳剪、一键全托管等能力,去下载:

里程碑 状态
桌面客户端(Electron,中英双语,导入+媒体探测) ✅ 已完成
本地转写(SenseVoice / Paraformer / FireRedASR2 三档 + 云端 ElevenLabs,逐字时间戳,首启自动下载·国内镜像优先) ✅ 已完成
AI 找爆点(LLM 只引原文不猜时间戳,逐字反向对齐 → 切点精确到词,四维复评打分) ✅ 已完成
出片(帧精确切割 + 竖屏 9:16 重构 + 卡拉OK逐字字幕烧录) ✅ 已完成
人脸跟随智能取景(镜头级三模式,无人脸自动回退居中裁剪) ✅ 已完成
说话人分离 · 气泡特效字幕 · 开场钩子 · 气口跳剪 · 剪口头禅 · 响度标准化 · 转写缓存 · 一键全托管 ✅ 已完成
安装包发布(Windows exe + 绿色版 zip + macOS dmg) 已发布
v0.5「选得准、批量稳」(切片审阅台 · 镜头切点吸附 · 品牌样式模板 · 端侧两级漏斗) 已发布
v0.6「看得见画面、接得上生态」(六路证据链 · 双语字幕 · MCP Server · 录播监听 · 弹幕信号 · 发布套件) 已发布
v0.7「切完自检、随叫随剪」(出片质检 · Headless CLI · Agent Skill · 精华合集 · 高潮前置 · 双画幅 · 商品模式) 已发布
v0.8「照着爆款切、坏片自己修」(参考视频驱动 · qa 修复循环 · 违禁词 lint · 大字爆点字幕 · 抽帧接触表) 已发布
多平台发布 · 剪映草稿导出 · 英文 ASR 升级 🗺️ 规划中

一键切片,三步出片

  1. 导入:把播客、直播回放、课程、Vlog 丢进来(MP4 / MKV / MOV / FLV / TS,也支持纯音频)
  2. 挑高光:本地逐字转写 → AI 通读全文自动识别高光片段——金句/冲突/高能瞬间,每条附爆款分、开场钩子和推荐理由,切点精确到词;看不顺眼的取消勾选即可
  3. 出片:一键切出竖屏 9:16 成片,自动加字幕(卡拉OK逐字点亮)直接烧进画面,文件落在「影片/HotClip」里,打开就能发

谁在用:直播切片 · 播客剪辑 · 剪口播 · 批量矩阵

  • 主播 / 切片手(直播切片、切片带货):下播后把几小时直播回放自动切成高光短视频;开「录播监听」后 7×24 无人值守,录完自动出片
  • 播客主(播客剪辑):纯音频也能出片——自动合成波形动画画面 + 金句字幕,播客节目直接变竖屏视频
  • 知识区 UP 主 / 口播博主(剪口播):自动去气口、剪口头禅、删停顿,长口播变利落短视频,字幕逐字点亮
  • 带货 / 矩阵团队(批量剪辑):一键全托管批量出片,每条附发布文案、封面图与 clips.json 元数据,直接接矩阵管线

为什么做 HotClip

市面上的 AI 切片工具,要么按分钟扣积分(一期 2 小时播客烧光整月额度,积分月底还清零),要么必须上传云端(未发布的素材/客户内容不敢传——参考 2025 年 CapCut 用户协议风波),要么切点稀烂(句子切一半、没上下文),要么中文支持名不副实。开源侧则几乎全是命令行/自部署,小白装不起来。

HotClip 的答案:

  • 🖥️ 双击就能用:Windows / macOS 安装包,不用 Python、不用 Docker、不用命令行
  • 🔒 本地优先:转写、找爆点、切片全在你电脑上跑,素材不上传
  • 🆓 真免费:开源 AGPL-3.0,无积分制、无水印、不限视频时长
  • 🎯 切点准:LLM 只负责«挑哪段»,时间戳由逐字转写反向对齐——不让 AI 猜时间
  • 🇨🇳 中文原生:中文语音识别走专门引擎(SenseVoice,兼顾粤语),界面中英双语,爆点判断的提示词也按内容语言分流——不是英文产品硬翻
  • 🤖 模型自带干粮也行:默认本地免费模型;要更强的爆点判断,可一键接 Atlas Cloud(一个 Key 用齐中外主流大模型)、fal.ai 或任意 OpenAI 兼容接口

对比

HotClip OpusClip / Klap / Vizard 等 SaaS 剪映/CapCut 智能切片 FunClip / autoclip 等开源
价格 免费开源 $15-29+/月,按源视频分钟扣积分,重生成再扣,积分月底清零,退订删项目 核心功能进会员/Pro 免费
素材去向 全程本地,不上传 必须上传云端 云端处理为主 本地
水印/时长限制 免费档有水印、限时长、项目 3 天过期 部分模板有限制
小白可用 双击安装即用 网页版,易用 易用 命令行/Docker/自部署
切点质量 逐字对齐,精确到词,附理由可否决 黑盒打分,常被抱怨断章取义 黑盒 按句切,无爆点排序
竖屏字幕 9:16 重构 + 逐字点亮字幕内置 有(付费档) 自动字幕已进付费 多数无竖屏重构

一句话:SaaS 的积分制和黑盒是最大怨气来源;开源工具装不起来。HotClip 把两边的坑同时填上。

竞品信息核对于 2026-07,具体以各家官网为准。

已实现

  • 本地逐字转写(三档可选):快速 SenseVoice(五语种,170MB)/ 均衡 Paraformer(中文更准,230MB)/ 最准 FireRedASR2(普通话/方言/中英混说,小红书开源,520MB)——全部本地运行、逐字时间戳、首次自动下载(国内镜像优先),模型不带标点的档位自动用标点模型回补;另有云端档 ElevenLabs(自带 Key,90+ 语种,只上传提取的音轨、绝不上传视频)
  • AI 找爆点(自动识别高光片段/金句):LLM 只负责«挑哪段»并引用原文,时间戳由逐字转写反向对齐(逐字精确/首尾锚定/按句对齐三级降级,UI 明示切点质量)——不让 AI 猜时间
  • 证据链卡片:每条候选附爆款分、开场钩子、推荐理由、精确时间边界,可勾选取舍
  • 人脸跟随智能取景(横屏转竖屏):横屏自动转竖屏 9:16,自动检测并跟随人脸(镜头级三模式:静止不动/平滑横移/One Euro 跟踪),人不在画面中间也不切歪;无人脸自动回退居中裁剪
  • 自动加字幕(卡拉OK逐字点亮):词级时间戳驱动的逐字点亮字幕(ASS/libass),直接烧录进成片,可开关
  • 语义断行(免 Key):字幕不再按固定字数「拦腰截断」——顺着 ASR 标点模型标出的逗号/顿号在真实子句处换行,长句里没有标点时再回看到最近的结构助词(的/了/着…)断,「十几块的 / 到底有什么区别」这样短语保持完整;等价于头部项目用 LLM 插 [br] 的效果,但用本地信号、零额外调用、不需要云 Key
  • 气泡特效字幕(Web 渲染引擎):用应用内置的 Chromium 离屏逐帧渲染 CSS 字幕层再合成进片——自适应圆角气泡底、关键词渐变金字、弹性入场,这些传统字幕烧录(libass)做不出的效果,一档切换即得;确定性逐帧驱动,同输入必出同片
  • 标题贴片:AI 起的爆款标题自动烧进顶部安全区(黑底白字贴片),切片标配一步到位
  • 开场钩子(黄金3秒):AI 为每条切片写的悬念句不再只躺在 clips.json——自动大字烧在开头 2 秒的上三分之一当文字钩子(前 3 秒抓不住人=直接划走,是短视频完播率的命门),淡入淡出、避开画面中央主体与顶部标题;没写出悬念句的片自动不加,可一键开关
  • 高潮前置(cold-open):一个开关,把切片里最炸的钩子句(1-4 秒)自动剪到开头再接完整正片,播到原位置原样重复——直播切片圈通行的完播率手法(50-60% 的划走发生在前 3 秒),商业工具把 AI Hook 锁在付费档;钩子句用与选段同一套引用反查逐词定位,字幕/悬念句/标题贴片在前置段照常烧录,SRT/封面时刻同步平移;钩子定位失败、或它本来就在开头 10 秒内时自动跳过(宁可不做不可做错),做没做写进 clips.json 回执
  • AI 复评质量门:严格评审员二次盲评每条候选,钩子/结构/价值/热点四维分项打分,每维一句话理由,另给一条可印上视频开头的悬念句;弱候选透明标记默认不选——托管出的每条都过双重关
  • 爆款分=排名不是玄学:总分由四维加权后按候选间相对排名归一(推荐档 76-99),同一批次内可直接比大小,不受 AI 打分批间漂移影响——商业工具同款做法,诚实标注它是排序器不是播放量预言
  • 多人对谈「谁在说话」:一键开启说话人分离(本地 pyannote+3D-Speaker,零上传),逐句标注谁在说——AI 按说话人挑段、避免把两个人的半句拼成断章取义,气泡字幕还能按人上色;访谈/播客/连麦场景专治「切出来不知道谁说的」
  • 商品讲解模式(带货直播切片):填几个商品词,选段就按带货转化逻辑走——优先圈试用实测演示 > 卖点讲解 > 价格机制,催单只保留紧邻上链接的天然收尾(「三二一,上链接」),纯憋单拉互动段(「点赞到X万才上链接」——平台判违规,切出去会限流)明确排除;命中的商品词确定性并入切片关键词、候选卡上打 🛒 标记,哪条在讲哪个商品一眼可查;商品词本机记住,和热词词表天然联动(词表纠错后的商品名照样命中)
  • 去录屏UI:手机直播录屏的状态栏/固定UI/上下黑边,用时域方差自动检测并裁除(静止的是UI,会动的是内容),检测不到就不裁
  • 剪口播 · 气口跳剪(自动去气口/删停顿):自动剪掉说话间的停顿静音并拼接,字幕时间轴同步重映射——成片节奏像人剪的,不是机切;剪不剪由「无词 声学静默」双重判定,笑声、掌声、BGM 高潮这些没有台词但有情绪的瞬间不会被误删
  • 剪口头禅:嗯/呃 等语气词和结巴重复自动剪除(词表刻意保守,「然后/那个/句尾的啊」这类真词不动);剪了什么逐条列进 clips.json,你始终知道 AI 动了哪里
  • 响度标准化:每条切片按 EBU R128 归一到 -14 LUFS 社媒标准(抖音/TikTok/Reels/视频号 播放同款响度),整批出片音量一致、不再有的太小声有的爆音——平台不会因忽大忽小压流量,观众也不用一直调音量;跳剪拼接后的成片按拼接后的音轨算响度,不是分段各算
  • 一键降噪(去底噪/电流声):直播回放常带底噪、嗡嗡的 50Hz 电流声,以前得导去 Audacity 处理再导回——现在出片工具条一个开关,双高通(24dB/oct 压电流声)+ 谱减降噪进出片链;合成素材实测静音段底噪 -7.9dB、人声只动 0.2dB,三条出片路径(普通/跳剪/音频成片)同链生效,永远排在响度标准化之前(先去噪再归一,不把噪底一起抬高);诚实定位:零成本基础降噪,不是 AI 修音
  • 封面图 + 元数据导出:每条切片附带封面 JPG(带字幕和标题贴片,平台直传)和 clips.json(标题/钩子/评分/评审意见/时间码/关键词),矩阵运营直接接 CMS;还带处理产出回执(有效字幕样式、取景是 face-track 还是回退中心裁、跳剪剪除比与拼接段数、剪了几个口头禅)——AI 到底对每条片子做了什么,一目了然可审计
  • 画面声音证据:响度峰值与镜头切换密度本地采集,注入爆点判断——不再纯文本盲选
  • 视觉爆点信号(端侧看画面):可选用本机 Ollama 视觉模型(如 qwen3-vl:4b)抽帧研判画面高能时刻——夸张表情、激烈肢体动作、场面炸裂这些逐字稿里完全看不见的爆点,圈成时段作为证据交给云端一起选段;抽帧时刻优先押在响度峰值/镜头密集段上(免费先验),全片兜底均匀补齐;端点不可用/证据太薄自动跳过,绝不拖垮检测,看了多少帧在结果页明示——专治「视频类工具在画面梗内容上准确率不到 35%」的行业通病
  • 端侧两级漏斗(省钱):可选用本机 Ollama 小模型(如 qwen3:4b)先通读全文圈出候选段,云端大模型只精读入围部分——长视频的云端 token 花费降一个量级;引用反查仍在全量转写上做,切点精度零损失;本地端点不可用自动回退全文直发,单块失败整块入围(宁可多花钱,绝不漏内容);省了多少在结果页明示
  • 镜头切点吸附:TransNetV2 镜头边界检测(31MB ONNX 本地推理,MIT)逐帧找真实镜头切换,切片起止点自动吸附到最近的镜头边界(≤0.8s 外扩优先)——成片不再从半个动作/半次转场开始;词边界守卫保证吸附绝不切掉说话,检测失败自动回退不吸附,吸了多少写进 clips.json 回执
  • 品牌样式模板:主高亮色(卡拉OK点亮/关键词强调/开场钩子/气泡渐变同源)、字幕字号与位置三档、logo 水印(四角可选/透明度可调)——配一次存成命名预设,之后每条切片(含一键托管)自动带上你的风格;用了什么样式写进 clips.json 回执,矩阵管线可核对品牌一致性。竞品把这个锁在付费墙后
  • 导出可取消:出片过程随时一键取消——正在编码的 ffmpeg 进程即时掐断(不是等它跑完),已完成的切片保留在输出文件夹
  • 出片实时进度:进度条不再按「第几条/共几条」半格跳——ffmpeg 编码进度流式回报,几分钟的长切片也能看到条内百分比匀速前进,不再疑似卡死;普通切片/跳剪/Audiogram 三条出片路径同一执行层,取消照常即时生效
  • 新版本提示:启动时静默检查 GitHub 最新 release,有新版在页头亮一枚小徽标,点击直达下载页——断网/限流全静默,绝不打扰;当前版本永远继续可用
  • 逐句稿即点即改(转写纠错):ASR 错字不再一路烧进字幕——转写页每句 hover 出铅笔,当场改掉;字幕、双语翻译、发布文案全部用修正后的文本,该句卡拉OK时间轴按字符宽度自动重建(CJK 逐字/英文按词)
  • 热词词表(专有名词一次纠错,期期自动修正):人名/品牌/游戏术语整场重复识别错是语音识别通病——逐句稿里改一处,一键应用到全片同错句并加入词表;词表持久化在本机,之后每次转写自动整词替换(英文整词匹配防误伤「MAIN」里的「AI」,最长错词优先),字幕/双语翻译/发布文案/录播监听/MCP 全部生效;词表更新后同素材重开直接用转写缓存重放替换、不重跑识别,被修正句带「词表」标记可审计
  • 智能封面选帧:封面不再固定取开头 0.8 秒(常拍到过渡帧),自动选切片内响度最高的一帧——峰值处通常是笑点/喊叫/情绪最高点,正是该当门面的表情(带激动表情的封面点击率高 20-30%);跳剪后被剪掉区间的峰值不参与,避开首尾转场,全静音素材回退旧行为
  • AIGC 标识(合规内建):一个开关,按《人工智能生成合成内容标识办法》打标——画面左上角「AI 生成」显式标识 + 文件元数据隐式标识(内容属性/工具/内容编号);发布平台要求 AIGC 声明时开启,默认关不误标
  • Audiogram 音频成片(播客的画面):纯音频源(播客/录音)导出时自动合成画面——深色底 + 品牌色波形动画 + 字幕/标题贴片照常烧录;静态封面会被划走,会动的波形才能在信息流里留住人(Headliner 整个产品就靠这一个能力);跳剪后波形与声音天然同步,竖/横屏跟随出片设置,零配置零新依赖
  • 时间线 EDL 导出(AI 粗剪,人终剪):一个开关,输出目录多一份 timeline.edl(CMX3600 通用格式)——AI 定的切点含跳剪的每一刀都在时间线上,导入 DaVinci Resolve / Premiere 重链源片就能继续精修;机器的判断全部可见、可改、可推翻
  • 一键双画幅(竖版发抖音,横版发B站):一个开关,同批切片在竖屏 9:16 之外再出一版横屏原画幅到「横屏/」子目录——各平台画幅规格不同,以前要进剪辑软件剪两遍;横屏版自动去掉标题贴片(竖屏短视频形态),字幕换底部小号布局,封面/SRT/回执各自成套;竖屏源裁不出 16:9 自动跳过,进度条按双倍任务数走。Opus/Vizard 都只能单画幅出片再逐条转,一键双画幅批量导出是头一份
  • 精华合集一键成片(周报合集):一个开关,这批切片按时间序自动拼成一支合集视频——「本周高光合集」是 B站/YouTube 主播的成熟周更形态,以前要进剪辑软件二次拼;流复制拼接秒级完成、零画质损失,切片间硬切(合集通行做法,转场反而拖节奏),旁边附 .chapters.txt 章节时间戳(YouTube 章节/B站简介粘贴即用,照此拆分P也行);拼接失败静默跳过,绝不拖垮已导出的单条切片
  • 出片偏好记忆 + 标题即点即改:工具条的开关组合(竖屏/字幕样式/跳剪/双语/发布文案/时长档…)自动记住,换视频不用重新点一遍;候选卡片的标题点铅笔就能改——导出文件名、标题贴片、发布文案全部跟着新标题走
  • 切片时长档:一键在「短·10-30s / 标准·8-40s / 长·40-90s」间切换并重新选段——目标时长作为硬约束进选段提示词(不是切完再裁),快节奏竖屏、B站/播客金句段各取所需;超出目标容差的候选直接过滤
  • SRT 字幕文件导出:一个开关,每条切片旁落同名 .srt——平台原生字幕上传(B站/YouTube)、剪辑器二次精修、无障碍都用得上;时间轴已对齐跳剪/剪口头禅后的成片,断行与烧录字幕逐行一致,开了双语还带译文第二行,纯本地零成本
  • 弹幕热度信号(观众投的票):检测时自动发现录播旁的同名弹幕 .xml(录播姬约定,兼容 B 站主站导出),滑窗密度 + 高能词加权(哈哈哈/666/草/awsl…)圈出观众实时高能时段,作为证据力最强的信号进爆点判断——弹幕是观众逐秒投出的票,比任何模型推断都直接;阈值随全场基线自适应,大主播弹幕海和小主播弹幕溪都圈得准;没有弹幕文件就当无此信号,中文直播切片的差异化尖刀
  • 录播监听(7×24 无人值守):盯住录播姬/OBS 的输出目录,新录播写完落稳自动转写、找爆点、出成片——直播录完即切,主播睡觉切片机干活;轮询式监听扛得住网络盘与分段写盘,"连续两轮大小不变"才算录完绝不切半截,已处理记录持久化重启不重切,单文件失败跳过继续盯(绝不循环重试烧 LLM 费用)
  • 本地 MCP Server(被 Agent 调用):在 Claude Code / Claude Desktop 注册后,Agent 一句话驱动整条本地管线——clip_video 全托管出片 / detect_highlights 先审后剪 / transcribe_video 端侧转写;零新增依赖的手写 stdio 协议,「本地 MCP 切片器」的空白位(商业侧只有 OpusClip 的云端版)
  • 发布文案生成(发布框不空手):一个开关,为每条切片生成发布标题(钩子风)+ 3-6 个垂类话题标签 + 一两句简介,落在 mp4 旁的同名 .post.txt 里直接全选复制,同步写进 clips.json 供矩阵管线取用——素材全部来自检测阶段的证据链(片名/钩子/关键词/正文),中文源出中文文案、英文源出英文文案;生成失败静默跳过不影响出片
  • 表情峰值信号(零配置看表情):YuNet 人脸检测 + FER+ 表情识别(两个几 MB 的 MIT 协议 ONNX 模型,首次自动下载)在采样帧上找大笑/惊讶/激动的表情峰值,圈成时段进爆点判断——不装 Ollama 也能让 AI"看见"情绪爆点,视觉信号的免费开箱版;采样押注响度峰值/镜头密集段窗口(表情就藏在那里),无人脸素材/模型不可用自动跳过,识别了几张脸在结果页明示
  • 双语字幕(出海一步到位):一个开关,用你配置的 LLM 把每句话整句翻译(整句语境,不是字幕行碎片),烧成主字幕下方的小号译文轨——原文卡拉OK在上、译文整句在下的双语电视级形态;中文源自动译英,外语源译中;跳剪压缩时间轴时译文行同步重映射,被剪掉的句子不残留;翻译失败静默跳过绝不拖垮出片,烧了几行写进 clips.json 回执。竞品按"100+ 语种字幕"单独收费的能力,这里免费
  • 切片审阅台(导出前看片):每条候选一键打开审阅台——应用内直接播放这条切片(本地流式协议,拖进度条不卡),波形时间轴上拖两端手柄逐词微调切点(自动吸附字词边界,拖动即蹭帧),整句伸缩、一键还原 AI 切点,「查结尾」只播最后 2.5 秒验收收尾;手调过的切点导出时自动跳过镜头吸附——机器不再改人的决定;专治「AI 选片不敢直接发」
  • 字幕安全区预览(防投稿翻车):审阅台一键叠加平台 UI 遮挡区遮罩——右侧点赞栏、底部文案区、顶部状态区会盖住画面的位置一眼可见,字幕/主体压进红区发出去就会被挡;内置抖音/快手/B站竖屏/视频号/小红书/TikTok/Reels/Shorts + 通用并集九档(视频号只有中间 6:7 区域不被遮挡这类平台差异都按实测数据画),虚线框同时标出竖屏 9:16 裁切范围;竞品里剪映的安全框只是线框、NarratoAI 只有字幕位置预览——按平台真实遮挡画遮罩的,这是头一份
  • 转写结果本地缓存:转写是整条流水线最慢的一步;结果按(文件+引擎)缓存在本地,同一个文件下次再开、想换设置多切几条,跳过重转写秒进挑爆点(云引擎还顺带省一次 API 费),文件改动或换引擎自动失效
  • 一键全托管:导入后点一个按钮,转写 → 找爆点 → 竖屏+字幕+剪气口成片全自动跑完,人只做最后审片
  • 帧精确切割:快速定位 + 重编码,爆点第一秒不糊不偏;直播回放数小时 FLV/TS 直接进
  • 中英双语界面,新增语言只需一个语言文件

规划中

完整规划见 产品规划文档,要点:

  • v0.5 选得准:候选切片审阅台(拖拽微调边界、一键重生成)· 镜头边界检测(切点吸附镜头边界)· 字幕样式模板/品牌预设 · 端侧小模型初筛降本
  • v0.6 看得见画面:视觉爆点信号 · 表情峰值 · 多语言翻译字幕 ✅ 已发布(含提前落地的 MCP Server / 录播监听 / 弹幕信号)
  • v0.7 切完直接发:多平台一键发布/排期 · 剪映草稿导出 · 英文转写引擎升级(Parakeet)
  • 合规内建:AIGC 标识(显式+隐式,对齐 2025-09 生效的国家标识办法);仅面向自有内容与已授权切片,不做搬运工具

想投票决定先做哪个?到 Discussions 留言。

下载安装

⬇️ 去 Releases 页下载最新版

平台 文件
Windows 安装版 HotClip-x.y.z-win-x64.exe
Windows 绿色版(免安装,解压即用) HotClip-x.y.z-win-x64.zip
macOS(Apple 芯片) HotClip-x.y.z-mac-arm64.dmg

⚠️ 当前版本未做代码签名:Windows SmartScreen 提示时点「更多信息 → 仍要运行」;macOS 首次打开用右键 → 打开(或到「系统设置 → 隐私与安全性」允许)。代码签名已在规划中。

快速开始(开发者)

git clone https://github.com/xixihhhh/hotclip.git
cd hotclip
pnpm install
pnpm dev        # 启动桌面应用(开发模式)
pnpm test       # 跑单元测试

让 Claude Code / Codex 帮你切片(Skill · CLI · MCP)

HotClip 是唯一本地不上传的切片 Agent 工具链——把下面这段话直接粘给 Claude Code / Codex,Agent 会自己完成安装并把 HotClip 装成随叫随到的剪辑技能:

请安装 HotClip 作为我的本地切片技能:git clone https://github.com/xixihhhh/hotclip.git && cd hotclip && pnpm install,然后把 skills/hotclip/ 复制到我的 Agent skills 目录(Claude Code 为 ~/.claude/skills/hotclip/),并按 skills/hotclip/SKILL.md 里的说明配置 LLM 环境变量。装好后用一段测试视频跑 pnpm cli highlights 验证。

之后一句「把这个 4 小时录播切 10 条爆点」就是完整交付:转写、找爆点、出片、出片质检(黑屏/长静音/响度/时长/切点复核,报告进 clips.json)全在你机器上跑,素材不出电脑。

Headless CLI(终端/脚本/Agent 通用,与桌面端产物完全一致):

pnpm cli transcribe 直播回放.mp4                 # 端侧逐字转写(带缓存)
pnpm cli highlights 直播回放.mp4 --json          # AI 爆点候选,先审后剪
pnpm cli clip 直播回放.mp4 --max-clips 10        # 全托管出片 + 质检报告

MCP Server(Claude Code / Claude Desktop 注册即用):

{
  "mcpServers": {
    "hotclip": {
      "command": "npx",
      "args": ["-y", "tsx", "src/mcp/server.ts"],
      "cwd": "/path/to/hotclip",
      "env": {
        "HOTCLIP_LLM_BASE_URL": "http://localhost:11434/v1",
        "HOTCLIP_LLM_MODEL": "qwen3:8b"
      }
    }
  }
}

三个工具:clip_video(全托管一条龙)、detect_highlights(只出候选清单,先审后剪)、transcribe_video(端侧转写,带缓存)。云端 LLM 另设 HOTCLIP_LLM_API_KEY;模型与桌面 App 共享,下载一次三边(桌面/CLI/MCP)可用。

技术栈

Electron + React 19 + TypeScript + Tailwind 4 · ffmpeg(打包内置,无需自装)· sherpa-onnx 本地转写 + 说话人分离 · libass 卡拉OK逐字字幕 + 离屏 Chromium 气泡特效字幕引擎 · LLM 爆点检测(Atlas Cloud / 本地 Ollama / 任意 OpenAI 兼容接口,BYO Key)

站在这些开源项目的肩膀上

项目 在 HotClip 中的角色
sherpa-onnx 本地语音识别运行时(纯 CPU 可跑)
SenseVoice / FunASR 五语种快速转写 / Paraformer 中文转写与标点
FireRedASR 最高精度档:普通话/方言/中英混说
pyannote-audio + 3D-Speaker 说话人分离(本地零上传)
FFmpeg + libass 帧精确切割 / 字幕烧录
onnxruntime 端侧模型推理

常见问题

有什么免费的 AI 切片 / AI 剪辑软件? HotClip 就是——免费开源(AGPL-3.0)、本地运行的 AI 剪辑 / 视频切片工具,把长视频、直播回放一键切成竖屏短视频,无水印、无积分制、不限时长,Windows / macOS 都有安装包。

HotClip 是免费的吗? 是。开源(AGPL-3.0)、本地运行、无水印、无积分制。可选的云端大模型按你自己的 Key 计费。

AI 剪辑会上传我的视频吗?需要联网吗? 不上传。转写、字幕、切片、导出全程在你自己的电脑上离线完成。只有「AI 找爆点」这一步默认调用云端大模型(只发文字稿,用你自己的 Key),不想联网可以接本机 Ollama——那就 100% 离线。

怎么把直播回放 / 播客一键剪成抖音、B站短视频? 导入文件 → AI 转写并自动识别高光片段(可手动增删调边界)→ 一键导出竖屏 9:16 成片,自带字幕、标题贴片和封面图,直接上传抖音 / 快手 / B站 / 视频号 / 小红书。

能自动加字幕吗? 能。逐字点亮的动态字幕(卡拉OK式)直接烧进画面,也可以导出 SRT 字幕文件给平台原生上传;开双语字幕还能整句翻译烧成第二行。

能自动剪掉口播里的停顿和口头禅吗? 能。「剪气口」自动删掉说话间的静音停顿(去气口),「剪口头禅」剪掉嗯/呃与结巴重复——剪了什么逐条写进 clips.json,你始终知道 AI 动了哪里。

HotClip 和剪映 / OpusClip / Klap 这类工具的区别? 最大区别是素材不出你的电脑:OpusClip 等 SaaS 必须上传云端、按源视频分钟扣积分(积分月底清零),免费档带水印;剪映的智能切片等核心能力在会员档。HotClip 开源免费、本地处理、无水印、不限时长,AI 切点还附理由可审计。详见上方对比表

支持中文视频吗? 支持。中文识别走专用引擎(SenseVoice/Paraformer 一类),准确率显著高于通用模型;界面、字幕、prompt 都针对中文内容做了适配。

需要显卡吗? 不需要。本地转写用的是 int8 量化的 SenseVoice 小模型,普通 CPU 就能跑;找爆点的大模型在云端(或你本机的 Ollama)。

授权与边界

  • 代码:AGPL-3.0-only
  • HotClip 面向你自己的内容已获授权的切片(如主播切片授权计划)。请遵守各平台二创与授权规则——未经授权的影视/直播搬运不受支持,也不欢迎。

社区

同作者项目

🔨 ClipForge — 开源 AI 带货短视频神器:上传一张商品图,AI 提炼卖点、写种草脚本、配画面配音字幕,一键产出抖音小店/快手/小红书/TikTok Shop 卖货视频。HotClip 把长视频切成爆款,ClipForge 从一张图造出短视频——做电商/带货的朋友可以配着用。

Star History Chart

⭐ 觉得有用就点个 Star——新版本发布时你会第一时间看到。