我的口播视频字幕skill打磨得比较满意了 功能还不少,基本上skill怼着视频文件跑完,字幕(无需再手动调整)、章节标题、花字都有了。有需要的么?
我的口播视频字幕skill打磨得比较满意了
完整原文、主题、复核、脑图、原子层、关系网络与处理轨迹。
我的口播视频字幕skill打磨得比较满意了
这条记录讲了什么
我的口播视频字幕skill打磨得比较满意了 功能还不少,基本上skill怼着视频文件跑完,字幕(无需再手动调整)、章节标题、花字都有了。有需要的么? 一、转写 - 本地 ASR:FunASR + token 级时间戳,全程离线,按内容哈希缓存 - 单视频 / 整目录:目录模式按创建时间接成一条时间轴,只出一个字幕 - 排序防错:优先读 creation_time,缺就整体退回 birthtime;--dry-run 先核对顺序 - manifest.json:记录视频顺序与时间偏移 二、说话人分离 - 双声道自动分轨:一人一个麦时两轨各转一遍,…
后续动作
| 动作 | 状态 | 来源 |
|---|---|---|
| dry-run 先核对顺序 | 待继续 | p02 |
| 单视频 / 整目录:目录模式按创建时间接成一条时间轴,只出一个字幕 | 待确认 | p02 |
| .uncertain.srt 待确认字幕:没把握改的地方 + 候选改法 | 待确认 | p02 |
查看完整 AI 结构化导读按需展开
关键导读
先把有效信息集中到顶部:一句话总览、编号要点、待办与历史呼应。完整正文与结构化数据在下方展开。
一句话总览
我的口播视频字幕skill打磨得比较满意了 功能还不少,基本上skill怼着视频文件跑完,字幕(无需再手动调整)、章节标题、花字都有了。有需要的么? 一、转写 - 本地 ASR:FunASR + token 级时间戳,全程离线,按内容哈希缓存 - 单视频 / 整目录:目录模式按创建时间接成一条时间轴,只出一个字幕 - 排序防错:优先读 creation_time,缺就整体退回 birthtime;--dry-run 先核对顺序 - manifest.json:记录视频顺序与时间偏移 二、说话人分离 - 双声道自动分轨:一人一个麦时两轨各转一遍,…
关键洞见
- 排序防错:优先读 creation_time,缺就整体退回 birthtime
- .highlights.srt 花字:章节小标题 + 关键重点提示
- 我的口播视频字幕skill打磨得比较满意了
- 功能还不少,基本上skill怼着视频文件跑完,字幕(无需再手动调整)、章节标题、花字都有了
- 本地 ASR:FunASR + token 级时间戳,全程离线,按内容哈希缓存
优先级分层
- 高:排序防错:优先读 creation_time,缺就整体退回 birthtime
- 高:-dry-run 先核对顺序
- 高:.uncertain.srt 待确认字幕:没把握改的地方 + 候选改法
待办动作
- 排序防错:优先读 creation_time,缺就整体退回 birthtime
- -dry-run 先核对顺序
- 单视频 / 整目录:目录模式按创建时间接成一条时间轴,只出一个字幕
- .uncertain.srt 待确认字幕:没把握改的地方 + 候选改法
- 功能还不少,基本上skill怼着视频文件跑完,字幕(无需再手动调整)、章节标题、花字都有了
单视频 / 整目录:目录模式按创建时间接成一条时间轴,只出一个字幕 排序防错:优先读 creation_time,缺就整体退回 birthtime manifest.json:记录视频顺序与时间偏移
一、转写 - 本地 ASR:FunASR + token 级时间戳,全程离线,按内容哈希缓存 - 单视频 / 整目录:目录模式按创建时间接成一条时间轴,只出一个字幕 - 排序防错:优先读 creation_time,缺就整体退回 birthtime;--dry-run 先核对顺序 - manifest.json:记录视频顺序与时间偏移 二、说话人分离 - 双声道自动分轨:一人一个麦时两轨各转一遍,声道号即说话人号 - 硬静音压串音:本轨没对方响的帧直接置零 - 串音清理三道:整句是对方的丢掉、两轨重复的去弱留强、agent 跨轨互校补漏 - 声纹分离 --speakers:单声道素材用,一条字幕只装一个人的话 - 抢话合成两行:两人同时说时上下两行 三、纠错(默认只纠错、不改写) - 同音近音错字:有把握才改,拿不准保留原文 - 专有名词:自带术语表 + 上下文推断,全片一致 - 连续重复去重:规则 + agent 复核,放过合法重复 - 年份换阿拉伯数字:一九年→19年,时长不动 - 中英文补空格:数字 + 时间单位除外 - 语气词全保留,clean 级别才去水词 四、排版 - 单行 16 个中文硬上限:英文数字算半宽 - 等宽切分:26 字切 13+13,不劈开英文单词 - 渲染前兜底:仍超宽的按 token 边界拆条 - 时间轴清理:消重叠、补最短时长、砍超长尾巴 五、交付物 - .srt 正片 / .raw.srt ASR 原文 / .spk1+.spk2 分轨对照 - .uncertain.srt 待确认字幕:没把握改的地方 + 候选改法 - .highlights.srt 花字:章节小标题 + 关键重点提示 - .review.srt + .review.md 敏感/冒犯审查:四类分高中低,宁多勿漏 #视频剪辑[话题]# #剪映[话题]# #口播视频[话题]# #播客剪辑[话题]# #访谈实录[话题]# #自媒体工具[话题]# #效率工具[话题]# #视频合规[话题]# 我的口播视频字幕skill打磨得比较满意了 功能还不少,... https://xhslink.cn/o/6PHpJttrTUg 这篇内容在【小红书】候着你~ resolved_url: https://www.xiaohongshu.com/explore/6a88032900000000050172cf xhs_capture_status: success
归档文档完整内容 · 含智能总结与原始标记
我的口播视频字幕skill打磨得比较满意了 功能还不少,基本上skill怼着视频文件跑完,字幕(无需再手动调整)、章节标题、花字都有了。有需要的么? 一、转写 - 本地 ASR:FunASR + token 级时间戳,全程离线,按内容哈希缓存 - 单视频 / 整目录:目录模式按创建时间接成一条时间轴,只出一个字幕 - 排序防错:优先读 creation_time,缺就整体退回 birthtime;--dry-run 先核对顺序 - manifest.json:记录视频顺序与时间偏移 二、说话人分离 - 双声道自动分轨:一人一个麦时两轨各转一遍,声道号即说话人号 - 硬静音压串音:本轨没对方响的帧直接置零 - 串音清理三道:整句是对方的丢掉、两轨重复的去弱留强、agent 跨轨互校补漏 - 声纹分离 --speakers:单声道素材用,一条字幕只装一个人的话 - 抢话合成两行:两人同时说时上下两行 三、纠错(默认只纠错、不改写) - 同音近音错字:有把握才改,拿不准保留原文 - 专有名词:自带术语表 + 上下文推断,全片一致 - 连续重复去重:规则 + agent 复核,放过合法重复 - 年份换阿拉伯数字:一九年→19年,时长不动 - 中英文补空格:数字 + 时间单位除外 - 语气词全保留,clean 级别才去水词 四、排版 - 单行 16 个中文硬上限:英文数字算半宽 - 等宽切分:26 字切 13+13,不劈开英文单词 - 渲染前兜底:仍超宽的按 token 边界拆条 - 时间轴清理:消重叠、补最短时长、砍超长尾巴 五、交付物 - .srt 正片 / .raw.srt ASR 原文 / .spk1+.spk2 分轨对照 - .uncertain.srt 待确认字幕:没把握改的地方 + 候选改法 - .highlights.srt 花字:章节小标题 + 关键重点提示 - .review.srt + .review.md 敏感/冒犯审查:四类分高中低,宁多勿漏 #视频剪辑[话题]# #剪映[话题]# #口播视频[话题]# #播客剪辑[话题]# #访谈实录[话题]# #自媒体工具[话题]# #效率工具[话题]# #视频合规[话题]# 我的口播视频字幕skill打磨得比较满意了 功能还不少,... https://xhslink.cn/o/6PHpJttrTUg 这篇内容在【小红书】候着你~ resolved_url: https://www.xiaohongshu.com/explore/6a88032900000000050172cf xhs_capture_status: success
思维导图
这里不再用摘要卡片伪装脑图,而是直接用经典 mindmap 组件来展示结构。点击分支会跳到正文。
点击节点会定位到正文,方便一边看脑图一边回看原文。
完整主题结构
2 个主题、8 个复核单元;全部保留原文锚点。
归档结构化主题;完整分支见上方思维导图。
归档结构化主题;完整分支见上方思维导图。
全部复核单元
原子结构层
主题 / 实体 / 概念三层标签 + 逐字原话 + 出链 / 反链。点击 chip 筛选。
资产与发布
转写
排序防错:优先读 creation_time,缺就整体退回 birthtime
.highlights.srt 花字:章节小标题 + 关键重点提示
我的口播视频字幕skill打磨得比较满意了
功能还不少,基本上skill怼着视频文件跑完,字幕(无需再手动调整)、章节标题、花字都有了
本地 ASR:FunASR + token 级时间戳,全程离线,按内容哈希缓存
这条录音的局部关系图
不用先跳到全局图。这里先把当前 capture 连到的 Topic / Entity / Day,以及共享这些节点的其他记录显出来。
单击右侧看详情;双击节点开浮层。这里只展示和当前录音直接相关的局部网络。
关联内容
只展示已有派生关系,不把自动相似度伪装成人工判断。
从这条 capture 派生出来的事项
点任意 item 可以继续看 gate / writeback / patch 的处理结果。
从 Capture《我的口播视频字幕skill打磨得比较满意了》保留问题:我的口播视频字幕skill打磨得比较满意了 功能还不少,基本上skill怼着视频文件跑完,字幕(无需再手动调整)、章节标题、花字都有了。有需要的么? 一、转写 - 本地 ASR:FunASR + token 级时间戳,全程离线,按内容哈
先在 clarify / merged 层保留这条内容,再提炼真实任务、状态与主题
从 Capture《我的口播视频字幕skill打磨得比较满意了》保留问题:我的口播视频字幕skill打磨得比较满意了 功能还不少,基本上skill怼着视频文件跑完,字幕(无需再手动调整)、章节标题、花字都有了。有需要的么? 一、转写 - 本地 ASR:FunASR + token 级时间戳,全程离线,按内容哈
先在 clarify / merged 层保留这条内容,再提炼真实任务、状态与主题
来源与处理轨迹
用于自动化排障与后续作品集历史回顾。