YouTube Transcript Extractor logo

YouTube Transcript Extractor

打开

Tapestry 系列中的 YouTube 字幕 Skill:用 yt-dlp 下载字幕,没有字幕时在本地用 Whisper 转写,最后输出去重后的纯文本,便于阅读和交给 Claude 分析。

分享:
查看替代方案

YouTube 字幕提取

youtube-transcript Skill 属于 Tapestry Skills for AI Agents(MIT,署名"Tapestry Skills Contributors"),这是一组面向 Claude Code 的学习与效率 Skill。它只做一件事:给定 YouTube 链接,拿到 .vtt 字幕文件或干净的纯文本。总结和行动计划来自同一仓库里的其他 Skill,而不是它本身。我们在 2026-09-23 查看时,仓库最新提交日期为 2026-03-11。

核心功能

  • 有序回退:先检查是否安装了 yt-dlp(没有则尝试用 Homebrew、apt 或 pip 安装),用 yt-dlp --list-subs 列出可用字幕,优先下载人工字幕(--write-sub),再退而下载自动生成字幕(--write-auto-sub)。
  • Whisper 兜底:如果完全没有字幕,Skill 会先显示预计的音频大小并征求同意再下载;安装 openai-whisper 前也会再次询问,然后用 base 模型在本地转写,完成后询问是否删除音频。
  • 去重:YouTube 自动字幕因为逐步显示会出现重复行。一段简短的 Python 处理会去掉时间戳和标签、解码 HTML 实体,并在保持说话顺序的前提下删除重复行。
  • 可读文件名:输出文件按视频标题命名,并替换 /、: 等字符。

适用场景

  • 把一场演讲或教程转成文字,方便 Claude 引用或总结。
  • 存档访谈内容,以后可以全文搜索。
  • 作为同仓库 learn-this 或 ship-learn-next Skill 的输入,把内容变成行动计划。

定价与获取

MIT 许可,免费。yt-dlp 和 Whisper 都是免费开源工具;Whisper 在本机运行,没有 API 费用,但模型需要磁盘空间(Skill 中写的 base 约 1 GB)。

快速开始

  1. 克隆 https://github.com/michalparkola/tapestry-skills-for-claude-code 并运行 ./install.sh,或把 youtube-transcript 文件夹复制到 ~/.claude/skills/。
  2. 打开 Claude Code,说:"Download the transcript for https://www.youtube.com/watch?v=VIDEO_ID"。
  3. 只有视频没有字幕时,才需要确认 Whisper 转写提示。

局限:私密、年龄限制或地区限制的视频会因 yt-dlp 报错而失败。自动字幕和较小的 Whisper 模型可能听错人名和专业术语。去重步骤也会删掉本来就该重复的句子。复用文字时请尊重视频作者的权利。

常见问题

它会总结视频内容吗?

不会。它只保存字幕;之后可以让 Claude 总结文本,或使用仓库里的 learn-this Skill。

能拿到哪种语言?

取决于视频提供了哪些字幕轨。--list-subs 会列出来,Whisper 可以自动识别语言,也可以用 --language 指定。

替代方案

  • Whisper V3:开源权重语音模型,可用于更大、更准确的本地转写。
  • MarkItDown Skill:其 youtube-transcription 扩展可以把 YouTube 链接转成 Markdown。
  • NotebookLM:直接把视频添加为资料来源并提问,无需自己处理字幕。

总结

YouTube Transcript Extractor 是在 Claude Code 里把视频变成文字的实用本地方案,回退逻辑合理,大文件下载前会先确认。它本身不分析内容。更多内容工具见 Skills 分类。

评论

还没有评论。成为第一个评论的人!