YouTube 字幕提取
youtube-transcript Skill 属于 Tapestry Skills for AI Agents(MIT,署名"Tapestry Skills Contributors"),这是一组面向 Claude Code 的学习与效率 Skill。它只做一件事:给定 YouTube 链接,拿到 .vtt 字幕文件或干净的纯文本。总结和行动计划来自同一仓库里的其他 Skill,而不是它本身。我们在 2026-09-23 查看时,仓库最新提交日期为 2026-03-11。
核心功能
- 有序回退:先检查是否安装了 yt-dlp(没有则尝试用 Homebrew、apt 或 pip 安装),用
yt-dlp --list-subs列出可用字幕,优先下载人工字幕(--write-sub),再退而下载自动生成字幕(--write-auto-sub)。 - Whisper 兜底:如果完全没有字幕,Skill 会先显示预计的音频大小并征求同意再下载;安装
openai-whisper前也会再次询问,然后用base模型在本地转写,完成后询问是否删除音频。 - 去重:YouTube 自动字幕因为逐步显示会出现重复行。一段简短的 Python 处理会去掉时间戳和标签、解码 HTML 实体,并在保持说话顺序的前提下删除重复行。
- 可读文件名:输出文件按视频标题命名,并替换
/、:等字符。
适用场景
- 把一场演讲或教程转成文字,方便 Claude 引用或总结。
- 存档访谈内容,以后可以全文搜索。
- 作为同仓库
learn-this或ship-learn-nextSkill 的输入,把内容变成行动计划。
定价与获取
MIT 许可,免费。yt-dlp 和 Whisper 都是免费开源工具;Whisper 在本机运行,没有 API 费用,但模型需要磁盘空间(Skill 中写的 base 约 1 GB)。
快速开始
- 克隆
https://github.com/michalparkola/tapestry-skills-for-claude-code并运行./install.sh,或把youtube-transcript文件夹复制到~/.claude/skills/。 - 打开 Claude Code,说:"Download the transcript for https://www.youtube.com/watch?v=VIDEO_ID"。
- 只有视频没有字幕时,才需要确认 Whisper 转写提示。
局限:私密、年龄限制或地区限制的视频会因 yt-dlp 报错而失败。自动字幕和较小的 Whisper 模型可能听错人名和专业术语。去重步骤也会删掉本来就该重复的句子。复用文字时请尊重视频作者的权利。
常见问题
它会总结视频内容吗?
不会。它只保存字幕;之后可以让 Claude 总结文本,或使用仓库里的 learn-this Skill。
能拿到哪种语言?
取决于视频提供了哪些字幕轨。--list-subs 会列出来,Whisper 可以自动识别语言,也可以用 --language 指定。
替代方案
- Whisper V3:开源权重语音模型,可用于更大、更准确的本地转写。
- MarkItDown Skill:其
youtube-transcription扩展可以把 YouTube 链接转成 Markdown。 - NotebookLM:直接把视频添加为资料来源并提问,无需自己处理字幕。
总结
YouTube Transcript Extractor 是在 Claude Code 里把视频变成文字的实用本地方案,回退逻辑合理,大文件下载前会先确认。它本身不分析内容。更多内容工具见 Skills 分类。
评论
还没有评论。成为第一个评论的人!
相关工具
相关洞察

Anthropic Subagent:多智能体时代的架构革命
深入解析 Anthropic 的多智能体架构设计。了解如何通过 Subagent 突破上下文窗口限制,实现性能提升 90%,以及多智能体系统在 Claude Code 中的实际应用。
按仓库任务选 AI 编程 CLI
按你真正要跑的工作,在 Claude Code、Codex CLI、OpenCode、Pi、omp、DeepSeek Harness 与 Grok Build 之间选择。2026-10-06 对照官方文档复核。
Skills + Hooks + Plugins:Anthropic 如何重新定义 AI 编程工具的扩展性
深入解析 Claude Code 的 Skills、Hooks 和 Plugins 三位一体架构,探讨为什么这种设计比 GitHub Copilot 和 Cursor 更先进,以及它如何通过开放标准重新定义 AI 编程工具的扩展性。