如果对你有用,请我喝杯咖啡~Please Sponsor,thanks! 开发该项目共使用 Token 价值~150 元
自动下载小宇宙播客音频并生成完整转录文本的 Claude Code Skill。
- 自动下载小宇宙播客音频和节目信息
- 使用 FunASR paraformer-zh 进行高质量中文语音识别
- Mac MPS (Metal) 加速,转录速度快 2-3 倍
- 自动合并 Show Notes 和完整转录文本
- 智能清理临时文件,节省存储空间
- 支持热词优化特定术语识别
- macOS (推荐 M1/M2/M3 芯片)
- Python 3.8+
- 约需 2GB 磁盘空间(用于 ASR 模型)
运行安装脚本检查并安装所有依赖:
~/.claude/skills/xiaoyuzhou-podcast/scripts/install.sh安装脚本会自动:
- 检测 Python 环境
- 安装 PyTorch (Metal 加速版)
- 安装 FunASR 和 ModelScope
- 安装 xyz-dl 下载工具
~/.claude/skills/xiaoyuzhou-podcast/scripts/process-podcast.sh <播客链接或ID>示例:
# 使用完整 URL
~/.claude/skills/xiaoyuzhou-podcast/scripts/process-podcast.sh \
https://www.xiaoyuzhoufm.com/episode/6942f3e852d4707aaa1feba3
# 使用 Episode ID
~/.claude/skills/xiaoyuzhou-podcast/scripts/process-podcast.sh 6942f3e852d4707aaa1feba3完整流程会:
- 下载音频和 Show Notes
- ASR 转录音频
- 合并文本到 README.md
- 自动清理临时文件
如果需要更细粒度的控制:
# 步骤 1: 下载
~/.claude/skills/xiaoyuzhou-podcast/scripts/download.sh <URL或ID>
# 步骤 2: 转录
python3 ~/.claude/skills/xiaoyuzhou-podcast/scripts/transcribe.py \
--audio ~/Podcasts/xiaoyuzhou/<ID>/.cache/audio.m4a
# 步骤 3: 合并和清理
~/.claude/skills/xiaoyuzhou-podcast/scripts/merge-and-clean.sh <ID>~/Podcasts/xiaoyuzhou/
└── {episode_id}/
└── README.md # 最终合并文档
每个 README.md 包含:
-
元数�� (YAML Front Matter)
- 标题、主播、时长
- 发布日期、音频链接
- Episode ID
-
Show Notes
- 节目简介
- 时间戳大纲
-
完整转录文本
- ASR 自动生成
- 中文准确度 > 90%
| 设备 | 1小时音频转录时间 | 加速比 |
|---|---|---|
| Mac M1/M2/M3 (MPS) | 18-30 分钟 | 2-3x |
| CPU | 45-60 分钟 | 1x |
- 模型: FunASR paraformer-zh
- 参数量: 220M
- 训练数据: 60,000 小时中文语音
- 模型大小: ~900MB (总计约 2GB,包含 VAD 和标点模型)
支持将转录文档同步到 Notion 数据库:
# 安装依赖
pip3 install notion-client
# 设置环境变量(推荐)
export NOTION_TOKEN="your-integration-token"
export NOTION_DATABASE_ID="your-database-id"
# 使用 Notion 同步
~/.claude/skills/xiaoyuzhou-podcast/scripts/process-podcast.sh <URL> --notion获取 Notion Token 和 Database ID:
-
Integration Token
- 访问 https://www.notion.so/my-integrations
- 创建新 Integration
- 复制 "Internal Integration Token"
-
Database ID
- 在 Notion 中打开目标数据库
- 点击右上角 "..." → "Copy link"
- URL 格式:
https://www.notion.so/{workspace}?v={view_id}&p={DATABASE_ID} - 复制 DATABASE_ID 部分(32位字符)
-
授权数据库
- 在 Notion 数据库页面点击 "..." → "Add connections"
- 选择你创建的 Integration
Notion 数据库建议字段:
- 标题
- 主播
- 发布日期
- 时长
- Episode URL (url)
提升特定术语识别准确度:
python3 scripts/transcribe.py \
--audio audio.m4a \
--hotword "投资 Fiserv 金融科技"根据内存调整批处理大小:
# 16GB 内存(默认)
--batch-size 300
# 32GB+ 内存(更快)
--batch-size 600检查 MPS 支持:
python3 -c "import torch; print(torch.backends.mps.is_available())"确保:
- Mac M1/M2/M3 设备
- macOS 最新版本
- PyTorch 2.0+
- 检查网络连接
- 确认可用磁盘空间 > 2GB
- 国内用户可能需要配置 ModelScope 镜像
优化建议:
- 确认启用了 MPS 加速
- 关闭其他资源密集应用
- 增加批处理大小(如果内存充足)
- xyz-dl: 小宇宙播客下载工具
- FunASR: 阿里达摩院语音识别框架
- PyTorch: 深度学习框架(Metal 加速)
- ModelScope: 模型管理和下载
��客 URL/ID
↓
xyz-dl 下载
↓
音频 + Show Notes (.cache/)
↓
FunASR 转录 (MPS 加速)
↓
合并到 README.md
↓
清理临时文件
↓
最终文档
- 仅供个人使用: 下载的内容和转录文本仅供个人学习
- 尊重版权: 支持创作者,通过官方渠道收听
- 平台条款: 遵守小宇宙平台的用户协议
- 合理使用: 避免频繁批量下载
-
中文 ASR 准确度约 90%+
-
可能受以下因素影响:
- 口音和方言
- 背景音乐或噪音
- 多人对话(无说话人分离)
- 专业术语
-
建议对关键内容人工校对
详细故障排查指南请参考:references/troubleshooting.md
- 初始版本发布
- 支持一键下载、转录、合并
- Mac MPS 加速支持
- 自动清理临时文件
欢迎提交 Issue 和 Pull Request!
MIT License
- xyz-dl - 小宇宙播客下载工具
- FunASR - 语音识别框架
- ModelScope - 模型平台
