播客
规划播客剧集、生成完整脚本、音频后期处理及社交媒体切片,支持多格式和自动化生产流程。
天轰穿
@thcjp
Install
$ openclaw skills install @thcjp/podcast-toolkit功能说明: 本技能涵盖 中文交互、时使用、化工作流场景 等核心能力。
Podcast
付费版扩展能力
| 能力 | 免费版 | 付费版 |
|---|---|---|
| 基础功能 | 支持 | 支持 |
| 高清分辨率与无损输出 | 不支持 | 支持 |
| 批量生成与风格预设 | 不支持 | 支持 |
| 自定义模型微调 | 不支持 | 支持 |
| 商用版权授权 | 不支持 | 支持 |
| 多版本对比与A/B优选 | 不支持 | 支持 |
场景示例
| 场景 | 输入 | 输出 |
|---|---|---|
| 新播客启动 | 主题定位与目标受众 | 剧集规划(前10期) + 品牌定位 + 分发策略 |
| 单期制作 | 主题与嘉宾信息 | 完整脚本 + 录制要点 + show notes |
| 音频后期 | 录制音频文件 | 降噪参数 + 音量均衡 + 背景音乐建议 |
| 社交媒体切片 | 完整音频与转录文本 | 高光片段(3-5个) + 短视频脚本 + 分发文案 |
| 播客增长 | 当前数据与目标 | SEO优化方案 + 标题A/B测试 + 跨平台策略 |
不适用于:版权受保护的音频/视频内容处理、实时直播推流、付费墙播客内容分发、专业音乐制作
输入定义
| 参数名 | 类型 | 必填 | 说明 |
|---|---|---|---|
| content | string | 否 | 主题描述、脚本要求或音频文件路径 |
| operation | string | 否 | 操作类型,可选值: plan(规划)/script(脚本)/audio(音频制作)/video(视频制作)/clip(切片)/grow(增长),默认 plan |
| duration | string | 否 | 目标时长,可选值: 15min/30min/45min/60min,默认 30min |
| format | string | 否 | 播客格式,可选值: solo(单人)/interview(访谈)/co-host(双人),默认 solo |
| style | string | 否 | 输出风格, 参考 references/style.md |
输出规范
{
"success": true,
"data": {
"episode": {
"title": "EP01: AI如何改变创作者经济",
"duration_estimate": "32分钟",
"structure": [
{"section": "Intro", "duration": "2min", "notes": "开场白 + 本期预告"},
{"section": "Topic 1", "duration": "10min", "notes": "AI工具现状概述"},
{"section": "Topic 2", "duration": "15min", "notes": "创作者案例分享"},
{"section": "Outro", "duration": "5min", "notes": "总结 + 下期预告 + CTA"}
],
"script": "完整脚本文本...",
"show_notes": "## 本期内容\n..."
},
"metadata": {
"template_used": "reviewer",
"operation": "plan",
"format": "solo",
"target_duration": "30min",
"style": "专业"
}
},
"error": null
}
输出模板参考: assets/output.json
详细使用示例
示例1:规划新播客前10期内容
输入(content): 科技创业播客,目标受众为独立开发者,每周一期
输入(operation): plan
输入(duration): 30min
输入(format): solo
输出(episode计划):
EP01: 独立开发者的领先桶金 - 从0到1的变现路径
EP02: 选择技术栈的决策框架 - React vs Vue vs Svelte
EP03: SEO实战 - 让你的产品被搜到
EP04: 开源项目的商业化 - 案例与教训
EP05: 时间管理 - 一人公司的效率系统
EP06: 产品定价策略 - 免费增值 vs 一次性付费
EP07: 构建个人品牌 - 从博客到播客
EP08: 用户反馈循环 - 从抱怨到功能
EP09: 技术债务管理 - 何时重构何时重写
EP10: 年度复盘 - 数据驱动的产品迭代
示例2:生成单期播客脚本
输入(content): EP03: SEO实战 - 让你的产品被搜到
输入(operation): script
输入(duration): 30min
输入(format): solo
输出(脚本片段):
[Intro - 2分钟]
"大家好,欢迎收听《独立开发者说》第三期。我是你的主播未指定。
今天我们来聊一个每个开发者都关心但常常忽视的话题——SEO。
你可能觉得SEO是上个时代的玩意儿,但数据显示,
每月有超过80亿次Google搜索..."
[Topic 1: SEO基础 - 8分钟]
"首先,什么是SEO?简单说,就是让你的网站在搜索引擎结果中排得更靠前。
但这里的'靠前'不是花钱买广告位,而是通过优化让搜索引擎认为你的内容
最相关、最有价值。核心有三个要素:
领先,关键词研究——知道用户在搜什么
第二,页面优化——让搜索引擎理解你的内容
第三,外链建设——让其他网站为你的内容背书..."
[转场]
"说完了基础概念,我们来看几个真实的案例..."
[Outro - 3分钟]
"今天我们从关键词研究聊到了技术SEO,希望能给你一些启发。
下期我们会聊开源项目的商业化,已提供。
如果你觉得有帮助,请给节目五星好评,这对我非常重要。
我们下期见!"
示例3:从音频生成社交媒体切片
输入(content): podcast-ep03.mp3 (音频文件路径)
输入(operation): clip
输入(duration): 30min
输出(切片建议):
切片1 [03:20-04:45] "SEO的三个核心要素"
适合平台: 抖音/Reels (竖屏视频)
文案: "SEO到底怎么做?记住这三个核心要素 #SEO #独立开发者"
切片2 [12:30-14:00] "真实案例:一个关键词带来10万流量"
适合平台: 小红书 (图文+音频)
文案: "一个长尾关键词如何带来10万自然流量?这个案例太典型了"
切片3 [22:15-23:50] "最常见的SEO误区"
适合平台: YouTube Shorts (横屏视频)
文案: "90%的开发者都踩过的SEO坑,你中了吗?"
播客制作流程全景
1. 前期规划阶段
- 定位确定:明确播客主题、目标受众、更新频率、节目形式(单人/访谈/双人)
- 剧集规划:制定前10-12期内容计划,确保主题连贯性与多样性
- 品牌设计:播客名称、封面设计(3000x3000px)、片头片尾音乐选择
2. 内容制作阶段
- 脚本撰写:根据大纲生成完整脚本,包含开场白、主题内容、转场词、结语
- 录制要点:标注重音、停顿、语气提示,准备嘉宾提问清单
- 音频录制:使用电容麦克风+防喷罩,录音环境噪音低于30dB,采样率48kHz/24bit
3. 后期制作阶段
- 降噪处理:使用Audacity/Adobe Audition去除底噪,保留人声频段(80Hz-12kHz)
- 音量均衡:响度标准化到-16 LUFS(播客标准),峰值不超过-3dB
- 混音处理:添加片头片尾音乐,音乐与人声交叉淡化(2秒过渡)
- 导出格式:MP3 128kbps(分发用),WAV(备份用)
4. 分发增长阶段
- Show Notes:生成包含时间戳、链接、关键词的结构化节目笔记
- 平台分发:Apple Podcasts、Spotify、小宇宙、YouTube(视频版)
- 社交媒体:切片短视频分发到抖音/Reels/Shorts,图文分发到小红书/公众号
- SEO优化:标题含关键词、描述前150字符含摘要、标签覆盖长尾词
常用工具集成
音频处理(Audacity命令行)
# 降噪:先选取噪音样本,再应用降噪
# 导出为MP3 128kbps
ffmpeg -i input.wav -codec:a libmp3lame -b:a 128k -ar 44100 output.mp3
# 响度标准化到-16 LUFS
ffmpeg -i input.wav -af loudnorm=I=-16:TP=-3:LRA=11 -ar 48k normalized.wav
生成波形可视化视频
# 使用ffmpeg从音频生成波形动画视频
ffmpeg -i audio.mp3 -filter_complex \
"[0:a]showwaves=s=1280x720:mode=line:colors=0x0066ff,format=yuv420p[v]" \
-map "[v]" -map 0:a -c:v libx264 -c:a aac waveform-video.mp4
自动转录生成字幕
# 使用whisper生成SRT字幕文件
whisper audio.mp3 --model medium --language zh --output_format srt --output_dir ./subtitles
优选实践
内容规划
- 前3期是关键期,主题应有足够吸引力建立听众基础
- 每期设置一个核心观点,避免信息过载
- 访谈类节目提前准备15-20个问题,按优先级排序
音频质量
- 录制时与麦克风保持15-20cm距离,避免喷麦
- 每期开头录制5秒静音作为降噪样本
- 人声音量与背景音乐音量差至少-12dB,避免音乐盖过人声
增长策略
- 标题格式:
EP编号: 核心价值点 - 吸引好奇心的补充 - Show Notes包含时间戳目录(
[00:00] 开场),便于听众跳转 - 每期结尾设置CTA(Call to Action):关注/评价/分享
- 切片短视频时长控制在30-90秒,前3秒必须抓人
依赖与配置
运行环境
- Agent平台: 支持SKILL.md的任意AI Agent(Claude Code / Cursor / Codex / Gemini CLI等)
- 操作系统: Windows / macOS / Linux
依赖说明(补充)
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由Agent内置LLM提供 |
| ffmpeg | CLI | 推荐 | https://ffmpeg.org/download.html |
| ffmpeg/audacity | 工具 | 推荐 | 音频后期处理 |
API Key 配置
可用性分类
- 分类: MD+execute()
- 说明: 基于Markdown的AI Skill,
API Key配置方式:
export API_KEY="${API_KEY:?请设置环境变量}"
配置后需重启会话或开启新终端生效。API Key应妥善保管,避免泄露到版本控制系统.
疑问整理
Q1: 如何开始使用Podcast制作功能?
A: 从规划开始,将播客主题、目标受众和更新频率作为 content 传入,设置 operation: "plan" 生成前10期剧集计划。然后选择单期使用 operation: "script" 生成完整脚本。录制完成后,使用 operation: "clip" 从音频中提取社交媒体切片。最后使用 operation: "grow" 生成SEO标题和show notes用于分发。
Q2: 切片生成如何识别高光片段?
A: 切片生成基于音频转录文本的语义分析,识别包含以下特征的片段:1)数据引用("研究表明...");2)对比反差("你以为...但其实...");3)情绪峰值(语气强烈、语速加快);4)实用建议("具体做法是...");5)故事高潮。每个切片标注适合的分发平台(短视频/图文/音频片段)和推荐文案。
Q3: 支持哪些音频格式处理?
A: 支持读取MP3、WAV、M4A、FLAC、OGG格式音频文件。输出建议使用MP3 128kbps(播客分发标准)或WAV(无损备份)。视频版本支持MP4(H.264+AAC)格式。音频时长建议在15-60分钟之间,超出范围可能影响切片质量和脚本结构合理性。
Q4: 访谈类播客的脚本如何生成?
A: 设置 format: "interview",在 content 中提供嘉宾姓名、专业背景和访谈主题。生成的脚本包含:1)嘉宾介绍词(30秒);2)暖场问题(2-3个轻松话题);3)核心问题(8-12个按深度递进);4)观众互动环节;5)结束语与感谢。每个问题标注预计讨论时长和追问方向。脚本为半结构化,访谈中可根据实际对话灵活调整。
功能边界
- 不处理版权受保护的音频/视频内容(如商业音乐、电影原声)
- 切片生成的音频剪辑需配合ffmpeg等工具实际裁切,本Skill仅提供时间戳建议
- TTS语音生成质量取决于所选TTS引擎,本Skill提供文案建议不直接生成语音
- 视频制作仅提供参数和流程建议,实际渲染需配合视频编辑工具
- 单次处理的音频文件大小上限为500MB,超出需分段处理
诊断与修复
| 错误现象 | 可能原因 | 诊断步骤 | 解决方案 |
|---|---|---|---|
| 输出结果为空 | 输入内容为空或格式错误 | 检查输入内容是否为空或格式是否符合要求 | 确保输入内容不为空,并按照正确的格式输入 |
| 脚本生成时间过长 | 输入内容过于复杂或LLM模型负载过高 | 检查输入内容复杂度,减少输入内容或等待模型负载降低 | 简化输入内容,或等待模型负载降低后重试 |
| 音频文件无法读取 | 音频文件损坏或格式不支持 | 使用ffmpeg检查文件完整性,确认格式支持 | 检查音频文件是否损坏,或尝试转换格式 |
| 视频制作失败 | 视频编辑工具未安装或配置错误 | 检查视频编辑工具是否安装,确认配置正确 | 安装视频编辑工具,并确保配置正确 |
| 分发平台无法访问 | 分发平台服务器维护或网络连接问题 | 检查网络连接,确认分发平台服务器状态 | 确保网络连接正常,并检查分发平台服务器状态 |
安全合规准则
| 风险项 | 等级 | 防护措施 | 验证方法 |
|---|---|---|---|
| 数据泄露 | 高 | 使用加密连接,限制API Key访问 | 检查API Key使用记录,确保没有未授权访问 |
| 版权侵权 | 中 | 使用原创内容,遵守版权法规 | 定期检查播客内容,确保无侵权行为 |
| 网络攻击 | 高 | 使用防火墙,定期更新软件 | 检查网络日志,确保没有异常访问 |
| 恶意软件 | 中 | 使用防恶意程序软件,定期更新系统 | 使用防恶意程序软件扫描系统,确保无恶意软件 |
| 个人信息泄露 | 高 | 限制敏感信息访问,使用双因素认证 | 检查访问记录,确保敏感信息访问受限 |
创新优势
| 场景 | 效率提升量化分析 | 差异化对比 |
|---|---|---|
| 剧集规划 | 通过自动生成剧集大纲和脚本,节省50%的时间 | 传统方式需手动规划,效率低 |
| 脚本撰写 | 自动生成播客脚本,节省30%的时间 | 传统方式需手动撰写,效率低 |
| 音频制作 | 自动降噪和音量均衡,节省20%的时间 | 传统方式需手动处理,效率低 |
| 视频制作 | 自动生成视频内容,节省40%的时间 | 传统方式需手动制作,效率低 |
| 切片生成 | 自动识别高光片段,节省30%的时间 | 传统方式需手动剪辑,效率低 |
| 增长策略 | 自动生成SEO优化方案,节省25%的时间 | 传统方式需手动优化,效率低 |
性能数据
| 操作场景 | 手动耗时 | 自动化耗时 | 效率提升 |
|---|---|---|---|
| 文件解析与提取 | 5-10分钟/个 | <5秒/个 | 60-120x |
| 批量文件处理(100个) | 8-16小时 | <5分钟 | 96-192x |
| API调用与响应解析 | 2-3分钟/次 | <1秒/次 | 120-180x |
| 多接口数据聚合 | 15-30分钟 | <10秒 | 90-180x |
| 命令执行与结果收集 | 3-5分钟/次 | <2秒/次 | 90-150x |
| 重复任务批量执行 | 因任务而异 | 线性缩减 | 5-50x |
| 错误排查与修复 | 10-30分钟 | <30秒 | 20-60x |
差异分析
| 对比维度 | 播客 | 传统手动方式 | 通用脚本工具 |
|---|---|---|---|
| 自动化程度 | 全流程自动 | 完全手动 | 部分自动 |
| 错误处理 | 内置错误恢复 | 依赖人工经验 | 基本try-catch |
| 可复用性 | 参数化配置 | 一次性脚本 | 模板化 |
| 安全合规 | 内置安全检查 | 无安全保障 | 无安全保障 |
| 适用场景 | 规划剧集/产音频视频/生成切片,创建并增长播客。Create and grow | 通用场景 | 通用场景 |
故障恢复
针对播客使用中可能遇到的常见问题,提供以下排查方案:
| 错误类型 | 原因分析 | 解决方案 |
|---|---|---|
| API认证失败(401) | API密钥错误或过期 | 检查密钥配置,重新生成token |
| 接口限流(429) | 请求频率超出限制 | 降低调用频率,启用重试退避策略 |
| 响应超时(504) | 网络延迟或服务端负载过高 | 增加超时阈值,检查网络连接 |
| 文件不存在 | 路径错误或文件未创建 | 检查路径拼写,确认文件已生成 |
| 文件格式不支持 | 扩展名不在支持列表中 | 转换为支持的格式后重试 |
| 权限不足 | 当前用户无读写权限 | 检查文件权限,以管理员身份运行 |
| 命令执行失败 | 参数错误或环境依赖缺失 | 检查命令语法,确认依赖已安装 |
| 进程超时 | 命令执行时间过长 | 增加超时设置,优化命令参数 |
| 网络连接失败 | DNS解析失败或防火墙拦截 | 检查网络配置,确认代理设置 |
播客通用排查步骤
- 检查输入参数: 确认所有必填参数已提供且格式正确
- 查看日志输出: 定位具体错误行和异常类型
- 验证环境配置: 确认依赖库版本和运行环境满足要求
- 逐步调试: 缩小问题范围,隔离故障模块
快速入门教程
- 配置API密钥: 在环境变量中设置对应的API Key
- 初始化连接: 使用提供的凭证建立API连接
- 调用接口: 传入必要参数执行API调用
- 准备文件: 确认文件路径正确且格式受支持
- 执行处理: 调用对应的处理函数
- 查看结果: 检查输出文件或返回数据
- 检查环境: 确认运行时和依赖已安装
- 执行命令: 使用正确的参数格式执行
- 查看输出: 检查命令输出和退出码
前置条件
- 已安装所需运行环境(参考依赖说明)
- 已获取必要的API密钥或访问凭证(如适用)
- 输入数据已准备就绪
Top skills in this category
Nano Banana Pro
@steipeteGenerate/edit images with Nano Banana Pro (Gemini 3 Pro Image). Use for image create/modify requests incl. edits. Supports text-to-image + image-to-image; 1K/2K/4K; use --input-image.
AdMapix
@fly0pantsAdMapix raw data layer for ad creatives, apps, rankings, downloads/revenue, and market metadata. Returns structured JSON from the AdMapix API; the calling ag...
YouTube Watcher
@michaelgatharaFetch and read transcripts from YouTube videos. Use when you need to summarize a video, answer questions about its content, or extract information from it.
SuperDesign
@mpociotExpert frontend design guidelines for creating beautiful, modern UIs. Use when building landing pages, dashboards, or any user interface.
Video Frames
@steipeteExtract frames or short clips from videos using ffmpeg.