AI播客生成-免费版
将PDF、文本、链接转为双人对话播客,适合个人创作者快速制作音频内容。Use when 需要文件处理、文档转换、格式互转、内容提取时使用。不适用于加密文件破解。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。
天轰穿
@thcjp
What This Skill Does
Converts PDFs, plain text, or URLs into a two-person conversational podcast using the MagicPodcast engine. Supports multiple languages (Chinese, English, Japanese, Korean) and outputs a shareable audio link.
Replaces manual audio recording and editing by automatically transforming written content into a natural dialogue between a host and a guest.
When to Use It
- Turn a blog post or article into a podcast for commuters
- Convert a PDF report into an audio format for hands-free learning
- Transform study notes into a spoken review session
- Create a shareable podcast from a web link without recording equipment
- Generate multilingual audio content from a single text source
Install
$ openclaw skills install @thcjp/ai-podcast-tool-free核心功能: 本技能提供中文交互、化工作流场景等能力。
AI播客生成工具 - 免费版
概述
AI播客生成免费版是一款面向个人用户的文档转播客工具。通过 MagicPodcast 引擎,将 PDF、文本、笔记或链接转化为自然的双人对话播客,几分钟即可获得可收听可分享的音频内容。
本版本适合内容创作者、学习者及多渠道内容分发者,通过分步引导式交互,快速将图文内容转化为音频形式。
核心能力
| 能力项 | 免费版支持 | 说明 |
|---|---|---|
| PDF 转播客 | 是 | PDF URL 输入 |
| 文本转播客 | 是 | 粘贴文本输入 |
| 多语种支持 | 是 | 中英日韩等 |
| 双人对话格式 | 是 | 主持人+嘉宾 |
| 分享链接 | 是 | 可分享播放 |
| 自定义对话风格 | 否 | PRO 版支持 |
| 批量生成 | 否 | PRO 版支持 |
| 音频下载 | 否 | PRO 版支持 |
| 节目封面定制 | 否 | PRO 版支持 |
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置。 |
核心功能执行
用input_params参数进行配置。
输出: 返回核心功能执行的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
参数配置与调用
用config_options参数进行配置。
输出: 返回参数配置与调用的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
config_options参数,支持修改/重置/导入操作
结果处理与输出
用output_format参数进行配置。
输出: 返回结果处理与输出的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
output_format参数,支持导出/保存/转换操作 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:链接转为双人对话、适合个人创作者快、速制作音频内容、播客生成免费版、面向个人用户的文、档转播客工具等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。
使用场景
场景一:文章转播客
内容创作者希望将一篇博客文章转为播客,方便通勤族收听。
# 配置 API
export MAGICPODCAST_API_URL="https://api.magicpodcast.app"
export MAGICPODCAST_API_KEY="${API_KEY:?请设置环境变量}"
# 从文本创建播客
payload="$(jq -n --arg text "$SOURCE_TEXT" --arg language "$LANGUAGE" '{text:$text,language:$language}')"
curl -sS -X POST "$MAGICPODCAST_API_URL/agent/v1/podcasts/text" \
-H "Content-Type: application/json" \
-H "x-api-key: $MAGICPODCAST_API_KEY" \
--data-binary "$payload"
场景二:PDF 报告转播客
用户希望将一份 PDF 报告转为播客,方便听觉学习。
# 从 PDF URL 创建播客
PDF_URL="https://example.com/report.pdf"
LANGUAGE="zh"
# 验证 URL 有效性
if ! printf '%s' "$PDF_URL" | grep -Eq '^https?://[^[:space:]]+$'; then
echo "Invalid PDF URL" >&2
exit 1
fi
payload="$(jq -n --arg pdfUrl "$PDF_URL" --arg language "$LANGUAGE" '{pdfUrl:$pdfUrl,language:$language}')"
curl -sS -X POST "$MAGICPODCAST_API_URL/agent/v1/podcasts/pdf" \
-H "Content-Type: application/json" \
-H "x-api-key: $MAGICPODCAST_API_KEY" \
--data-binary "$payload"
场景三:学习笔记转播客
学生希望将学习笔记转为播客,通勤时复习。
流程:
1. 系统询问播客主题
2. 询问内容来源(粘贴文本)
3. 询问播客语言
4. 确认后创建播客
5. 返回分享链接
用户: 把我的机器学习笔记转成播客
系统: 请粘贴你的笔记文本
用户: [粘贴文本]
系统: 播客用什么语言?
用户: 中文
系统: 确认创建中文播客?
用户: 是
系统: 已创建,链接: https://www.magicpodcast.app/...
不适用场景
以下场景AI播客生成-免费版不适合处理:
- 加密文件破解
- 损坏文件修复
- 物理介质数据恢复
触发条件
需要文件处理、文档转换、格式互转、内容提取时使用。不适用于非本工具能力范围的需求。
快速开始
领先步:配置 API Key
# 本技能的核心实现逻辑
# 请参考上方使用说明进行配置和调用
echo "implementation_ready"
获取地址:https://www.magicpodcast.app/skill-platform
第二步:分步交互创建
系统会依次询问:主题→来源→语言→确认,然后创建播客。
第三步:查看结果
创建后访问 https://www.magicpodcast.app/app 查看播客仪表盘,生成完成后返回分享链接。
示例
基础配置项说明:
# 环境变量
MAGICPODCAST_API_URL=https://api.magicpodcast.app
MAGICPODCAST_API_KEY=your_key
# 安全命令模板
safe_job_id() {
printf '%s' "$1" | grep -Eq '^[A-Za-z0-9_-]{8,128}$'
}
safe_http_url() {
printf '%s' "$1" | grep -Eq '^https?://[^[:space:]]+$'
}
# 查询任务状态
curl -sS "$MAGICPODCAST_API_URL/agent/v1/jobs/$JOB_ID" \
-H "x-api-key: $MAGICPODCAST_API_KEY"
优选实践
- 内容质量决定效果:输入文本结构清晰、信息丰富,生成的播客质量更高
- 语言明确指定:不要假设语言,明确指定(如"中文"、"English")避免异常
- PDF 需可访问:PDF URL 必须是公开可访问的直链,本地文件需先上传
- 生成需等待:播客生成通常需要 2-5 分钟,可在仪表盘查看进度
- 敏感内容谨慎:不要发送敏感文档,除非确认可接受外部处理
- 分享链接优先:完成后默认返回
outputs.shareUrl,缺失时回退到outputs.appUrl
常见问题
Q1:API Key 如何获取?
A:访问 https://www.magicpodcast.app/skill-platform,用 Google 账号登录,复制 API Key。免费注册,一分钟内完成。
Q2:本地 PDF 文件怎么处理?
A:需先将本地 PDF 上传到可访问的 URL(如网盘公开链接),再使用 PDF URL 方式创建。
Q3:生成失败怎么办?
A:检查 API Key 是否有效;确认 PDF URL 可公开访问;查看返回的错误信息;稍后重试。
已知限制
A:登录用户可免费生成播客,但有配额限制。如需批量生成或高级功能,请使用 PRO 版。
Q5:生成的播客可以下载吗?
A:免费版仅提供在线分享链接。如需下载音频文件,请使用 PRO 版的音频下载功能。
- 当前为免费版本,如需完整功能请升级到付费版获取全部能力
依赖说明
运行环境
- Agent平台: 支持 SKILL.md 的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
- 操作系统: Windows / macOS / Linux
- 运行时: Bash shell + curl + jq
依赖详情
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| MagicPodcast API | 外部 API | 必需 | 官网注册免费获取 |
| curl | 命令行工具 | 必需 | 系统自带 |
| jq | JSON 处理 | 必需 | 包管理器安装 |
API Key 配置
- 环境变量名:
MAGICPODCAST_API_KEY - 附加变量:
MAGICPODCAST_API_URL(有默认值) - 获取方式: 访问
https://www.magicpodcast.app/skill-platform注册 - 存储建议: 写入
.env文件或系统环境变量,避免硬编码到脚本
可用性分类
- 分类: MD+execute(纯 Markdown 指令,核心功能需要 exec 命令行执行能力)
- 说明: 基于Markdown的AI Skill,通过分步对话与 curl 调用驱动播客生成流程
错误处理
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
安全注意事项
| 风险类型 | 防范措施 |
|---|---|
| API密钥泄露 | 通过环境变量配置,禁止硬编码到代码或配置文件中 |
| 命令执行风险 | 仅执行白名单命令,避免拼接用户输入到命令行参数中 |
| 网络通信安全 | 使用HTTPS协议,验证SSL证书有效性 |
| 敏感数据暴露 | 输出结果中不包含密钥、令牌等敏感信息 |
使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。
效率量化分析
| 操作场景 | 手动耗时 | 自动化耗时 | 效率提升 |
|---|---|---|---|
| 文件解析与提取 | 5-10分钟/个 | <5秒/个 | 60-120x |
| 批量文件处理(100个) | 8-16小时 | <5分钟 | 96-192x |
| API调用与响应解析 | 2-3分钟/次 | <1秒/次 | 120-180x |
| 多接口数据聚合 | 15-30分钟 | <10秒 | 90-180x |
| 命令执行与结果收集 | 3-5分钟/次 | <2秒/次 | 90-150x |
| 重复任务批量执行 | 因任务而异 | 线性缩减 | 5-50x |
| 错误排查与修复 | 10-30分钟 | <30秒 | 20-60x |
差异化对比
| 对比维度 | 本技能 | 传统手动方式 | 通用脚本工具 |
|---|---|---|---|
| 自动化程度 | 全流程自动 | 完全手动 | 部分自动 |
| 错误处理 | 内置错误恢复 | 依赖人工经验 | 基本try-catch |
| 可复用性 | 参数化配置 | 一次性脚本 | 模板化 |
| 安全合规 | 内置安全检查 | 无安全保障 | 无安全保障 |
| 适用场景 | 核心功能 | 通用场景 | 通用场景 |
Top skills in this category
Feishu Evolver Wrapper
@autogame-17(Depreciated: This skill is no longer maintained; its related functions have been absorbed by the Evolver main body.) Feishu-integrated wrapper for the capability-evolver. Manages the evolution loop lifecycle (start/stop/ensure), sends rich Feishu card reports, and provides...
Edge TTS
@i3130002Text-to-speech conversion using node-edge-tts npm package for generating audio from text. Supports multiple voices, languages, speed adjustment, pitch control, and subtitle generation. Use when: (1) User requests audio/voice output with the "tts" trigger or keyword. (2) Content needs to be spoken rather than read (multitasking, accessibility, driving, cooking). (3) User wants a specific voice, speed, pitch, or format for TTS output.
Google Ads
@hith3shInspect Google Ads accounts and campaigns, run GAQL reports, and coordinate campaign or audience changes with confirmation via the Google Ads API. Use this s...
Google Analytics
@hith3shRun GA4 reports, inspect properties, list audiences and data streams, and analyze traffic and conversion data via the Google Analytics Data API. Use this ski...
Figma
@maddiedreeseProfessional Figma design analysis and asset export. Use for extracting design data, exporting assets in multiple formats, auditing accessibility compliance, analyzing design systems, and generating comprehensive design documentation. Read-only analysis of Figma files with powerful export and reporting capabilities.