podcast-generation
仓库创建 2026年1月17日最近提交 21 天前SkillHot 收录 20 天前
▸ 精选理由
提供从实时 WebSocket 到 PCM/WAV 的全栈示例,便于集成语音输出功能。
▸ 风险提示
依赖 Azure OpenAI Realtime 服务与密钥,可能产生成本或数据外泄风险。
这个 Skill 做什么
使用 Azure OpenAI Realtime 将文本转换为播客风格的音频叙事。
把文本变成播客风格的音频叙事,基于 Azure OpenAI 的 GPT Realtime Mini,通过 WebSocket 实时流式输出 PCM 音频和转写。适合做文本转语音、自动生成播客或需要边生成边播放的功能。提供从 React 前端到 Python FastAPI 后端的端到端实现,能把流式音频合成并返回可播放的 WAV。
▸ 展开 SKILL.md 英文原文
Generate AI-powered podcast-style audio narratives using Azure OpenAI's GPT Realtime Mini model via WebSocket. Use when building text-to-speech features, audio narrative generation, podcast creation from content, or integrating with Azure OpenAI Realtime API for real audio output. Covers full-stack implementation from React frontend to Python FastAPI backend with WebSocket streaming.
2.7k
Stars
304
Forks
40
仓库内 Skill
+0
7 日增星
安装 / 使用
给你的 Agent 一句话(通用)
帮我安装这个 skill:https://raw.githubusercontent.com/microsoft/skills/main/.github/skills/podcast-generation/SKILL.md或 curl 直取 SKILL.md
curl -fsSL "https://raw.githubusercontent.com/microsoft/skills/main/.github/skills/podcast-generation/SKILL.md"SKILL.MD 节选查看完整文件 ↗
# Podcast Generation with GPT Realtime Mini Generate real audio narratives from text content using Azure OpenAI's Realtime API. ## Quick Start 1. Configure environment variables for Realtime API 2. Connect via WebSocket to Azure OpenAI Realtime endpoint 3. Send text prompt, collect PCM audio chunks + transcript 4. Convert PCM to WAV format 5. Return base64-encoded audio to frontend for playback ## Environment Configuration ```env AZURE_OPENAI_AUDIO_API_KEY=your_realtime_api_key AZURE_OPENAI_AUDIO_ENDPOINT=https://your-resource.cognitiveservices.azure.com AZURE_OPENAI_AUDIO_DEPLOYMENT=gpt-realtime-mini ``` **Note**: Endpoint should NOT include `/openai/v1/` - just the base URL. ## Core
via SKILL·HOT · 数据来自 GitHub 公开信息 · 原文版权归作者所有