从QuickView趋势笔记生成韩语AI播客包,含双人主持脚本(Callie×Nick)、Gemini多说话人TTS音频、字幕时间轴与渲染修正、缩略图+MP4包装及YouTube标题/描述输出。支持完整版(15~20分钟)和压缩版(5~7分钟)。
AI Podcast PipelineQQ安全通知. 此技能可能因合法使用:. base64解码:仅用于解码双子座TTS API响应的音频数据而触发抗病毒假阳性是一项面向实际任务的技能。它将相关步骤、工具调用和结果整理方式集中到统一流程中,帮助使用者更快完成目标并减少重复操作。
实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。
执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。
本技能可能因以下合法用途触发杀毒软件误报:
GEMINI_API_KEY)所有代码均开源,可在本仓库中完整审计。无任何恶意行为。
基于 Trend/QuickView-* 内容构建端到端播客资产。
优先选用您所配置的 Quartz 根目录下的周度 QuickView 文件。
若用户提供 wk.aiee.app URL,请先将其映射为本地 Quartz Markdown 文件。
请阅读并应用:
references/podcast_prompt_template_ko.md两种模式:
规则:
archive/ 目录# 通过环境变量设置 API 密钥(必需)
export GEMINI_API_KEY=""
# 在 skills/ai-podcast-pipeline/ 目录下执行
python3 scripts/build_dualvoice_audio.py
--input
--outdir
--basename podcast_full_dualvoice
--chunk-lines 6
python3 scripts/gemini_multispeaker_tts.py
--input-file
--outdir
--basename podcast_dualvoice
--retries 3
--timeout-seconds 120
默认语音映射(2026-02-10 起固定):
KorePuck输出格式:MP3(默认交付格式)
使用全文本字幕构建器(不进行 ... 截断):
python3 scripts/build_korean_srt.py
--script
--audio
--output /podcast.srt
--max-chars 22
使用支持调节字体与时间轴偏移的渲染器:
python3 scripts/render_subtitled_video.py
--image
--audio
--srt
--output /final.mp4
--font-name "Do Hyeon"
--font-size 27
--shift-ms -250
说明:
shift-ms 为负值表示字幕提前显示(用于修复音画不同步)font-size(例如设为 25~27)# 通过环境变量设置 API 密钥(必需)
export GEMINI_API_KEY=""
python3 scripts/build_podcast_assets.py
--source ""
参考规范(布局 / 文案约束):
references/thumbnail_guidelines_ko.md每次交付必须包含以下内容:
build_dualvoice_audio.py)--shift-ms 参数(通常设为 -150 至 -300)GEMINI_API_KEY)传入,禁止硬编码。references/podcast_prompt_template_ko.mdreferences/workflow_runbook.mdreferences/thumbnail_guidelines_ko.md