可用whisper+chatgpt端到端批量处理音频转录与字幕生成:先用whisper批量转文字并指定--language zh,再通过本地粘贴或python脚本调用gpt-4o清洗结构化输出,最后用subtitle edit校准时间轴并硬编码字幕。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要把几十期播客或多个视频的音频文件统一转成文字、提取重点、生成字幕,又不想手动逐个上传和整理——ChatGPT本身不支持直接上传音频文件,但能配合免费工具链完成端到端批量处理。
先用Whisper把所有音频转成文字
打开 OpenAI Whisper GitHub 页面,点击右上角“Code”→“Download ZIP”,解压后进入文件夹;
在该文件夹空白处按住 Shift + 右键→选择“在此处打开 PowerShell 窗口”;
运行 pip install -r requirements.txt 安装依赖(需已安装 Python 3.9+);
把所有待处理的 MP3/M4A/WAV 文件拖进同一文件夹,例如命名为 podcasts/;
执行命令:whisper podcasts/ --model base --language zh --output_format txt ——这会为每段音频生成同名 .txt 文件;【必须用 --language zh 显式指定中文,否则中文识别率暴跌】
用ChatGPT批量清洗和结构化文本
方法一:本地批量粘贴(适合≤20个文件)
将全部 .txt 文件内容复制,用 Notepad++ 或 VS Code 合并为一个大文本,开头加提示:“以下是我从32期播客中提取的原始转录稿,每段以‘=== 第X期 ===’分隔。请为每期生成:① 3个核心观点(用短句,不超15字);② 100字以内摘要;③ 时间戳对齐的SRT字幕(格式严格按标准SRT,序号+时间码+文字,每段不超过2行)。”
把整段文本发给 ChatGPT-4o(网页版或App),等待输出;
收到结果后,用正则表达式 (d+
d{2}:d{2}:d{2},d{3} --> d{2}:d{2}:d{2},d{3}
.*?
) 提取全部 SRT 块,另存为 all_subtitles.srt;
用于在用户想通过浏览器自动化与 Google Gemini 或 ChatGPT 交互时。触发短语包括“ask Gemini”“ask ChatGPT”“ask GPT”“让...”。
方法二:用Python脚本自动调用API(适合≥50个文件)
安装依赖:pip install openai python-dotenv;
创建 .env 文件,写入 OPENAI_API_KEY=sk-xxx(需开通 GPT-4 API 权限);
新建 batch_process.py,粘贴以下代码(已适配中文播客语境,自动切分避免超长):
import os, openai, time<br>from dotenv import load_dotenv<br>load_dotenv()<br>client = openai.OpenAI()<br>for i, f in enumerate(sorted(os.listdir("transcripts"))):<br> if not f.endswith(".txt"): continue<br> txt = open(f"transcripts/{f}").read()[:6000] # 截断防超限<br> resp = client.chat.completions.create(<br> model="gpt-4o",<br> messages=[{"role":"user","content":f"你是一名专业播客编辑。请基于以下文字,严格输出三部分:\n1. 核心观点(3条,每条≤15字,用★开头)\n2. 摘要(≤100字)\n3. SRT字幕(仅文字部分,不带时间码,按语义切分,每行≤20字)\n---\n{txt}"}]<br> )<br> open(f"output/{f[:-4]}.md", "w", encoding="utf-8").write(resp.choices[0].message.content)<br> time.sleep(1) # 避免触发速率限制
运行脚本前,确保已建好 transcripts/ 和 output/ 文件夹;【API调用失败时优先检查 OPENAI_API_KEY 是否过期或欠费】
合并字幕并嵌入视频(可选)
下载免费工具 yt-dlp(比 youtube-dl 更活跃);
若原视频在 YouTube,执行:yt-dlp --write-subs --sub-lang zh-Hans --convert-subs srt --skip-download "VIDEO_URL" 获取官方字幕;
用 Subtitle Edit 打开你生成的 SRT → 顶部菜单“同步”→“与音频同步”,导入对应音频文件,自动校准时间轴;
校准完成后,点击“文件”→“导出为”→选择“MP4 with subtitles”,勾选“硬编码字幕”,设置字体大小为48,点击“确定”即生成带字幕的视频。










