观看2小时网课视频时,可通过四种方式借助gemini快速获取核心内容:一、gemini advanced直传本地视频生成结构化摘要;二、粘贴youtube链接触发实时字幕与视觉分析;三、用ffmpeg切片后调用api批量处理;四、用chrome扩展提取srt字幕转纯文本再摘要。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您观看一段长达2小时的网课视频,但希望快速掌握核心内容,则可能需要借助Gemini的视频摘要能力。以下是实现该目标的多种具体操作路径:
一、使用Gemini Advanced 的原生视频上传功能
Gemini Advanced(需订阅)支持直接上传MP4、MOV等常见格式的本地视频文件,并自动提取关键帧、语音转文字及语义摘要。该方式无需第三方工具介入,全程在Google生态内完成。
1、访问gemini.google.com并登录已开通Advanced权限的Google账号。
2、点击输入框旁的回形针图标,选择“上传文件”,选取本地网课视频(最大支持10GB)。
3、上传完成后,在对话框中输入指令:请为这段视频生成5分钟内的结构化精华摘要,按知识点分段,保留关键定义、公式和案例。
4、等待处理完成(通常耗时约为视频时长的1/5,2小时视频约需24分钟)。
二、通过YouTube链接触发Gemini实时摘要
若网课已发布在YouTube且为公开或未设隐私限制的视频,Gemini可直接抓取公开页面的字幕轨道与视觉提示,跳过上传环节,显著缩短准备时间。
1、复制目标网课视频的完整YouTube URL(确保链接末尾不含?si=等追踪参数)。
2、在Gemini Advanced对话窗口中粘贴链接,并附加指令:基于此YouTube视频,提取授课逻辑主线,剔除重复讲解、口头禅和互动问答,浓缩为严格不超过5分钟阅读量的要点清单。
3、确认视频下方显示“正在分析音频与字幕”状态条,待其变为绿色对勾后查看结果。
三、拆分+分段提交至Gemini API 批量处理
针对超长视频或需定制化摘要层级的场景,可将2小时视频按40分钟为单位切割为三段,分别调用Gemini Pro Vision API接口提交,再人工合并去重。此法适用于开发者或熟悉命令行操作的用户。
1、使用ffmpeg执行切片命令:ffmpeg -i course.mp4 -c copy -f segment -segment_time 2400 -reset_timestamps 1 part_%03d.mp4。
2、为每段视频调用API时,在payload中设置system_instruction字段为:“你是一名教育内容架构师,请仅输出知识点标题、对应讲解时长(精确到秒)、核心结论,不使用任何连接词。”
3、接收三组JSON响应后,用Python脚本按时间戳排序、合并相同标题条目、截断总长度超过300秒的内容项。
四、借助Chrome扩展协同提取字幕再喂给Gemini
当视频位于受DRM保护平台(如学堂在线、中国大学MOOC)无法直接上传时,可先利用字幕提取扩展捕获隐藏字幕流,再将SRT文本导入Gemini进行纯文本摘要,规避视频解析限制。
1、在Chrome浏览器安装“Language Reactor”扩展并重启浏览器。
2、播放网课视频,点击扩展图标,选择“显示双语字幕”,右键字幕区域选择“导出为SRT”。
3、打开导出的SRT文件,删除时间码行,保留纯文本对话内容,保存为UTF-8编码的TXT文件。
4、在Gemini Advanced中上传该TXT文件,并输入指令:根据以下课堂实录文本,识别教师强调三次以上的概念,标注其首次出现时间点(格式:XX:XX),归纳为带编号的5条核心结论。











