需在jupyter notebook单单元格内完成:安装库→配置gemini api密钥→抓取网页纯文本→生成摘要;推荐用requests+beautifulsoup清洗html,再调用genai.generativemodel生成摘要。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要在Jupyter Notebook里不复制粘贴网页内容,直接从URL抓取文本并送入Gemini API生成摘要——整个流程必须在同一个Notebook单元格内完成,避免手动中转和格式污染。
安装必要库并配置API密钥
先用pip安装google-generativeai和requests(如果尚未安装):!pip install google-generativeai requests。
导入库后,用os.environ["GOOGLE_API_KEY"] = "your_api_key_here"设置密钥;【密钥必须是未过期的、已开启Generative AI API服务的项目密钥】,否则后续调用会直接报403错误。
接着执行import google.generativeai as genai; genai.configure(api_key=os.environ["GOOGLE_API_KEY"])完成初始化。
抓取网页纯文本内容
方法一:用requests + BeautifulSoup提取正文(推荐)
执行import requests, re → from bs4 import BeautifulSoup → url = "https://example.com" → res = requests.get(url, timeout=10) → soup = BeautifulSoup(res.text, "html.parser") → for tag in soup(["script", "style", "nav", "header", "footer", "aside"]): tag.decompose() → text = soup.get_text(separator=" ", strip=True)。
方法二:极简方案(仅适用于结构干净的页面)
跳过BeautifulSoup,直接用text = re.sub(r"\s+", " ", requests.get(url).text.split("")[0])粗筛,但【此方式极易因HTML结构变动导致IndexError或截断正文】,慎用于生产环境。
调用Gemini API生成摘要
第一步:创建模型实例model = genai.GenerativeModel("gemini-1.5-flash")(响应快,适合摘要)。
第二步:构造提示词
定义prompt = f"请用200字以内概括以下网页内容要点,不要添加原文未提及的信息:\n\n{text[:8192]}";这里截断到8192字符是因为免费tier对单次输入有长度限制,超长会触发ResourceExhausted异常。
第三步:发起请求并获取结果response = model.generate_content(prompt) → print(response.text)。
大量免费API接口:立即使用
涵盖生活服务API、金融科技API、企业工商API、等相关的API接口服务。免费API接口可安全、合规地连接上下游,为数据API应用能力赋能!





