千问能不能做事件抽取?从新闻文本中自动提取出什么人在什么时间做了什么事

星芳姑娘_6318

星芳姑娘_6318

2026-05-21

812人浏览

原创

可利用qwen3-14b等千问系列模型,通过提示工程、rag增强、低代码集成或多模态解析等方式,从新闻中自动抽取“谁在何时何地做了什么”结构化事件要素。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

千问能不能做事件抽取?从新闻文本中自动提取出什么人在什么时间做了什么事

如果您尝试从新闻文本中自动识别“谁在何时何地做了什么”这类结构化事件要素,但人工梳理效率低、易遗漏关键信息,则可能是由于事件表述隐含、时间地点嵌套、主体指代模糊所致。以下是利用千问实现该目标的多种操作路径:

一、使用Qwen3-14B模型配合结构化提示词抽取事件三元组

该方法依托Qwen3-14B强大的链式推理与长上下文理解能力,在无需微调的前提下,通过精准提示工程驱动模型输出标准JSON格式的事件要素,确保每个事件包含主体、行为、时间、地点四类字段。模型启用enable_thinking模式后可对模糊指代(如“该公司”“上述人员”)进行前文回溯消解。

1、准备一段含明确事件描述的新闻文本,例如:“2025年11月20日,阿里巴巴集团宣布完成对某AI初创企业的全资收购,交易金额达4.2亿美元。”

2、向已部署的Qwen3-14B服务发送请求,system提示词设为:“你是一个专业的新闻事件结构化解析器,请严格按以下规则执行:仅输出合法JSON数组;每个对象必须包含‘主体’‘行为’‘时间’‘地点’四个键;时间字段须标准化为YYYY-MM-DD格式;地点若未明示则填‘未知’;不添加任何解释性文字。”

3、user输入为新闻原文,并追加指令:“请按上述规则提取全部独立事件,每件事对应一个JSON对象。”

二、通过Ollama WebUI本地运行Qwen3-0.6B实现轻量级事件抽取

该方法适用于资源受限环境(如单张RTX 4090),利用Qwen3-0.6B的低延迟响应特性,在Jupyter或WebUI界面中快速完成小规模新闻文本的事件要素识别,支持对相对时间(如“签约后第5个工作日”)进行自动推算并转为绝对日期。

1、在CSDN星图平台启动Qwen3-0.6B镜像,确认/v1接口可用,base_url形如https://gpu-podxxxx-8000.web.gpu.csdn.net/v1。

2、在Jupyter Notebook中配置ChatOpenAI客户端,设置extra_body={"enable_thinking": true, "return_reasoning": false}以启用思维链但不返回推理过程。

3、调用invoke方法,输入:“请从以下新闻中提取所有事件,格式为:主体|行为|时间|地点。时间需转换为标准格式,地点缺失则写‘未提及’。新闻内容:[粘贴原文]。”

三、调用通义千问API结合RAG增强新闻事件抽取准确性

该方法将原始新闻文本与权威事件知识库(如司法案例库、企业工商变更记录)进行语义对齐,通过检索增强生成(RAG)机制校验主体真实性与行为合理性,避免模型幻觉导致的错误三元组生成,尤其适用于涉及法律后果或监管动作的新闻。

1、预先构建新闻事件知识索引,涵盖近五年重大并购、行政处罚、高管变动等结构化事件条目,每条含唯一事件ID、主体全称、行为类型标签、发生时间戳。

千问文生图
千问文生图

阿里云千问文生图模型(Qwen-Image)技能,支持图像生成。当用户要求AI生成图片、画图、文生图、text-to-image,或提到千问、阿里云生图时使用。支持中英文提示词,可指定画面尺寸、风格参数等。

下载

2、向通义千问API发起请求,system角色设定为:“你是一个融合RAG检索结果的事件抽取器。用户将提供新闻文本和一段相关检索片段,请基于两者交叉验证生成事件三元组。”

3、user消息中同步传入新闻原文与RAG返回的Top3匹配片段,指令为:“请比对新闻与检索内容,仅当行为动词、时间、主体三者均一致时才输出事件;否则标注‘存疑’并说明差异点。”

四、在简道云低代码平台中集成千问插件实现批量新闻事件提取

该方法面向企业级非技术人员,通过表单字段绑定与前端事件自动触发,将上传的多篇新闻PDF/Word文件批量送入千问处理流程,输出统一字段的Excel事件表格,支持按“主体”“行为类型”“时间区间”三维度筛选导出。

1、在简道云创建「新闻事件采集」表单,设置字段:新闻标题(单行文本)、原文附件(文件上传)、事件表格(多行文本,权限设为不可编辑)。

2、进入「表单属性 >> 前端事件」,新增事件:触发字段选“原文附件”,执行动作为调用「通义千问-律政智析」插件。

3、插件配置中,“问题”字段填写:“请从上传文档中提取全部事件,按时间升序排列,每行格式为:[主体]于[时间]在[地点][行为];若地点未出现则省略‘在[地点]’部分。”

五、使用千问多模态能力解析含图表新闻中的隐含事件

该方法针对含时间轴图、流程图或地理热力图的新闻报道,千问通过视觉语言联合建模识别图像中的时间节点、空间分布与动作序列,再与正文文本对齐生成完整事件描述,突破纯文本抽取的信息边界。

1、上传一份含“2025年Q3全球AI芯片出货量趋势图”的PDF新闻,确保图像分辨率不低于300dpi且未加密。

2、在千问对话窗口点击“+”上传该文件,随后输入:“请分析图中横轴时间标记与曲线峰值对应的事件,结合正文第2段内容,生成包含主体、行为、时间、地点的事件陈述。”

3、确认输出是否将“2025年7月出货量激增”与正文“英伟达发布H200芯片并量产交付”关联,形成完整事件:“英伟达于2025年7月在全球范围内量产交付H200芯片”。

相关专题

更多
LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

2026.09.30

60

10

LLVM RISC-V参数配置教程
LLVM RISC-V参数配置教程

本专题介绍LLVM对RISC-V基础ISA和扩展的支持方式,涵盖RV32、RV64、标准扩展、实验性扩展、厂商扩展、-menable-experimental-extensions和版本差异。

2026.09.30

40

14

LLVM IR中间表示入门指南
LLVM IR中间表示入门指南

本专题整理LLVM IR的核心概念,包括中间表示作用、模块结构、函数、基本块、SSA形式、类型系统和常见语法,帮助新手理解LLVM编译流程中的关键层。

2026.09.30

40

12

PDF转图片方法
PDF转图片方法

需要把 PDF 页面用于上传、预览、分享或图片归档时,PDF 转图片方法专题整理 JPG/PNG 格式选择、逐页导出、清晰度设置、批量下载和结果检查等流程,帮助用户稳定完成 PDF 图片化处理。

2026.09.30

40

26

PixTV AI视频生成与无限画布创作
PixTV AI视频生成与无限画布创作

PixTV专题整理AI视频与视觉内容创作相关功能使用教程,涵盖AI生图、视频生成、无限画布、多模型创作、素材管理、声音音乐及视频剪辑等功能,帮助用户快速掌握PixTV从创意到成片的完整制作方法。

2026.09.29

40

15

Buffalo框架数据库开发全教程
Buffalo框架数据库开发全教程

本专题围绕Buffalo框架数据库开发,讲解database.yml多环境配置、soda与fizz迁移生成回滚、模型结构体标签、增删改查与条件查询、一对多与多对多关联、数据校验、回调钩子、事务处理及原生SQL执行能力。

2026.09.23

240

15

Buffalo框架路由与请求处理实操指南
Buffalo框架路由与请求处理实操指南

本专题讲解Buffalo框架路由与请求处理机制,涵盖路由注册与分组、资源路由、Handler编写规范、Context上下文方法、参数绑定、中间件编写挂载、Session与Cookie读写、Flash消息及错误页面定制方法。

2026.09.23

160

15

Buffalo框架零基础入门教程
Buffalo框架零基础入门教程

本专题整理Buffalo框架入门内容,涵盖Go环境准备、buffalo CLI安装、新项目生成、目录结构说明、dev热加载启动、数据库连接配置与常见报错排查,帮助新手按约定优于配置的思路跑通第一个Buffalo框架应用。

2026.09.23

120

15

Conan创建软件包配方指南
Conan创建软件包配方指南

本专题介绍通过conanfile.py创建软件包的方法,讲解包名、版本、依赖和构建设置等基础信息,以及source、build、package、package_info等常用方法的作用及编写思路。

2026.09.22

80

12

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
通义千问基本用法
通义千问基本用法

共1课时 | 228人学习

通义千问的提示词工程
通义千问的提示词工程

共1课时 | 258人学习