GloVe词向量模型原理详解:如何结合全局统计与局部上下文信息?

陌强大大_9095

陌强大大_9095

2026-05-29

286人浏览

原创

glove模型核心是融合全局统计与局部上下文:通过构建加权共现矩阵(窗口内邻近词对计数),并最小化加权平方损失 $f(x_{ij})(w_i^\top \tilde{w}_j + b_i + \tilde{b}j - \log x{ij})^2$,使向量内积加偏置逼近共现频次对数值,从而自然涌现线性语义类比关系。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

glove词向量模型原理详解:如何结合全局统计与局部上下文信息?

GloVe模型的核心在于不把“全局统计”和“局部上下文”当作互斥选项,而是用一个统一的数学框架把两者自然融合——它既不是纯矩阵分解,也不是滑动窗口预测,而是基于词对共现频次建模向量内积与偏置项之和,使其逼近共现次数的对数值。

共现矩阵:全局统计的落地形式

所谓“全局”,不是指整篇文档或整个语料库的粗粒度统计,而是对每一对词(wᵢ, wⱼ)在整个语料中、在固定大小的上下文窗口(如±5词)内共同出现的总次数进行精确计数。这个窗口机制就是局部性的体现:只统计邻近共现,而非任意位置的共现。因此,共现矩阵X本身已隐含局部约束;它的每个元素Xᵢⱼ = 该词对在所有滑动窗口中联合出现的加权次数(距离越近,权重越高)。

  • 例如,“猫”和“可爱”若在100个窗口中相邻出现,而“猫”和“引擎”仅在3个窗口中擦肩而过,X猫,可爱远大于X猫,引擎
  • 矩阵维度为V×V(V是词汇表大小),但实际存储常采用稀疏结构,因绝大多数词对从不共现(Xᵢⱼ = 0)

目标函数:用向量运算拟合统计规律

GloVe不预测概率,也不做分类,而是设定一个简洁目标:让词向量wᵢ和ŵⱼ的内积加上两个独立偏置bᵢ、b̂ⱼ,尽可能等于log(Xᵢⱼ)。即希望:

wᵢ⊤ŵⱼ + bᵢ + b̂ⱼ ≈ log(Xᵢⱼ)

这个设计直接桥接了向量空间(连续、可微、支持类比)与离散共现计数(真实、可统计、带语义强度)。内积反映相似性,偏置项则吸收词频固有偏差(如高频词“的”更容易被共现,需单独校准)。

  • 当Xᵢⱼ = 0时,log(0)无定义,GloVe跳过该项——避免引入噪声
  • 当Xᵢⱼ很小(如1–5),log(Xᵢⱼ)为负但敏感,模型会认真拟合低频可靠信号
  • 当Xᵢⱼ极大(如“the”和“cat”),log压缩其影响,防止主导梯度更新

加权损失:平衡高低频词的训练贡献

原始平方误差 (wᵢ⊤ŵⱼ + bᵢ + b̂ⱼ − log Xᵢⱼ)² 仍会受高频共现干扰。GloVe引入权重函数f(Xᵢⱼ),使最终损失为:

WorkBuddy(Mac4.22.10)
WorkBuddy(Mac4.22.10)

WorkBuddy 4.22.10 是腾讯推出的 AI 智能体桌面工作台,主打“下载即用”的零部署体验。它能通过自然语言指令,自主规划并执行文档处理、数据分析、PPT 生成等复杂任务。支持多模型切换与技能扩展,可像同事一样帮你完成重复性工作,大幅提升办公效率。

下载

f(Xᵢⱼ) × (wᵢ⊤ŵⱼ + bᵢ + b̂ⱼ − log Xᵢⱼ)²

典型f定义为:当Xᵢⱼ ≤ xₘₐₓ时,f(Xᵢⱼ) = (Xᵢⱼ/xₘₐₓ)α;否则为1(α常取0.75,xₘₐₓ常设为100)。这确保:

  • Xᵢⱼ = 0 → f = 0,完全忽略未共现词对
  • Xᵢⱼ ∈ [1, xₘₐₓ] → f随Xᵢⱼ平缓上升,低频共现获得合理权重
  • Xᵢⱼ > xₘₐₓ → f饱和为1,高频共现不再放大梯度

为什么能支持语义类比?

因为目标函数强制向量关系服从共现比率。比如,若“king”与“man”的共现比接近“queen”与“woman”的共现比,即:

log(Xking,man/Xking,woman) ≈ log(Xqueen,man/Xqueen,woman)

展开后,等价于 (wking − wqueen)⊤(wman − wwoman) ≈ 常数,说明向量差方向一致。大量此类比率约束,最终使“king − man + woman”自然趋近“queen”。

这种线性结构不是人为强加的,而是全局共现模式在向量空间中的自然涌现。

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

自然语言处理

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
数据分析的方法
数据分析的方法

数据分析的方法有:对比分析法,分组分析法,预测分析法,漏斗分析法,AB测试分析法,象限分析法,公式拆解法,可行域分析法,二八分析法,假设性分析法。php中文网为大家带来了数据分析的相关知识、以及相关文章等内容。

2023.07.04

1722

6

数据分析方法有哪几种
数据分析方法有哪几种

数据分析方法有:1、描述性统计分析;2、探索性数据分析;3、假设检验;4、回归分析;5、聚类分析。本专题为大家提供数据分析方法的相关的文章、下载、课程内容,供大家免费下载体验。

2023.08.07

2310

5

网站建设功能有哪些
网站建设功能有哪些

网站建设功能包括信息发布、内容管理、用户管理、搜索引擎优化、网站安全、数据分析、网站推广、响应式设计、社交媒体整合和电子商务等功能。这些功能可以帮助网站管理员创建一个具有吸引力、可用性和商业价值的网站,实现网站的目标。

2023.10.16

6450

14

数据分析网站推荐
数据分析网站推荐

数据分析网站推荐:1、商业数据分析论坛;2、人大经济论坛-计量经济学与统计区;3、中国统计论坛;4、数据挖掘学习交流论坛;5、数据分析论坛;6、网站数据分析;7、数据分析;8、数据挖掘研究院;9、S-PLUS、R统计论坛。想了解更多数据分析的相关内容,可以阅读本专题下面的文章。

2024.03.13

2944

8

Python 数据分析处理
Python 数据分析处理

本专题聚焦 Python 在数据分析领域的应用,系统讲解 Pandas、NumPy 的数据清洗、处理、分析与统计方法,并结合数据可视化、销售分析、科研数据处理等实战案例,帮助学员掌握使用 Python 高效进行数据分析与决策支持的核心技能。

2025.09.08

4165

12

Python 数据分析与可视化
Python 数据分析与可视化

本专题聚焦 Python 在数据分析与可视化领域的核心应用,系统讲解数据清洗、数据统计、Pandas 数据操作、NumPy 数组处理、Matplotlib 与 Seaborn 可视化技巧等内容。通过实战案例(如销售数据分析、用户行为可视化、趋势图与热力图绘制),帮助学习者掌握 从原始数据到可视化报告的完整分析能力。

2025.10.14

6212

24

Python 数据分析与可视化合集
Python 数据分析与可视化合集

聚焦 Python 在数据分析领域的核心应用,讲解 NumPy 数组运算、Pandas 数据清洗与聚合统计、缺失值与异常值处理、数据透视表生成,以及使用 Matplotlib、Seaborn、Pyecharts 制作折线图、柱状图、热力图、地图等多种可视化图表,适合数据分析师和运营人员快速掌握用 Python 从原始数据中挖掘洞察的能力。

2026.04.08

296

25

Python数据分析与Pandas高级实战
Python数据分析与Pandas高级实战

本专题围绕 Python 数据分析展开,系统讲解 Pandas 的高级用法,包括数据清洗、透视表、时间序列分析以及多表合并与分组操作。通过实战案例,帮助开发者掌握高效处理与分析数据的方法,提高数据处理效率与分析能力。

2026.04.13

451

25

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
热门推荐
/
最新课程
phpStudy极速入门视频教程
phpStudy极速入门视频教程

共6课时 | 54.6万人学习

独孤九贱(4)_PHP视频教程
独孤九贱(4)_PHP视频教程

共89课时 | 133.4万人学习