Transformer 注意力整套完整流程梳理

从向量到QKV到点积到缩放到Softmax到加权融合,完整的Transformer注意力流程,全程业务语言,供应链案例贯穿。

2026-07-31 · 4 min · 1669 words · Xin

什么是交叉注意力机制(Cross-Attention)

用业务语言讲清楚 Cross-Attention:两组相互对应的信息,用A做查询方去检索匹配B里的内容。

2026-07-31 · 3 min · 1176 words · Xin

什么是自注意力机制(Self-Attention)

用供应链业务案例讲透Self-Attention:一份数据内部互相查找关联,Q/K/V全部来自同一数据源,是理解Transformer的第一块基石。

2026-07-31 · 3 min · 1073 words · Xin

向量接近的判断逻辑是什么

详解向量相似度判断的底层逻辑:向量不是逐字编码,而是整体语义的打包。通过余弦相似度衡量方向重合度。

2026-07-31 · 2 min · 934 words · Xin

欧式距离在物流优化场景的使用

物流网点片区划分、配送路线聚合场景中,欧氏距离不只判断地理远近,还能兼顾货量、时效等量化指标。

2026-07-31 · 2 min · 858 words · Xin

欧式距离适用场景

欧氏距离同时考量特征方向和数值大小,适合结构化数值聚类、备件指标分类、坐标点位匹配等场景。

2026-07-31 · 3 min · 1007 words · Xin

点积业务场景与计算逻辑

点积是一套快速计算公式,用来衡量两组向量大方向是否一致,输出一个数字代表匹配程度,是注意力机制计算关联程度的基础运算。

2026-07-31 · 3 min · 1039 words · Xin
黑ICP备15000859号-1 | 黑公网安备23000002000105号