跳到主要内容

全部菜单

L

LLM Attention Visualization

展示小型 LLM 生成每个词元时参考了哪些前文的可视化

AI9天前
分类
AI
语言
英语
发布于
9天前

Transformer 模型在生成时可以回看之前的任意词元,但必须有所取舍。这个页面用 Transformers.js 在浏览器里运行一个约 6 亿参数的模型,点按或悬停在任一生成的词元上,前文会按贡献大小显示深浅。深浅值是注意力权重乘以值向量的模长,再跨所有注意力头汇总、跨所有层求和后归一化得到的,是相当粗略的近似。

在示例的办公室搬迁摘要里,照抄的地址和日期会让原文对应位置格外醒目,这也说明了模型为何擅长逐字复制。

喜欢这个产品吗?