从文本预处理、词嵌入到 Transformer 与预训练模型,系统建立自然语言处理的核心认知。
当前目录下的专题与页面会统一按权重排序。
打开页面查看详细内容。
从 RNN 的局限出发,用通俗类比理解 Transformer 的整体流程、自注意力、QKV、多头注意力、位置编码,以及它为什么成为大模型底座。