2024年12月8日大约 3 分钟
- 杂谈26
- hands-on-code4
- 年终总结4
- python-type-challenge3
- 分词2
- 面试锦囊2
- 序列标注2
- 算法妙用2
- 情感-原因对抽取(ECPE)2
- 笔记折腾记1
- raycast-turorial1
- 搜索技术1
- 实体识别1
用 PyTorch 实现从零实现 LoRA, 理解 LoRA 的原理,主要是为了展示一个 LoRA 实现的细节
2024年11月9日大约 4 分钟
手写一个 Causal Language Model,或者说简化版的 transformer 中的 decoder。
2024年8月18日大约 3 分钟
在 AI 相关的面试中,经常会有面试官让写 self-attention,但是 transformer 这篇文章其实包含很多的细节,因此可能面试官对于 self-attention 实现到什么程度是有不同的预期。因此这里想通过写不同版本的 self-attention 实现来达到不同面试官的预期,四个不同的版本,对应不同的细节程度。
2024年8月18日大约 7 分钟