🧑🏫 60+ Implementations/tutorials of deep learning papers with side-by-side notes 📝; including transformers (original, xl, switch, feedback, vit, ...), optimizers (adam, adabelief, sophia, ...), gans(cyclegan, stylegan2, ...), 🎮 reinforcement learning (ppo, dqn), capsnet, distillation, ... 🧠
COMMITS
/ labml_nn/transformers/mha.py October 24, 2023
V
arxiv.org links
Varuna Jayasiri committed
December 24, 2022
V
fix typo mha
Varuna Jayasiri committed
July 2, 2022
V
comet links fix
Varuna Jayasiri committed
June 28, 2022
V
experiment links transformer
Varuna Jayasiri committed
April 10, 2022
V
links to colab
Varuna Jayasiri committed
October 21, 2021
September 21, 2021
V
Primer EZ (#96)
Varuna Jayasiri committed
August 17, 2021
V
paper links
Varuna Jayasiri committed
June 7, 2021
V
gMLP (#57)
Varuna Jayasiri committed
February 19, 2021
V
📚 compressive transformer
Varuna Jayasiri committed
February 17, 2021
V
formatting
Varuna Jayasiri committed
February 16, 2021
V
float(inf)
Varuna Jayasiri committed
February 5, 2021
V
✨ transformer xl experiment
Varuna Jayasiri committed
February 2, 2021
V
use forward
Varuna Jayasiri committed
February 1, 2021
V
✍️ mha english
Varuna Jayasiri committed
January 10, 2021
V
transpose with \top
Varuna Jayasiri committed
V
feedback transformer notes
Varuna Jayasiri committed
January 9, 2021
V
relative attention notes
Varuna Jayasiri committed
December 21, 2020
V
underset fix
Varuna Jayasiri committed
December 18, 2020
V
mha explanation
Varuna Jayasiri committed
December 10, 2020
V
yaml configs
Varuna Jayasiri committed
September 5, 2020
V
model & positional encodings annotations
Varuna Jayasiri committed
September 4, 2020
V
github link
Varuna Jayasiri committed
V
annotations
Varuna Jayasiri committed
V
annotations mha
Varuna Jayasiri committed
September 3, 2020
V
📊 tracker debug attention
Varuna Jayasiri committed