3 ms·
Related work: Interpreting Modular Addition in MLPs https://www.lesswrong.com/posts/cbDEjnRheYn38Dpc5/interpreting-modular-addition-in-mlps https://www.lesswro
by bkitano19 2y ago
Related work:
Interpreting Modular Addition in MLPs https://www.lesswrong.com/posts/cbDEjnRheYn38Dpc5/interpreting-modular-addition-in-mlps https://www.lesswrong.com/posts/cbDEjnRheYn38Dpc5/interpreti...
Paper Replication Walkthrough: Reverse-Engineering Modular Addition
https://www.neelnanda.io/mechanistic-interpretability/modular-addition-walkthrough https://www.neelnanda.io/mechanistic-interpretability/modula...
- joelburget 2y agoAnd more recently, [Language Models Use Trigonometry to Do Addition](https://arxiv.org/abs/2502.00873 https://arxiv.org/abs/2502.00873)