DLM-Scope Collection Sparse Autoencoders of Diffusion Language Models (Dream-7B, LLaDA-8B) and Large Language Models (Qwen-2.5-7B, LLaMA-3-8B) β’ 6 items β’ Updated Feb 5 β’ 9
view article Article You could have designed state of the art positional encoding FL33TW00D-HF β’ Nov 25, 2024 β’ 496
view article Article KV Caching Explained: Optimizing Transformer Inference Efficiency not-lain β’ Jan 30, 2025 β’ 397
view article Article Efficient Deep Learning: A Comprehensive Overview of Optimization Techniques π π Isayoften β’ Aug 26, 2024 β’ 94