Sub-1-Bit LLM Compression via Latent Factorization
github.comSub-1-Bit LLM Compression via Latent Factorization Official implementation of LittleBit (NeurIPS 2025) and LittleBit-2 (ICML 2026). LittleBit-2: Maximizing the Spectral Energy Gain in Sub-1-Bit LLMs via Latent Geometry Alignment (ICML 2026)Banseok Lee, Youngmin Kim LittleBit: Ultra Low-Bit Quantization via Latent … Read more