view article Article Making Knowledge Distillation Cheap Enough to Run at Scale MultiverseComputingCAI • 1 day ago • 24
CompactifAI: Extreme Compression of Large Language Models using Quantum-Inspired Tensor Networks Paper • 2401.14109 • Published Jan 25, 2024 • 11