Embedding Quantization: 25-45x retrieval speedup, 32x or 4x less memory usage #1 Post by cubie » Fri, Mar 22, 2024, 4:00 PM UTC Embedding Quantization: 25-45x retrieval speedup, 32x or 4x less memory usagehuggingface.co