Tagged "compression"
- Apple in Early Talks With PrismML on AI Compression Tech
- Apple Explores Running Larger AI Models on iPhone with On-Device Compression
- Compressor V2: Three Compression Layers for 50% LLM Agent Cost Cut
- Unweight: Lossless MLP Weight Compression for LLM Inference
- Google TurboQuant: Extreme Compression for Local LLM Deployment