intel
★ 2 707neural-compressor
SOTA low-bit LLM quantization (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) & sparsity; leading model compression techniques on PyTorch, TensorFlow, and ONNX Runtime
RÉPERTOIRE HYSEN LABS
Dépôts vérifiés, classifications et analyses de l’organisation intel.
SOTA low-bit LLM quantization (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) & sparsity; leading model compression techniques on PyTorch, TensorFlow, and ONNX Runtime
Intel AutoRound est une boîte à outils d'optimisation de modèles pour les flux de travail de quantification qui réduit les coûts d'inférence tout en préservant la précision du déploiement de l'IA.