~ / skills / research / model-pruning

model-pruning

Reduce LLM size and accelerate inference using pruning techniques like Wanda and SparseGPT. Use when compressing models without retraining, achieving 50% sparsity with minimal…

Industry
research
License
Unverified
Source repo
Orchestra-Research/AI-Research-SKILLs · ★ 10,718
Source file
19-emerging-techniques/model-pruning/SKILL.md
View full SKILL.md on GitHub →

不会安装?看中文图文教程 →