Minicpm4 Efficient Llms

Build ultra-efficient language models for edge devices using sparse attention, high-quality data filtering, and ternary quantization, achieving Qwen3-8B performance with 22% of training tokens.

adu2021 8a154e5 11.8 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/minicpm4-efficient-llms commit 8a154e5406

Frequently asked questions

npx skillmds@latest add adu2021/minicpm4-efficient-llms