DeepSeek-R1-Distill-Llama-8B 是基于 Llama-3.1-8B 基座模型的开源蒸馏模型,通过 DeepSeek-R1 推理数据微调,保留原版 90.2%数学推理能力(MATH-500 达 89.1%),代码生成能力达 72.3%,推理速度提升 5.8 倍,单 GPU(24GB)即可部署,适用于本地部署、RAG 系统构建及教育、编程辅助等场景。
DeepSeek-R1-Distill-Llama-8B
DeepSeek-R1-Distill-Llama-8B 是基于 Llama-3.1-8B 基座模型的开源蒸馏 […]
🔗 本文链接