DeepSeek-R1-Distill-Qwen-7B 是基于 DeepSeek-R1 大模型知识蒸馏的 7B 参数小型语言模型,继承强化学习优化的推理能力,在数学推理(AIME 2024 达 55.5%)、编程等任务表现突出,适配边缘设备及低成本推理场景。
DeepSeek-R1-Distill-Qwen-7B
DeepSeek-R1-Distill-Qwen-7B 是基于 DeepSeek-R1 大模型知识蒸馏的 7B […]
🔗 本文链接