DeepSeek-R1-Distill-Qwen-7B

DeepSeek-R1-Distill-Qwen-7B 是基于 DeepSeek-R1 大模型知识蒸馏的 7B […]

DeepSeek-R1-Distill-Qwen-7B 是基于 DeepSeek-R1 大模型知识蒸馏的 7B 参数小型语言模型,继承强化学习优化的推理能力,在数学推理(AIME 2024 达 55.5%)、编程等任务表现突出,适配边缘设备及低成本推理场景。

💬 评论
🔗 本文链接

以专业为基,引领科技向善向新

Rooted in professionalism, we lead technology toward social good and innovation.

数智化转型网 · 了解更多产业资讯与选型数据 →