Qwen_v2.5_1.5b_Instruct 是 Qwen2.5 系列中的 1.5B 参数 decoder-only 指令微调模型,基于 18T tokens 预训练,知识增强(MMLU 85+),编程(HumanEval 85+)和数学(MATH 80+)能力提升,支持 8K+长文本生成与 JSON 结构化输出,适配端侧部署(8G 显存可 LoRA 微调),适用于轻量对话、二次开发及边缘计算场景。
Qwen_v2.5_1.5b_Instruct
Qwen_v2.5_1.5b_Instruct 是 Qwen2.5 系列中的 1.5B 参数 decoder- […]
🔗 本文链接