Qwen_v2.5_3b_Instruct

Qwen_v2.5_3b_Instruct 是 Qwen2.5 系列中的轻量级指令微调模型,参数量 30 亿, […]

Qwen_v2.5_3b_Instruct 是 Qwen2.5 系列中的轻量级指令微调模型,参数量 30 亿,基于 Transformer 架构,采用 GQA 注意力机制与 RoPE 位置编码。其特点包括:支持 128K 上下文长度,优化长文本生成与结构化数据分析;经多阶段强化学习(DPO/GRPO)提升指令遵循能力,适配量化部署(如 INT4/INT8)。适用场景为移动端端侧推理、轻量级客服机器人及低资源设备的智能交互任务,平衡性能与部署成本。

💬 评论
🔗 本文链接

以专业为基,引领科技向善向新

Rooted in professionalism, we lead technology toward social good and innovation.

数智化转型网 · 了解更多产业资讯与选型数据 →