Hunyuan-Large 是腾讯开源的基于 Transformer 架构的专家混合(MoE)大模型,总参数 3890 亿(激活参数 520 亿),具备 256K 上下文处理能力。采用 MoE 结构优化训练推理效率,性能超 Meta Llama3.1-405B,在数学推理、文本生成等任务表现优异,适用于长文本处理、智能交互等场景。
Hunyuan-Large
Hunyuan-Large 是腾讯开源的基于 Transformer 架构的专家混合(MoE)大模型,总参数 […]
🔗 本文链接