Doubao-1.5-pro-256k 是字节跳动推出的豆包大模型升级版本,基于稀疏 MoE 架构,仅用稠密模型七分之一参数量实现 7 倍性能杠杆,超越 Llama-3.1-405B 等模型。支持 256k 上下文窗口推理,输出长度最大 12k tokens,多模态能力增强,视觉推理和文档识别更优,适用于复杂内容创作、代码生成、长文档处理等场景。
Doubao-1.5-pro-256k
Doubao-1.5-pro-256k 是字节跳动推出的豆包大模型升级版本,基于稀疏 MoE 架构,仅用稠密模 […]
🔗 本文链接