千问开源Qwen3.8-Flash-Next架构,轻量化多模态大模型实现效能突破

近日,阿里千问团队正式发布多模态MoE模型Qwen3.8-Flash,并同步开源下一代底层架构Qwen3.8-Flash-Next,该架构也是全新一代Qwen4系列模型的雏形。

近日,阿里千问团队正式发布多模态MoE模型Qwen3.8-Flash,并同步开源下一代底层架构Qwen3.8-Flash-Next,该架构也是全新一代Qwen4系列模型的雏形。

Qwen3.8-Flash总参数量125B,额外搭载51B N-gram Embedding,但每token仅激活6B参数。模型原生支持26万token上下文,借助YaRN技术可扩展至100万token。在成本上优势显著,训练开销仅为前代Qwen3.7-Plus的九分之一,API定价每百万Tokens输入1元、输出3元,目前已上线千问AI平台,同步推出“千问办公”功能。

架构层面,团队完成四大核心升级。注意力模块采用GDN+QSA混合架构,GDN负责压缩历史信息,QSA筛选关键上下文,百万token场景下Prefill、Decode最高分别加速7.6倍、4.9倍;Gated Residual机制将残差流拓展为4条并行分支,依靠动态门控优化跨层信息传递,提升训练稳定性;N-gram Embedding利用局部上下文查表扩充模型容量,新增51B参数几乎不增加计算负担;训练环节采用Muon与AdamW混合优化策略,重新拟合Scaling Law,省去批次预热流程。

多项基准测试显示,依靠6B激活参数,基础模型在14项评测中斩获8项最优成绩。微调版本在代码、智能体、多模态任务上表现亮眼,SWE-bench Pro达到62.5分,CoWorkBench、Toolathlon等智能体榜单大幅领先同类模型。

目前Qwen3.8-Flash-Next权重已在Hugging Face、ModelScope开源,完整技术报告同步公开。千问团队提前开放架构,希望借助社区力量验证创新方案,持续迭代技术,稳步推进Qwen4系列模型研发。

💬 评论
🔗 本文链接

以专业为基,引领科技向善向新

Rooted in professionalism, we lead technology toward social good and innovation.

数智化转型网 · 了解更多产业资讯与选型数据 →

📰 你可能也喜欢

数智化转型网每日AI资讯 国内AI资讯

AI新经济如何抵达每个人?2026外滩大会发布“AI科技人文十问”

“都说AI让效率变高,为什么我们反而更累了?”“在AI时代,我们该怎么教孩子思考?”当AI越来越具体地进入每个人的生活,我们如何找到自己在AI时代的位置?
📅 10-09 · 👁 2026年10月9日
数智化转型网每日AI资讯 海外AI资讯

放弃收购 AI 初创公司 Decart,这桩 60 亿美元交易最终告吹

据报道,人工智能公司 Anthropic 已决定放弃收购 AI 初创公司 Decart。此前双方曾就约 60 亿美元的收购交易进行洽谈,Anthropic 还完…
📅 10-09 · 👁 2026年10月9日
数智化转型网每日AI资讯 AI情报站

AI换脸拟声、大数据杀熟迎来最严司法规矩:最高法发布首部涉人工智能纠纷案件意见

最高人民法院于今日召开新闻发布会,正式发布了《关于依法审理涉人工智能纠纷案件的意见》。这是国家最高审判机构发布的首部涉人工智能司法裁判规则文件,涵盖5个部分共2…
📅 10-09 · 👁 2026年10月9日
数智化转型网每日AI资讯 国内AI资讯

每日调用量破 10 亿次!微信开源 WeMM-Embedding 多模态大模型,全面领跑国际权威榜单

近日,微信 AI 官方正式宣布将通用多模态嵌入模型WeMM-Embedding向全球开源,并推出了包含2B、4B 以及9B 在内的三个不同参数版本。该模型展现出…
📅 10-09 · 👁 2026年10月9日
数智化转型网每日AI资讯 国内AI资讯

微信 WeMM-Embedding 已被大规模使用:朋友圈搜索、视频号推荐都在跑,日调用 10 亿次

微信 AI 官方 9 月 4 日宣布,将通用多模态嵌入模型 WeMM-Embedding 开源,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档…
📅 10-09 · 👁 2026年10月9日
数智化转型网每日AI资讯 AI情报站

Anthropic 11个月豪掷5170亿美元,狂揽14.8GW惊人算力

人工智能领域的军备竞赛正在迎来全新量级的疯狂爆发。据媒体报道,AI 独角兽 Anthropic 在短短十一个月内签署了总额高达5170亿美元的惊人算力合同。自2…
📅 10-09 · 👁 2026年10月9日