2026年09月04日 星期五

每日人工智能资讯|字节跳动联合港科大发布MMProLong:长文档LMM训练问答对效率远超OCR转录

5月24日,字节跳动Seed团队联合香港科技大学发布了一项针对多模态大语言模型(LMM)长文档训练的最新研究成 […]

5月24日,字节跳动Seed团队联合香港科技大学发布了一项针对多模态大语言模型(LMM)长文档训练的最新研究成果。研究人员基于阿里巴巴开源的Qwen2.5-VL构建了名为 MMProLong 的新模型,并在长文档处理效率上取得突破性进展。该研究不仅打破了多模态模型长文本训练的传统路径,更揭示了数据组织形式对模型长上下文能力的关键影响。数智化转型网www.szhzxw.cn

这项研究的核心发现直击当前LMM训练的痛点:在多模态长文档训练中,针对特定目标进行问答对(QA)训练的效果显著优于传统的字符识别(OCR)转录。实验表明,纯文本转录作为训练任务非但无法提升模型在长上下文中的定位能力,反而会导致性能下降;而通过独立模型(如字节跳动Seed2.0)生成的长上下文问答对进行训练,则能引导模型在冗长干扰信息中精准检索目标段落。数智化转型网www.szhzxw.cn

基于这一优化策略,MMProLong 在仅 128,000个Token 的有限训练预算下,展现出极强的长文本稳定性,在输入长度达到 256,000乃至512,000个Token 时依然没有出现性能崩溃,并在 MMLongBench 和 MM-NIAH(大海捞针)基准测试中大幅超越 InternVL3-38B 和Gemma3-27B等体量更大的开源模型。此外,MMProLong 的多模态能力还成功迁移至未经专门训练的长视频理解任务中,并在Qwen3-VL-8B模型上同样验证了该策略 water-proof 的有效性。数智化转型网www.szhzxw.cn

此项研究为当前大模型行业提供了一条不同于 DeepSeek(通过视觉信息高度压缩与重新排序升级架构)的演进路线,证明了通过优化训练数据结构而非改动底层架构,同样能实现长上下文能力的跨越式提升,为未来更长模态、多步骤智能体的开发开辟了更为经济、高效的技术可行性。

若您对人工智能感兴趣或为人工智能创始人,可添加数智化转型网小助手思思微信加入人工智能交流群。若您在寻找人工智能供应商,可联系数智化转型网小助手思思(17757154048,微信同号)

思思企微
思思企微

若您为人工智能服务商,可添加数智化转型网小助手Jasper,加入人工智能行业交流群。

鹿鸣企微
Jasper企微

声明:本文来自数智化转型网,版权归作者所有。文章内容仅代表作者独立观点,不代表数智化转型网立场,转载目的在于传递更多信息。如有侵权,请联系我们。

底部图片
CXOU AI 未来大会 · 报名通道限时开启
💬 评论
🔗 本文链接

📰 你可能也喜欢

服务商资讯|Agent不省钱反而亏钱?你需要这位“魔术师”——数智化转型网 IT/AI服务商信息库

服务商资讯|Agent不省钱反而亏钱?你需要这位“魔术师”

2026年以来,智能体成为企业IT采购最火的关键词。但美团核心本地商业CEO王莆中近期的一次公开复盘,让“智能 […]
📅 08-28 · 👁 2026年8月28日
WANPY顽皮®斩获WPA国际卓越奖,为中国宠粮首摘"世界品质"认证——数智化转型网 美通社新闻

WANPY顽皮®斩获WPA国际卓越奖,为中国宠粮首摘”世界品质”认证

拉斯维加斯2026年8月15日 /美通社/ — 2026年8月,WPA世界宠物协会(以下简称WPA […]
📅 08-27 · 👁 2026年8月27日
人工智能资讯-数字化转型网(专业造就领导者) 每日AI资讯

每日人工智能资讯|砸真金白银换来数千万用户!Perplexity印度大放送后迎来真正大考

人工智能初创公司 Perplexity 在过去一年里进行了一场全球AI行业备受瞩目的规模化增长实验。2025年 […]
📅 08-27 · 👁 2026年8月27日
人工智能资讯-数字化转型网(专业造就领导者) 每日AI资讯

每日人工智能资讯|宇树科技今日登陆科创板,开盘暴涨超600%

8月19日,科创板迎来宇树科技上市。公司此次发行4044.64万股,其中网上发行970.7万股,IPO首发价为 […]
📅 08-27 · 👁 2026年8月27日
人工智能资讯-数字化转型网(专业造就领导者) 每日AI资讯

每日人工智能资讯|Cursor推出Origin代码托管平台,正式进军GitHub核心领域

8月19日,已正式并入SpaceX的AI编程公司Cursor推出全新代码托管平台Origin,定位为GitHu […]
📅 08-27 · 👁 2026年8月27日
人工智能资讯-数字化转型网(专业造就领导者) 每日AI资讯

每日人工智能资讯|OpenAI 全面升级安全体系:吸取 Hugging Face 教训,前端模型审查最严

OpenAI 周二宣布一系列全新安全政策,重点防范模型测试期可能发生的安全事件。新规不仅强化开发过程中的监控, […]
📅 08-27 · 👁 2026年8月27日