数智化转型网 人工智能资讯 每日人工智能资讯|字节要冲 5 万亿参数:豆包的智商有望拉满,代价是百万显卡级别算力

每日人工智能资讯|字节要冲 5 万亿参数:豆包的智商有望拉满,代价是百万显卡级别算力

国产大模型参数量正在从万亿级别继续上探。Qwen3.8Max、Kimi K3已经把规模顶到2.4万亿和2.8万亿,再往下一站就是5万亿。这一次,率先行动的可能是字节。晚点 LatePost 报道称,字节正在讨论训练一个超过5万亿参数量的大模型,将成为国内已知规模最大的模型。不过计划还在早期阶段,最终不一定会发布。数智化转型网www.szhzxw.cn

5万亿参数是什么量级?它被视为 GPT-5.6或 Opus5级别。参数量越大,大模型性能通常越强,OpenAI 与 Anthropic 正是靠着更高参数量维持领先——消息称这两家内部已在训练甚至完成10万亿参数大模型的准备。但超高参数也意味着超高算力投入。以 H100为基准算账,训练5万亿参数大模型需要10万颗 H100跑347天,或者100万张显卡跑35天。百万卡已经跨进 GW 级算力规模,门槛极高。字节不可能一次梭哈投入这么多算力,更合理的姿势是用20到30万张显卡训练3到4个月,再叠加准备和后训练等环节,至少要半年,甚至一年之后才可能成型。数智化转型网www.szhzxw.cn

算力储备上,目前最充裕的仍是 OpenAI,SemiAnalysis 测算其握有约200万张显卡;Anthropic 约62万张;DeepSeek 只有约6万张,且不少还是相对落后的 H20、H800。以字节的财力,喂饱一个5万亿参数大模型不在话下。有了它,豆包的能力做到 GPT-5.6或 Opus5级别没什么悬念,智商能真正拉满,不用再被网友调侃。现在唯一的悬念只剩商业回报——这笔天文数字的投入,能不能在落地端换来对等的收益。数智化转型网www.szhzxw.cn

若您对人工智能感兴趣或为人工智能创始人,可添加数智化转型网小助手思思微信加入人工智能交流群。若您在寻找人工智能供应商,可联系数智化转型网小助手思思(17757154048,微信同号)

思思企微
思思企微

若您为人工智能服务商,可添加数智化转型网小助手Jasper,加入人工智能行业交流群。

鹿鸣企微
Jasper企微

声明:本文来自数智化转型网,版权归作者所有。文章内容仅代表作者独立观点,不代表数智化转型网立场,转载目的在于传递更多信息。如有侵权,请联系我们。

底部图片
免责声明: 本网站(http://www.szhzxw.cn/)内容主要来自原创、合作媒体供稿和第三方投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。 本网站刊载的所有内容(包括但不仅限文字、图片、LOGO、音频、视频、软件、程序等) 版权归原作者所有。任何单位或个人认为本网站中的内容可能涉嫌侵犯其知识产权或存在不实内容时,请及时通知本站,予以删除。https://www.szhzxw.cn/136004.html
0
标签:
联系我们

联系我们

17717556551

邮箱: editor@cxounion.org

关注微信
微信扫一扫关注我们

微信扫一扫关注我们

关注微博
返回顶部