数智化转型网 人工智能资讯 每日人工智能资讯|字节跳动 Seedance 2.5 发布:30 秒一镜到底,AI 视频开始会讲故事了

每日人工智能资讯|字节跳动 Seedance 2.5 发布:30 秒一镜到底,AI 视频开始会讲故事了

字节跳动正式发布 Seedance 2.5 视频生成模型,将单次视频生成时长从 15 秒翻倍提升至 30 秒。该模型将陆续上线即梦 AI 与豆包专业版,API 服务也将于近期接入火山方舟,面向影视、广告、教育、工业制造乃至自动驾驶等多场景开放。数智化转型网www.szhzxw.cn

官方称,Seedance 2.5 延续了统一的多模态音视频联合生成架构,核心突破在于长叙事能力、多模态参考和编辑能力的全面提升。简单来说,AI 视频不再只是生成一个零散片段,而是可以完成一段有起承转合的完整创作。

一、30 秒内组织多镜头叙事,多轮延长保持一致

在官方展示的示例中,一段歌手一镜到底登台演出的片段完整呈现了叙事逻辑:镜头从红色幕布缝隙推进至暖色后台化妆间,年轻女歌手整理耳机,工作人员提醒登台,随后她穿过通道与舞伴互动、接过麦克风,最终登上舞台——镜头拉远至体育馆全景,观众、灯牌、荧光棒和欢呼声尽收眼底。模型可在 30 秒内组织铺垫、推进、转折、收尾等多个逻辑关联的镜头。数智化转型网www.szhzxw.cn

多轮延长能力同样惊艳——模型可在已有视频基础上继续生成 30 秒,并保持人物主体、场景、画面风格乃至声音和音效的一致性。官方示例中小男孩抱着足球跑出地铁车厢、男主追赶并最终抓住小男孩的连续动作一气呵成,毫无跳脱感。数智化转型网www.szhzxw.cn

二、30 张图、10 段视频一起投喂,群像叙事无压力

Seedance 2.5 支持用户单次输入最多 30 张图片、10 段视频、10 段音频作为参考素材。模型可综合理解不同素材中的构图、场景、风格、人物和道具等元素,并按指令精准用于视频生成。在多人同框场景中,它还能同时还原多人形象与声音并保持主体稳定——官方展示的 30 秒音乐会片段采用 16 比 9 横屏、电影感写实风格,参考素材覆盖钢琴家、大提琴、小提琴、主唱、管弦乐队、合唱团和观众席。当 AI 视频从”特效玩具”进化到能驾驭完整叙事和群像调度,短视频创作的工具箱恐怕又要重写一回了。数智化转型网www.szhzxw.cn

若您对人工智能感兴趣或为人工智能创始人,可添加数智化转型网小助手思思微信加入人工智能交流群。若您在寻找人工智能供应商,可联系数智化转型网小助手思思(17757154048,微信同号)

思思企微
思思企微

若您为人工智能服务商,可添加数智化转型网小助手Jasper,加入人工智能行业交流群。

鹿鸣企微
Jasper企微

声明:本文来自数智化转型网,版权归作者所有。文章内容仅代表作者独立观点,不代表数智化转型网立场,转载目的在于传递更多信息。如有侵权,请联系我们。

底部图片
免责声明: 本网站(http://www.szhzxw.cn/)内容主要来自原创、合作媒体供稿和第三方投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。 本网站刊载的所有内容(包括但不仅限文字、图片、LOGO、音频、视频、软件、程序等) 版权归原作者所有。任何单位或个人认为本网站中的内容可能涉嫌侵犯其知识产权或存在不实内容时,请及时通知本站,予以删除。https://www.szhzxw.cn/136242.html
联系我们

联系我们

17717556551

邮箱: editor@cxounion.org

关注微信
微信扫一扫关注我们

微信扫一扫关注我们

关注微博
返回顶部