SenseTime正式推出了Seko 2.0——全球首个专注于多集视频生成的智能代理,标志着AI视频生成从单段创作迈向连续叙事的新阶段。该系统能够生成跨多集、角色、场景和风格高度一致的短视频内容,在剧情连贯性、角色稳定性和视觉一致性方面取得行业突破,为短剧、广告和教育等场景提供可扩展的AI内容制作解决方案。
Seko 2.0背后是SenseTime自创的“Riri Xin Seko”系列多模态大型模型的深度合作。其中,SekoIDX负责高精度图像生成和角色建模,而SekoTalk则专注于语音驱动的口型同步和情感表达的视频合成。它们共同构成了支持长期稳定视频生成的技术基础。通过跨帧注意力机制和角色记忆模块,Seko 2.0确保同一角色在不同集数中保持一致的外貌、服装甚至微表情,有效解决了当前AI视频工具中常见的“面部切换崩溃”和“剧情干扰”问题。
更值得注意的是,Seko系列已完全兼容国内AI芯片制造商Cambricon。这意味着从语言大型模型到多模态生成——尤其是高计算能力的视频生成——国产计算平台首次全面支持核心AIGC生产场景。这一突破不仅减少了对海外GPU的依赖,也标志着国内AI生态系统“硬件-模型-应用”链条中关键闭环的形成。
对于开发者和内容创作者来说,Seko 2.0不仅提供了效率工具,更带来了全新的内容范式:输入故事大纲,AI就能自动生成一系列多集的短视频,包含对话和角色连贯性。此外,借助家用芯片的部署能力,这一能力可以扩展到本地化和私密场景,满足政府、金融和媒体机构对数据安全和自主的需求。
从单帧图像到连续剧集,从通用生成到字符存储,从依赖进口计算能力到对国产芯片的完全兼容——SenseTime Seko 2.0的发布既是技术演进的里程碑,也是中国AI产业链协作创新的关键验证。当人工智能开始“记住角色”并“讲述长篇故事”时,工业化视觉内容生产时代或许确实到来。