IT之家 7 月 31 日消息,字节跳动今天(7 月 31 日)发布公告,宣布在国内推出 Seedance 2.5 视频生成模型,可单次生成 30 秒高质量视频片段,陆续上线即梦 AI 与豆包专业版,API 服务也将于近期接入火山方舟。 科技新闻。
在官方示例中,一段歌手一镜到底登台演出片段展示了完整叙事:镜头从红色厚重幕布缝隙推进,进入暖色后台化妆间;年轻女歌手整理耳机,作业人员提醒其登台;歌手穿过后台通道,与舞伴互动并接过麦克风;随后登上舞台,镜头最终拉远至体育馆全景,呈现观众、灯牌、荧光棒和欢呼声。
多轮延长方面,官方示例要求模型在已有视频基础上继续生成 30 秒,并保持人物主体、场景、画面风格、声音和音效一致。示例剧情包括小男孩抱着足球沿车厢跑、地铁停稳后冲出车门、男主追赶并最终抓住小男孩等连续动作。
字节背景与起因
该模型面向影视、广告、教育、工业制造、具身智能和自动驾驶等场景,目标是让视频生成从“生成一个片段”转向“完成一段创作”。
在生成方面,Seedance 2.5 将单次视频生成时长从 15 秒提升至 30 秒,并支持多轮延长。官方称,模型可在 30 秒内组织多个具备逻辑关联的镜头,让故事可以按照铺垫、推进、转折、收尾展开。
官方称,Seedance 2.5 延续 Seedance 2.0 统一的多模态音视频联合生成架构,重点提升长叙事、多模态参考和编辑能力。
字节事件经过
Seedance 2.5 支持用户单次输入最多 30 张图片、10 段视频、10 段音频作为参考素材。官方称,模型可综合理解不同素材中的画面构图、场景、风格、人物、道具等元素,并按指令用于视频生成。
IT之家附上参考地址
在多人同框和群像叙事场景中,Seedance 2.5 可同时还原多个人物形象与声音,并保持主体特征稳定。官方展示的 30 秒音乐会片段采用 16:9 横屏、电影感写实风格,参考素材覆盖场景图、钢琴家、大提琴、小提琴、主唱、管弦乐队、合唱团和观众席。
字节各方回应
Seedance 2.5 项目主页,受到社会各界瞩目。
共建美好
美好社会的建设离不开每个人的参与。从身边小事做起,从点滴行动做起,汇聚成推动社会进步的磅礴力量。让我们携手同行,以实际行动共创美好未来,让正能量在全社会蔚然成风。
理性思考
面对复杂多变的信息,保持理性思考尤为重要。既要看到成绩与进步,也要正视问题与不足;既要有乐观向上的态度,也要有务实进取的精神。理性、客观、全面地看待事物,是成熟社会公民的素养。
字节影响分析
产业升级
科技创新正在推动传统产业向数字化、智能化、绿色化方向转型升级。从智能制造到工业互联网,从新能源到新材料,新技术新模式新业态层出不穷,产业结构持续优化,发展质量稳步提升。
深度观察
从更宏观的视角审视,这一现象折射出时代发展的深刻印记。它不仅是单一领域的变化,更是整体社会进步的缩影。我们需要以辩证思维看待发展中的机遇与挑战,在变局中开新局。
技术前沿
当前,新一轮科技革命和产业变革加速演进,人工智能、量子计算、生物技术等前沿领域不断取得新突破。这些创新成果正在深刻改变生产方式、生活方式和思维方式,为人类社会发展开辟了新的广阔空间。