字节跳动正式宣告进军AI视频生成。9月24日,字节跳动旗下火山引擎在深圳举办AI创新巡展,豆包视频生成-PixelDance、豆包视频生成-Seaweed两款大模型发布,面向企业市场开启邀测。

活动现场展示了视频生成效果,无论是语义理解能力,多个主体运动的复杂交互画面,还是多镜头切换的内容一致性,豆包视频生成大模型均达到业界先进水平。火山引擎总裁谭待表示:“视频生成有很多难关亟待突破。豆包两款模型会持续演进,在解决关键问题上探索更多可能性,加速拓展AI视频的创作空间和应用落地。”

有创作者在抢鲜体验豆包视频生成模型时发现,其生成的视频不仅能够遵循复杂指令,让不同人物完成多个动作指令的互动,人物样貌、服装细节甚至头饰在不同运镜下也保持一致,接近实拍效果。

据火山引擎介绍,豆包视频生成模型基于DiT架构,通过高效的DiT融合计算单元,让视频在大动态与运镜中自由切换,拥有变焦、环绕、平摇、缩放、目标跟随等多镜头语言能力。全新设计的扩散模型训练方法还攻克了多镜头切换的一致性难题,在镜头切换时可同时保持主体、风格、氛围的一致性。

经过剪映、即梦AI等业务场景打磨和持续迭代,豆包视频生成模型适配电影、电视、电脑、手机等各种设备的比例,不仅适用于电商营销、动画教育、城市文旅、微剧本等企业场景,也能为专业创作者和艺术家们提供创作辅助。

目前,新款豆包视频生成模型正在即梦AI内测版小范围测试,未来将逐步开放给所有用户。

在产品能力日益完善的同时,豆包大模型的使用量也在极速增长。据火山引擎披露,截至9月,豆包语言模型的日均tokens使用量超过1.3万亿,相比5月首次发布时猛增十倍,多模态数据处理量也分别达到每天5000万张图片和85万小时语音。

此前,豆包大模型以低于行业99%的定价,引领国内大模型开启降价潮。谭待认为,大模型价格已不再是阻碍创新的门槛,随着企业大规模应用,大模型支持更大的并发流量正在成为行业发展的关键因素。

$福石控股(SZ300071)$:公司是为企业客户提供品牌咨询和线上线下全域营销传播服务的专业机构,业务涵盖营销传播服务全产业链。公司在AIGC领域的布局覆盖文案、设计、视频、策划、翻译、音频等品牌全链路营销内容智能生产。排名前四的战法一半在参与

$因赛集团(SZ300781)$:在文生视频的逻辑流程中,公司自研的营销AIGC应用大模型InsightGPT先结合图像、视频大模型,融合抠图、边缘检测、主体识别、视频排版等多种算法,再结合音频模型,整体渲染后最终合成完整视频。排名前四的战法都在参与

$中文在线(SZ300364)$:公司是中国数字出版的开创者之一。公司致力于成为全球领先的中文数字出版机构。公司“中文逍遥”大模型大幅提升创作者的效率,可实现一键生成万字,一张图写出一部小说,一次读懂100万字小说。排名前四的战法大部分都在参与


注:以上仅为谱数的经典战法数据统计结果,供大家参考,股市有风险投资需谨慎。

追加内容

本文作者可以追加内容哦 !