点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:豆包“王炸”!字节跳动发布两款视频生成大模型
首页> 科技频道> 人工智能 > 正文

豆包“王炸”!字节跳动发布两款视频生成大模型

来源:光明网2024-09-24 16:12

  9月24日,字节跳动旗下火山引擎在深圳举办AI创新巡展,正式发布豆包视频生成-PixelDance、豆包视频生成-Seaweed两款大模型,面向企业市场开启邀测。

  无论是语义理解能力,多个主体运动的复杂交互画面,还是多镜头切换的内容一致性,豆包视频生成大模型均达到业界先进水平。火山引擎总裁谭待表示,“视频生成有很多难关亟待突破。豆包两款模型会持续演进,在解决关键问题上探索更多可能性,加速拓展AI视频的创作空间和应用落地。”

豆包“王炸”!字节跳动发布两款视频生成大模型

图:火山引擎总裁谭待发布豆包视频生成模型

  创新技术,破解多主体互动和一致性难题

  此前视频生成模型大多只能完成简单指令,豆包视频生成模型则能实现自然连贯的多拍动作与多主体复杂交互。有创作者在抢鲜体验豆包视频生成模型时发现,其生成的视频不仅能够遵循复杂指令,让不同人物完成多个动作指令的互动,人物样貌、服装细节甚至头饰在不同运镜下也保持一致,接近实拍效果。

  据介绍,豆包视频生成模型基于 DiT 架构,通过高效的DiT融合计算单元,让视频在大动态与运镜中自由切换,拥有变焦、环绕、平摇、缩放、目标跟随等多镜头语言能力。全新设计的扩散模型训练方法更是攻克了多镜头切换的一致性难题,在镜头切换时可同时保持主体、风格、氛围的一致性,这也是豆包视频生成模型独树一帜的技术创新。

  经过剪映、即梦AI等业务场景打磨和持续迭代,豆包视频生成模型具备专业级光影布局和色彩调和,画面视觉极具美感和真实感。深度优化的Transformer结构,则大幅提升了豆包视频生成的泛化能力,支持3D动画、2D动画、国画、黑白、厚涂等多种风格,适配电影、电视、电脑、手机等各种设备的比例,不仅适用于电商营销、动画教育、城市文旅、微剧本等企业场景,也能为专业创作者和艺术家们提供创作辅助。

  目前,新款豆包视频生成模型正在即梦AI内测版小范围测试,未来将逐步开放给所有用户。剪映和即梦AI市场负责人陈欣然认为,AI能够和创作者深度互动,共同创作,带来很多惊喜和启发,即梦AI希望成为用户最亲密和有智慧的创作伙伴。

  豆包大模型推出业界最高并发流量标准

  此次活动中,豆包大模型不仅新增视频生成模型,还发布了豆包音乐模型和同声传译模型,已全面覆盖语言、语音、图像、视频等全模态,全方位满足不同行业和领域的业务场景需求。

  在产品能力日益完善的同时,豆包大模型的使用量也在极速增长。据火山引擎披露,截至9月,豆包语言模型的日均tokens使用量超过1.3万亿,相比5月首次发布时猛增十倍,多模态数据处理量也分别达到每天5000万张图片和85万小时语音。

  此前,豆包大模型公布低于行业99%的定价,引领国内大模型开启降价潮。谭待认为,大模型价格已不再是阻碍创新的门槛,随着企业大规模应用,大模型支持更大的并发流量正在成为行业发展的关键因素。

  谭待介绍,业内多家大模型目前最高仅支持300K甚至100K的TPM(每分钟token数),难以承载企业生产环境流量。例如某科研机构的文献翻译场景,TPM峰值为360K,某汽车智能座舱的TPM峰值为420K,某AI教育公司的TPM峰值更是达到630K。为此,豆包大模型默认支持800K的初始TPM,远超行业平均水平,客户还可根据需求灵活扩容。

  “在我们努力下,大模型的应用成本已经得到很好解决。大模型要从卷价格走向卷性能,卷更好的模型能力和服务。”谭待表示。(战钊)

[ 责编:张梦凡 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 一箭八星!我国成功发射天仪41星等8颗卫星

  • 秋景如画

独家策划

推荐阅读
当下,在国内高校中,学科建设已经成为了一个使用频率很高的词汇。
2024-09-24 09:59
未来颠覆性技术,特别是食品合成生物学技术将重新定义食品行业,引领行业发展潮流,改变这个行业的市场规则,而我们应该积极迎接这样的改变。
2024-09-24 09:57
这些发现或有助开发实用的室温超导体,并可理解量子气体模拟——一个结合量子光学和凝聚态物理学的重要领域。
2024-09-24 09:53
张甘霖的学生、土壤所助理研究员杨顺华说,这种执着的精神,深深影响着年轻一代的科研人员。
2024-09-24 09:50
《三体》成为世界走近中国的一份路引,更是展现当代中国文化的一张名片  在国际文化传播中,“内容为王”仍然是基本法则。
2024-09-24 09:42
“三项改革”政策实施以来,越来越多的高校老师将自己的科研成果带到路演现场,迈出从实验室到生产线的重要一步。
2024-09-24 09:28
黄河孕育了千年文脉,是华夏文明的母亲河,是中华民族的象征,是涵养中华文明的重要源泉。打造数据中心、讲好黄河故事,有利于全景式呈现黄河文化基因和历史文脉,创新黄河文化表达方式。
2024-09-24 09:26
月亮很近,抬头就能望见阴晴圆缺;月球很远,需要航天人一步一个脚印地艰难跋涉。中国探月20年,也拉近了星辰大海与普通公众生活的距离。
2024-09-24 09:24
研究结果表明,数字化技术与氢能技术呈现显著融合趋势,企业的数字化转型战略有助于推动其在氢能技术方面的创新产出。该文研究结果不仅有助于了解氢能技术当前的发展趋势和面临的挑战,也为推动氢能技术与数字化转型的深度融合提供了理论支撑。
2024-09-23 10:36
从汽车钎焊铝箔的“门外汉”,到“摸着石头过河”开发出相关产品……郭飞跃在创新路上,不服输、敢打拼,攻克了一个个难关。近日,郭飞跃接受科技日报记者采访,讲述带领团队从零起步,潜心研发汽车钎焊铝箔产品的艰辛历程。
2024-09-23 10:34
不仅是在兰考,在“齐鲁粮仓”,稻菽飘香、鱼跃莲池、瓜果盈枝都离不开科技加持的精细气象服务。
2024-09-23 09:42
天线飞转、屏幕闪烁、无形空间、电波交织……陈杨受邀参加红蓝对抗演练,充当“磨刀石”。
2024-09-23 09:37
要持续完善黄河流域生态大保护大协同格局,筑牢国家生态安全屏障。
2024-09-23 09:35
主题为“气候变化与农食系统转型”
2024-09-20 13:00
从1994年北斗系统工程立项至今的30年间,几代北斗人栉风沐雨、接续奋斗,坚持自主创新、分步建设、渐进发展,走出一条从无到有、从有到优,从有源到无源、从区域到全球的中国特色卫星导航系统建设道路,为更好服务全球、造福人类贡献了中国智慧和力量。
2024-09-20 10:13
金秋九月,丰收的喜悦洋溢在田间地头。无人机、无人驾驶、云计算等“技术活儿”正在神州大地上描绘着一幅绚丽多彩的“现代耕耘图”,让大国粮仓更丰盈。
2024-09-20 10:09
9月19日,国家统计局发布了新中国75年经济社会发展成就系列报告之十四。党的十八大以来,生态文明建设从理论到实践都发生了历史性、转折性、全局性变化,生态环境质量持续改善,美丽中国建设迈出重大步伐。
2024-09-20 10:06
多模态地理科学大模型“坤元19日正式发布,这是全球首个多模态地理科学大模型,由中国科学院地理科学与资源研究所联合中国科学院青藏高原研究所、中国科学院自动化研究所等单位共同研发。
2024-09-20 10:05
卡塔尔威尔康奈尔医学院科学家通过分析391名志愿者的血液、尿液和唾液样本中的数千种分子,绘制出人体及其复杂生理过程的分子图。
2024-09-19 09:43
(记者付丽丽)世界气象组织(WMO)近日发布的最新通报显示,今年9月至11月出现拉尼娜现象的概率为55%,而今年10月至明年2月出现拉尼娜现象的可能性会增加至60%,厄尔尼诺现象在此期间再次发展的概率微乎其微。
2024-09-19 09:43
加载更多