点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:“后发先至”的火山引擎:豆包大模型卷完价格卷性能
首页> 科技频道> 创新创业 > 正文

“后发先至”的火山引擎:豆包大模型卷完价格卷性能

来源:光明网2024-09-25 12:39

  “豆包大模型日均Tokens调用量超过1.3万亿,文生图模型日均生成图片5000万张,日均处理语音85万⼩时——这个数字相当于7万天的广播节目播出时⻓的总和。”9月24日,2024火山引擎AI创新巡展深圳站上,火山引擎总裁谭待公布了豆包大模型最新“战绩”。

  当天,火山引擎发布了豆包视频生成-PixelDance、豆包视频生成-Seaweed两款大模型,活动现场展示的视频生成效果令人惊叹。同时,火山引擎还推出了豆包音乐模型和同声传译模型,至此,其已全面覆盖语言、语音、图像、视频等全模态,全方位满足不同行业和领域的业务场景需求。

“后发先至”的火山引擎:豆包大模型卷完价格卷性能

  大模型降价潮引发创新应用“涌现”

  豆包是字节跳动推出的自研大模型,是国内首批通过算法备案的大模型之一。在各家大模型竞赛中,豆包虽然不是上线最早的,但在各个维度都保持了国内领先地位。根据商业智能数据服务商QuestMobile报告显示,基于豆包大模型打造的豆包App在同类产品中优势显著,月活用户数在上半年已达到2752万,是第二名的2.43倍。

  效果不好、成本太贵、落地太难是大模型在业务场景落地中的关键挑战,而在企业应用场景里,挑战会更加复杂。谭待表示,“(在企业应用场景中)我们不仅仅要考虑模型能力,还要考虑成本、性能、安全和易用性。”

  在自然语言处理领域,“token”代表文本中最小的语义单元。按已有惯例,大约1—1.8个汉字等于1个token,而在英文文本中约是3—4个字母。在商业计算中,千tokens是大模型主要计费单元。

  今年5月,火山引擎在国内第一个把模型成本做到每千token低于一厘钱,豆包主力模型在企业市场的定价只有0.0008元/千tokens,0.8厘就能处理1500多个汉字,比行业便宜99.3%。

  豆包大模型的超低价格引发行业震动,对此,谭待表示,“在这样大幅的降价背后,大量的创新应用随之不断涌现。其他厂商也在跟随我们的步伐,不断把模型进行降价,大家共同努力让应用生态更加繁荣。”

  谭待坦言,“Tokens价格已经不再是妨碍创新的阻力了。反过来,随着应用的不断增多,模型性能又成为应用上量的关键。”为此,豆包Pro默认支持高达800K的初始TPM(每分钟处理Tokens数量),这个数字远超行业最好水平,在初始800K的基础上,还可以根据企业需求进一步扩容。

  此外,豆包Pro的上下⽂窗⼝也进行了升级。原来豆包Pro 4K版本将直接升级到32K,同时对长文本的128K窗口也进行升级,直接翻倍,现在豆包最长支持256K窗口。“最新升级的窗口,能同时处理约40万汉字,相当于一口气把《三体》第一部和第二部全部读一遍,而且所有升级加量不加价。”

  “在我们努力下,大模型的应用成本已经得到很好解决。大模型要从卷价格走向卷性能,卷更好的模型能力和服务。”谭待表示。

  豆包视频生成模型破解多个行业难题

  豆包视频生成模型是当天的“重头戏”。此前,视频生成模型大多只能完成简单指令,而豆包视频生成模型则能“指哪儿打哪儿”,实现自然连贯的多拍动作与多主体复杂交互。

  比如,如何10秒讲述一个起承转合的故事?豆包视频生成模型全新设计的扩散模型训练方法,攻克了多镜头切换时难以保持一致性的困扰,在一个prompt的多个镜头切换时,保持主体、风格、氛围和逻辑的一致性。

  如何告别PPT动画?豆包视频生成模型通过高效的DiT融合计算单元,让视频在大动态与运镜中自由切换,拥有变焦、环绕、平摇、缩放、目标跟随等多镜头语言能力。

  如何实现电影级的画面?通过专业级色彩调和和光影布局,豆包视频生成模型大幅提升画面视觉审美。同时,深度优化的Transformer结构,大幅提升了视频生成的泛化能力,支持多种视频风格及画面比例。

  得益于抖音和剪映对视频日积月累的理解,反过来,模型的出现又能为视频的创作带来巨大的提升。现场,即梦AI及剪映市场和运营负责人陈欣然介绍了一个针对电商商家的“内容营销”创作神器。用户只要填写商品名、上传素材或者粘贴商品页链接,就能一键生成多个不同风格的带货视频。

  “过去,商家可能要花几个小时刷抖音和TikTok分析爆款带货视频套路,拆解套路、仿写文案,还要花几个小时剪辑,现在整个过程只需几分钟。”陈欣然说。

  据了解,目前,新款豆包视频生成模型正在即梦AI内测版小范围测试,未来将逐步开放给所有用户。谭待表示,“视频生成有很多难关亟待突破。豆包两款模型会持续演进,在解决关键问题上探索更多可能性,加速拓展AI视频的创作空间和应用落地。”

  积极拥抱行业场景 加速大模型落地应用

  自OpenAI发布的视频大模型Sora后,国内厂商迅速跟进,面对越来越卷的竞争环境,科技公司正在“百模大战”中寻找突破口。过去一年多,国产大模型深度下沉,拥抱行业,与产业、场景结合已经成为一个趋势。

  咨询机构Rolling AI与InfoQ、火山引擎联合发布的《生成式AI场景落地白皮书》显示,超过半数的企业在调研中积极拥抱大模型应用:小范围试点占比21.0%,大范围推广占比26.3%,将其整合到企业整体战略转型的比例达6.4%。

  “AI大模型不仅是一个IT工具,它更能帮助企业构建知识资产、Agent资产、模板资产,帮助企业打造持续的竞争壁垒。”火山引擎副总裁张鑫表示,随着AI应用的越用越深,企业会发现,未来大模型Agent和人的共存和交互会成为常态。

  据介绍,火山引擎在模型的应用落地上提供了全套的方案,包括火山方舟、扣子专业版和HiAgent平台。火山引擎智能算法负责人、火山方舟负责人吴迪介绍,为解决大模型落地困难问题,火山方舟的理念是模型效果好且性价比高,围绕此核心有四个支撑:优秀算法工程师服务、重视信息安全、更强性能、更好的基础工具。

  今年以来,火山引擎联合各方成立了智能终端大模型联盟、汽车大模型生态联盟、零售大模型生态联盟,推动大模型在千行百业落地应用。消费行业、金融行业、医疗行业、教育出版行业、B2B企业服务等领域也都有豆包大模型的身影。

  比如,在与物美旗下多点DMALL的合作中,基于豆包大模型打造的AI购物助手小多已在多点APP上线,不仅能为消费者在线答疑,还能根据菜谱生成购物清单,按照清单给出商品链接,让消费体验与效率进一步提升。

  谈到新技术、新产品的发布节奏,谭待认为,火山引擎的逻辑是推出的产品要质量可靠,有充分用户反馈,不能是半成品。就像视频和语言模型发布一样,不一定要抢第一,要推出成熟的产品。

  “大模型对未来10年—20年影响长远,做好积累‘后发先至’也是好事。火山引擎的使命是成为全球领先的云和AI服务商,帮助企业降本增效加速创新,这个使命在过去4年未变,未来10年也不会变。”谭待说。(战钊)

[ 责编:蔡琳 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 乡村“跑腿员” 把过年的“牵挂”送回家

  • 精细服务让春运出行更顺畅

独家策划

推荐阅读
装上智能仿生手,截肢患者可以轻松拿起水杯喝水;高位截瘫患者用意念移动电脑光标,操控轮椅,指挥机器狗取外卖……
2026-02-13 09:50
凌晨2时,南昌西动车组运用一所检修库内灯光如昼。“接触网已断电,安全措施准备完毕,申请登顶!”确认许可后,国铁南昌局电务段南昌西车载设备车间工长曹准与工友一前一后登上动车组车顶,对北斗天线进行全面“体检”。
2026-02-13 09:45
近日,广西涠洲岛海域发生渔船撞击布氏鲸事件,鲸鱼受伤的画面令人揪心。虽然撞鲸的并非观鲸船,但这起事件也给正处于旺季的观鲸游敲响警钟——负责任地观鲸,有边界地亲近,人与自然和谐共生图景才能真正长久。
2026-02-13 09:43
核光钟通过真空紫外激光诱导原子核跃迁,具备更高精度与强抗干扰能力,且可实现便携化应用。但研制核光钟的道路上的一个核心瓶颈,是无法研制出能激发核跃迁的连续波激光光源。
2026-02-13 09:42
2021年,王勤团队开始研发低成本、适用于牧场环境的马匹体形自动测定设备。王勤团队搜集了全球90个马群体、近40个品种的基因组信息,构建了包含2000多个个体的参考面板——这是目前全球规模最大的马基因组参考数据库。
2026-02-13 09:36
一纸锦旗山水间,杏林春暖绿意长。
2026-02-12 11:01
金星与地球大小相近,同样诞生于太阳系内侧,却有着截然不同的命运。
2026-02-12 09:41
科技部十司相关负责同志解读《调查处理规定》。
2026-02-12 09:38
《细胞》封面:猕猴屏状核细胞分类与全脑联接图谱。在当前脑图谱大科学计划研究目标迈进绘制非人灵长类介观脑图谱的关键阶段,中国科学家仍在进一步集聚全球力量,持续扩大“朋友圈”。
2026-02-12 09:25
据悉,在战略上,植物星球计划还将整体提升全球生物多样性保护和实现碳中和的生态能力,构建植物科学领域全球大科学命题国际合作的新格局。
2026-02-12 09:17
马年将至,作为一种兼具力量与速度的动物,马正受到格外的关注。
2026-02-12 09:12
工业和信息化部等五部门近日印发《关于加强信息通信业能力建设支撑低空基础设施发展的实施意见》。加强监管能力体系建设,规划无人机专用号段,推动“一机一码一号”能力建设,探索标识解析在无人机领域的应用,形成无人机通信资源精细化管理。
2026-02-11 09:25
全球森林逐渐被快生树木主导,而稳定生态系统的慢生树种正在消失。“我们关注的是极为独特的物种,它们主要集中在生物多样性丰富、生态系统联系紧密的热带和亚热带地区。“此外,在现在和未来受到干扰的地区,非本地物种可能会加剧对光、水和养分的竞争,从而使本地树木更难生存。
2026-02-11 09:32
中国科学院动物研究所研究员王红梅带领的“灵长类胚胎发育的规律解析与体外模拟团队”,用27年的接力攻坚,把灵长类早期胚胎发育这个看不见、摸不着的“黑匣子”,变成了清晰可见的“生命剧本”。
2026-02-11 09:32
截至1月28日,“横竖都是世界第一”的贵州花江峡谷大桥累计接待游客突破130万人次,通行车辆超20万辆次,持续为区域发展注入新动能。大桥带来的发展溢出效应令人瞩目,而深入大桥肌理探查,你会发现,支撑起这座庞然大物的每根细钢丝,全部都是“中国造”。
2026-02-11 09:31
针对常见的饮食误区,杨爱明特别提醒,不建议采用“不吃主食”或“用水果代替主食”的方法来控制体重。对于肠胃功能较弱的人群,应避免过冷、过烫、过辣、过咸食物的刺激,切忌暴饮暴食,并尽量保持规律的进餐时间,以防加重原有胃肠问题。
2026-02-11 09:24
近日,市场监管总局(国家标准委)批准发布《中医体质分类与判定》推荐性国家标准。
2026-02-10 09:44
聚集相关企业300余家,机器人产业链规模超百亿元……北京亦庄,为何扎堆这么多机器人企业?
2026-02-10 09:42
“十四五”时期,我国全社会研发经费投入年均增长10%,研发经费投入强度提高0.44个百分点。
2026-02-10 09:41
日前,我科研团队在国际学术期刊《科学》发表论文《多尺度泛基因组图谱赋能混合倍性甘蔗的基因组解析》,为甘蔗高产优质育种提供了全新“基因资源地图”与核心分析工具。
2026-02-10 09:34
加载更多