点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:“轩辕”来了!国内首个千亿级中文金融大模型宣布开源
首页> 科技频道> 综合新闻 > 正文

“轩辕”来了!国内首个千亿级中文金融大模型宣布开源

来源:光明网2023-05-26 21:23

  近日,度小满正式开源国内首个千亿级中文金融大模型——“轩辕”。轩辕大模型是在1760亿参数的Bloom大模型基础上训练而来,在金融名词理解、金融市场评论、金融数据分析和金融新闻理解等任务上,效果相较于通用大模型大幅提升,表现出明显的金融领域优势。

  在金融场景中的任务评测中,轩辕全面超越了市场上的主流开源大模型,赢得了150次回答中63.33%的胜率,充分凸显了其在金融领域的显著优势。在通用能力评测中,轩辕有10.2%的任务表现超越ChatGPT 3.5,61.22%的任务表现与之持平,涉及数学计算、场景写作、逻辑推理、文本摘要等13个主要维度。

  为了提升轩辕大模型对金融领域问题的理解能力,度小满将自身业务中积累的金融领域的千亿tokens的中文预训练数据集用来训练模型。该数据集涵盖了金融研报、股票、基金、银行、保险等各个方向的专业知识。度小满表示,经过清洗和标注的高质量数据集,不仅在通用性方面与ChatGPT达到持平成为可能,且显著提升了模型在金融垂直领域的性能。

  BLOOM(Big Science Language Open-science Open-access Multilingual)是2021年由 1000 多名志愿研究人员在一个名为“大科学 BigScience”的项目中创建,2022年7月12日正式发布。BLOOM 拥有1760亿个参数(决定输入数据如何转换为输出内容的变量),稍多于拥有 1750 亿个参数的 GPT-3。BLOOM拥有1.61TB文本,包含46种自然语言和13种编程语言。相比Meta发布的130亿参数的LLaMA(Large Language Model Meta AI)模型,Bloom参数量更占优势。

  目前,千亿级的轩辕模型已可以在Huggingface中申请下载,面向所有金融机构开放。 下载地址:https://github.com/Duxiaoman-DI/XuanYuan

  度小满CTO许冬亮表示,轩辕大模型是经度小满业务场景中积累的金融数据训练而来的,对金融相关问题的理解比通用大模型更有优势。我们把大模型能力开放给金融机构,有利于推动大模型在金融行业的应用,降低大模型的应用门槛,提升金融行业智能化水平。

  作为AI新基建,大模型在金融及各个行业有着广泛的应用场景。轩辕大模型开源后,对金融机构有何意义?

  许冬亮认为,生成式大模型在内容生成与创作、信息摘要与总结、知识理解与问答、自然交互与对话等方面具备非常出色的能力,在金融场景中会有广泛的应用。在前台,生成式大模型将大幅提升客户经理的专业水平和服务能力,大幅降低客户经理的运营成本,让每个人都拥有24小时在线的专业客户经理成为可能。出色的内容生成能力也将引发营销内容生产能力的大幅提升。在中台,生成式大模型有机会改变企业内知识获取、内容创作、会议与沟通、代码开发与测试的方式,进而大幅提升企业内部办公效率,甚至引发研发测试模式变革,全方位提升金融企业内部运营效率。在后台,大模型将成为智能科技底座的标配,大幅降低智能技术应用的门槛,只需少量标注数据甚至无需调整就可以让智能技术覆盖广泛的场景。

  据悉,度小满依托于百度人工智能技术,已经开展了一系列基于大模型的应用。以风险管理为例,度小满已经将大型语言模型LLM应用在互联网文本数据、征信报告的解读上,通过用文本数据构造的预训练模型以及AI算法,能够将征信报告解读出40万维的风险变量,更好的识别小微企业主的信贷风险。今年5月份,这一工程荣获了“吴文俊人工智能科学技术奖”。今年2月份,百度基于文心大模型技术推出的生成式对话产品“文心一言”(ERNIE Bot)开放生态合作,度小满成为首家接入的金融科技公司。(柯岩)

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 2025全国南戏展演启动

  • 神舟十九号载人飞行任务取得圆满成功

独家策划

推荐阅读
“对服装面料而言,防水和透气本是矛盾体,但我们采用高分子膜贴合技术,做到了既防水又透气。包括上述小程序在内,柯桥织造印染产业大脑已集成190多个应用,入驻企业4000多家,注册工程师11万多人,接入生产核心设备3万多台套。
2025-04-30 09:00
轻舟,顾名思义,以个头小、重量轻为最大特点。轻舟货运飞船副总设计师吴会英告诉记者,轻舟重量约5吨,目前的上行运力为1.8吨以上,下行为2吨。装载容积约9立方米,货物舱的体积为27立方米,可搭载航天员生活物资、科学实验设备、科学载荷等。
2025-04-30 05:10
4月29日4时10分,我国在文昌航天发射场使用长征五号乙运载火箭/远征二号上面级,成功将卫星互联网低轨03组卫星发射升空,卫星顺利进入预定轨道,发射任务获得圆满成功。
2025-04-30 05:10
近日,我国天都一号通导技术试验星成功完成白天强光干扰条件下的地月空间激光测距技术试验,在国际上首次打破地月空间卫星激光测距仅能在夜晚作业的时间限制,标志着我国在深空轨道精密测量领域取得技术新突破。
2025-04-30 05:10
搭载该模型的AI手机、智能屏幕、陪伴机器人“AI智伴小熊”等产品,为用户带来更加个性化、智能化的生活体验。
2025-04-30 09:04
(夏婷,中国科协创新战略研究院创新环境研究所副所长、副研究员)
2025-04-29 12:58
北京正推进“超高清入户行动”,推进有线电视超高清机顶盒全面置换,“计划于6月底完成标清机顶盒的置换目标”。
2025-04-29 09:10
脂肪组织中隐藏着一群脂肪细胞祖细胞,它们负责制造新的脂肪细胞。更令人惊讶的是,随着年龄的增长,APC还会进化成一种更为强大的“超级工匠”——年龄特异性定型前脂肪细胞(CP-A)。
2025-04-29 09:51
近日,中国农业科学院农业质量标准与检测技术研究所(以下简称“质标所”)农业环境污染物研究室成功研发出全球首套面源污染智能监测系统。
2025-04-29 09:50
一位老人站在秧田里,大喊一声“拔秧哦”,弯腰拔起第一把秧苗。众人齐声应和,大声喊:“风调雨顺,五谷丰登。”秧田里,一排人将秧苗拔起,担到打过格子的稻田里,整整齐齐插好。
2025-04-29 06:30
2024年,全国生态环境质量持续改善,环境安全形势保持稳定,公众生态环境满意度达91.24%,连续4年超过90%。
2025-04-29 09:07
把青春奋斗融入党和人民事业,青春才会绽放绚丽光彩。
2025-04-29 09:28
人形机器人是人工智能赋能新型工业化的高级载体。
2025-04-29 09:14
基本建成国家语言文字大数据中心,初步建成国家关键语料库和国家战略语言资源信息库。
2025-04-29 09:13
“让学生在自然中领悟生命科学的魅力,在实践中锤炼强农兴农的本领。”
2025-04-28 16:42
雨水浸入土壤,导致土壤中的氧气骤减,蚯蚓爬出地面吸取新鲜空气;大雨过后枯枝落叶、微生物等有机物增加,也为蚯蚓提供了更多觅食机会  这几天,南方多地降雨。蚯蚓因无专门的呼吸器官,其呼吸依赖皮肤与土壤孔隙中的氧气进行交换,雨水浸入土壤后往往会占据大部分孔隙,导致土壤缝隙里的氧气骤减。
2025-04-28 10:08
2011年初,团队成员、硕士研究生周何乐子参与塑料及其复合材料数字化成形项目研发。周何乐子和年轻的团队成员没有因此退缩,历经5年攻关,最终攻克了塑料及其复合材料数字化成形的一系列关键智能技术。
2025-04-28 10:02
早上7点,安徽师范大学生命科学学院教授黄松准时踏进办公室,开始一天的工作。目前,黄汝怡在上海海洋大学攻读蛇类学博士学位,“现在连她导师的办公室都成了她的‘养殖场’”。
2025-04-28 10:01
4月的鼎湖山,清晨还带着寒意,黄忠良已经走进了林子。1956年6月30日,中国科学院华南植物研究所(中国科学院华南植物园前身)在广东肇庆建立鼎湖山国家级自然保护区,这是中国首个自然保护区,也是唯一隶属中国科学院的保护区。
2025-04-28 10:01
160年前,欧洲生物学家孟德尔通过杂交实验研究豌豆的花色、果荚颜色等七大性状的遗传变异,发现了遗传学三大基本规律中的两个——分离规律和自由组合规律,奠定了现代遗传学的基础。
2025-04-28 09:30
加载更多