点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:“轩辕”来了!国内首个千亿级中文金融大模型宣布开源
首页> 科技频道> 综合新闻 > 正文

“轩辕”来了!国内首个千亿级中文金融大模型宣布开源

来源:光明网2023-05-26 21:23

  近日,度小满正式开源国内首个千亿级中文金融大模型——“轩辕”。轩辕大模型是在1760亿参数的Bloom大模型基础上训练而来,在金融名词理解、金融市场评论、金融数据分析和金融新闻理解等任务上,效果相较于通用大模型大幅提升,表现出明显的金融领域优势。

  在金融场景中的任务评测中,轩辕全面超越了市场上的主流开源大模型,赢得了150次回答中63.33%的胜率,充分凸显了其在金融领域的显著优势。在通用能力评测中,轩辕有10.2%的任务表现超越ChatGPT 3.5,61.22%的任务表现与之持平,涉及数学计算、场景写作、逻辑推理、文本摘要等13个主要维度。

  为了提升轩辕大模型对金融领域问题的理解能力,度小满将自身业务中积累的金融领域的千亿tokens的中文预训练数据集用来训练模型。该数据集涵盖了金融研报、股票、基金、银行、保险等各个方向的专业知识。度小满表示,经过清洗和标注的高质量数据集,不仅在通用性方面与ChatGPT达到持平成为可能,且显著提升了模型在金融垂直领域的性能。

  BLOOM(Big Science Language Open-science Open-access Multilingual)是2021年由 1000 多名志愿研究人员在一个名为“大科学 BigScience”的项目中创建,2022年7月12日正式发布。BLOOM 拥有1760亿个参数(决定输入数据如何转换为输出内容的变量),稍多于拥有 1750 亿个参数的 GPT-3。BLOOM拥有1.61TB文本,包含46种自然语言和13种编程语言。相比Meta发布的130亿参数的LLaMA(Large Language Model Meta AI)模型,Bloom参数量更占优势。

  目前,千亿级的轩辕模型已可以在Huggingface中申请下载,面向所有金融机构开放。 下载地址:https://github.com/Duxiaoman-DI/XuanYuan

  度小满CTO许冬亮表示,轩辕大模型是经度小满业务场景中积累的金融数据训练而来的,对金融相关问题的理解比通用大模型更有优势。我们把大模型能力开放给金融机构,有利于推动大模型在金融行业的应用,降低大模型的应用门槛,提升金融行业智能化水平。

  作为AI新基建,大模型在金融及各个行业有着广泛的应用场景。轩辕大模型开源后,对金融机构有何意义?

  许冬亮认为,生成式大模型在内容生成与创作、信息摘要与总结、知识理解与问答、自然交互与对话等方面具备非常出色的能力,在金融场景中会有广泛的应用。在前台,生成式大模型将大幅提升客户经理的专业水平和服务能力,大幅降低客户经理的运营成本,让每个人都拥有24小时在线的专业客户经理成为可能。出色的内容生成能力也将引发营销内容生产能力的大幅提升。在中台,生成式大模型有机会改变企业内知识获取、内容创作、会议与沟通、代码开发与测试的方式,进而大幅提升企业内部办公效率,甚至引发研发测试模式变革,全方位提升金融企业内部运营效率。在后台,大模型将成为智能科技底座的标配,大幅降低智能技术应用的门槛,只需少量标注数据甚至无需调整就可以让智能技术覆盖广泛的场景。

  据悉,度小满依托于百度人工智能技术,已经开展了一系列基于大模型的应用。以风险管理为例,度小满已经将大型语言模型LLM应用在互联网文本数据、征信报告的解读上,通过用文本数据构造的预训练模型以及AI算法,能够将征信报告解读出40万维的风险变量,更好的识别小微企业主的信贷风险。今年5月份,这一工程荣获了“吴文俊人工智能科学技术奖”。今年2月份,百度基于文心大模型技术推出的生成式对话产品“文心一言”(ERNIE Bot)开放生态合作,度小满成为首家接入的金融科技公司。(柯岩)

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 一支画笔 勾勒出乡村百姓的“诗与远方”

  • 委内瑞拉:美方已派遣外交官代表团赴委

独家策划

推荐阅读
8日,中国载人航天工程办公室发布2025年度《中国空间站科学研究与应用进展报告》。
2026-01-09 02:45
日前,生态环境部与国家统计局联合印发《关于发布2023年电力二氧化碳排放因子的公告》,以便于不同主体核算电力消费的二氧化碳排放量。
2026-01-09 02:45
近日,中国农业科学院农产品加工研究所联合国内外科研团队,系统揭示了小麦基因型、灌溉条件、储存方式及制粉工艺影响面团流变特性及产品质量的微观和介观机制。
2026-01-09 02:45
各地要强化标准牵引,结合相关部门人工智能终端智能化分级标准制定和产品智能化等级认定等情况,合理确定补贴品类。
2026-01-09 09:05
从中国机械工业联合会获悉,“十四五”时期是我国环保装备制造行业技术创新爆发期,产业链自主可控率超90%,核心专利数量全球第一,技术装备水平跃升,国际竞争力显著提升,国际市场占有率达23.1%。
2026-01-09 02:55
CES历来是观察前沿技术走向的重要窗口。今年,一个新词被频频提及——“物理人工智能(物理AI,Physical AI)”。
2026-01-08 18:29
从7日在京召开的全国知识产权局局长会议上了解到,根据世界知识产权组织最新发布的《2025年全球创新指数报告》,我国“综合排名进前十、单项排名‘双第一’”。
2026-01-08 02:20
近日,中央农村工作会议在北京召开。会议强调,“加强农业关键核心技术攻关和科技成果高效转化应用,因地制宜发展农业新质生产力”,为做好“三农”工作提供了重要指引。
2026-01-08 02:20
时序轮转一甲子,肇始于一间实验室的中国科技考古,历经六十载深耕求索,终从一片学术荒原,昂首跻身世界学科前沿之列。六十年来,中国科技考古依靠工作者们的汗水、智慧与坚守,写成一段传奇。
2026-01-08 02:20
冰冷坚硬的金属骨架、精确运转的齿轮电机……这,是不是你脑中的“机器人”?其实,还有一种机器人:它们没有坚硬的躯壳,而是以柔软的身体探索世界,它们并不强壮,却不会轻易损坏——这,就是软体机器人。它们像章鱼、蚯蚓、水母等自然界生物一样灵动,能够弯曲、伸展、钻入狭缝,展现出前所未有的环境适应力。
2026-01-08 02:25
近日,工业和信息化部正式公布我国首批L3级有条件自动驾驶车型准入许可,两款分别适配城市拥堵、高速路段的车型将在北京、重庆指定区域开展上路试点。
2026-01-08 02:25
“激光不是自然光,它是人类创造的‘最准的尺’‘最利的刀’,更是能为人类需求精准调光的‘魔法师’。”1月6日,科学家精神百场讲坛在扬州大学开讲,中国科学院院士、天津大学教授姚建铨向现场听众分享了自己60年的科研历程与心得。
2026-01-07 02:30
以前医生判断大脑是否健康,需要进行磁共振检查,这个检查结果用的是西方人群的参考标准。
2026-01-07 02:30
从中国科学院大连化学物理研究所获悉,“面向空间应用的锂离子电池电化学光学原位研究”项目已在中国空间站内开展。神舟二十一号航天员乘组共同在轨操作该项目实验,其中,中国科学院大连化学物理研究所研究员张洪章作为载荷专家发挥了其专业优势。
2026-01-08 02:20
硫化氢气味如臭鸡蛋,在天然气开采、炼油、煤化工中大量产生。它不仅有毒,更是形成酸雨的“元凶”之一。据统计,我国每年待处理的硫化氢约80亿立方米,全球规模更是巨大。如何安全、彻底地处理它,一直是工业界面临的巨大挑战。
2026-01-07 02:30
从生态环境部获悉,日前,南京环境科学研究所秦卫华、李中林、王涛研究团队在《布拉格国家昆虫博物馆馆报》上发表研究成果——西藏吉隆发现猎蝽科猛猎蝽属新物种吉隆猛猎蝽,我国青藏高原生物多样性数据库再添新成员。
2026-01-07 02:30
“人类工程与大自然的完美融合!”不久前,贵州花江峡谷大桥刚刚建成通车便火遍全网,各地游客纷至沓来,只为感受新晋世界第一高桥的壮观雄伟。
2026-01-07 02:30
“一张网”的构建是我国测绘地理信息事业转型升级的生动实践。
2026-01-06 09:53
具身智能作为人工智能与机器人科学交叉的前沿领域,是新一轮产业变革的技术引擎。
2026-01-06 02:45
我国首次航天员洞穴训练日前在重庆市武隆区圆满结束,28名航天员参加了这次训练。
2026-01-06 02:45
加载更多