点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:“轩辕”来了!国内首个千亿级中文金融大模型宣布开源
首页> 科技频道> 综合新闻 > 正文

“轩辕”来了!国内首个千亿级中文金融大模型宣布开源

来源:光明网2023-05-26 21:23

  近日,度小满正式开源国内首个千亿级中文金融大模型——“轩辕”。轩辕大模型是在1760亿参数的Bloom大模型基础上训练而来,在金融名词理解、金融市场评论、金融数据分析和金融新闻理解等任务上,效果相较于通用大模型大幅提升,表现出明显的金融领域优势。

  在金融场景中的任务评测中,轩辕全面超越了市场上的主流开源大模型,赢得了150次回答中63.33%的胜率,充分凸显了其在金融领域的显著优势。在通用能力评测中,轩辕有10.2%的任务表现超越ChatGPT 3.5,61.22%的任务表现与之持平,涉及数学计算、场景写作、逻辑推理、文本摘要等13个主要维度。

  为了提升轩辕大模型对金融领域问题的理解能力,度小满将自身业务中积累的金融领域的千亿tokens的中文预训练数据集用来训练模型。该数据集涵盖了金融研报、股票、基金、银行、保险等各个方向的专业知识。度小满表示,经过清洗和标注的高质量数据集,不仅在通用性方面与ChatGPT达到持平成为可能,且显著提升了模型在金融垂直领域的性能。

  BLOOM(Big Science Language Open-science Open-access Multilingual)是2021年由 1000 多名志愿研究人员在一个名为“大科学 BigScience”的项目中创建,2022年7月12日正式发布。BLOOM 拥有1760亿个参数(决定输入数据如何转换为输出内容的变量),稍多于拥有 1750 亿个参数的 GPT-3。BLOOM拥有1.61TB文本,包含46种自然语言和13种编程语言。相比Meta发布的130亿参数的LLaMA(Large Language Model Meta AI)模型,Bloom参数量更占优势。

  目前,千亿级的轩辕模型已可以在Huggingface中申请下载,面向所有金融机构开放。 下载地址:https://github.com/Duxiaoman-DI/XuanYuan

  度小满CTO许冬亮表示,轩辕大模型是经度小满业务场景中积累的金融数据训练而来的,对金融相关问题的理解比通用大模型更有优势。我们把大模型能力开放给金融机构,有利于推动大模型在金融行业的应用,降低大模型的应用门槛,提升金融行业智能化水平。

  作为AI新基建,大模型在金融及各个行业有着广泛的应用场景。轩辕大模型开源后,对金融机构有何意义?

  许冬亮认为,生成式大模型在内容生成与创作、信息摘要与总结、知识理解与问答、自然交互与对话等方面具备非常出色的能力,在金融场景中会有广泛的应用。在前台,生成式大模型将大幅提升客户经理的专业水平和服务能力,大幅降低客户经理的运营成本,让每个人都拥有24小时在线的专业客户经理成为可能。出色的内容生成能力也将引发营销内容生产能力的大幅提升。在中台,生成式大模型有机会改变企业内知识获取、内容创作、会议与沟通、代码开发与测试的方式,进而大幅提升企业内部办公效率,甚至引发研发测试模式变革,全方位提升金融企业内部运营效率。在后台,大模型将成为智能科技底座的标配,大幅降低智能技术应用的门槛,只需少量标注数据甚至无需调整就可以让智能技术覆盖广泛的场景。

  据悉,度小满依托于百度人工智能技术,已经开展了一系列基于大模型的应用。以风险管理为例,度小满已经将大型语言模型LLM应用在互联网文本数据、征信报告的解读上,通过用文本数据构造的预训练模型以及AI算法,能够将征信报告解读出40万维的风险变量,更好的识别小微企业主的信贷风险。今年5月份,这一工程荣获了“吴文俊人工智能科学技术奖”。今年2月份,百度基于文心大模型技术推出的生成式对话产品“文心一言”(ERNIE Bot)开放生态合作,度小满成为首家接入的金融科技公司。(柯岩)

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • “冰城”百年老街的璀璨冬夜

  • 雪后探访东北虎

独家策划

推荐阅读
作为全国首个商业航天共性试验和科研生产基地,“北京火箭大街”项目由亦庄控股旗下城市更新公司投资、开发、运营管理
2026-01-13 17:38
力鸿一号遥一飞行器12日在酒泉卫星发射中心圆满完成亚轨道飞行试验任务,返回式载荷舱顺利着陆完成回收。本次飞行试验圆满完成返回式载荷舱的再入大气层返回减速与回收验证,
2026-01-13 03:35
从耳畔低语的智能伴侣,到街头无声行驶的自动驾驶车辆,科技正褪去冰冷外壳,融入人们日常生活。谷歌计划将AI技术嵌入人们日常依赖的应用Gmail内,让其帮助总结冗长的邮件,并撰写得体的回复。
2026-01-13 09:07
南极秦岭站附近,几只黑白分明、步履蹒跚的阿德利企鹅歪着头,打量着不远处向他们热情招手的中国考察队员。今年,中国第42次南极考察队又一次如约而至,继续开展对这些极地“原住民”的监测研究。
2026-01-13 09:06
滑动轴承被称为工业装备的“关节”,其性能直接决定了重型机械、精密机床、高效电机乃至风力发电机、高速列车等高端装备的可靠性、效率与寿命。
2026-01-13 09:06
数据显示,自港珠澳大桥珠海公路口岸开通以来,经港珠澳大桥边检站查验内地旅客数量已超过3938万人次,仅2025年就超过1257万人次,创历史新高。
2026-01-13 09:05
工信学堂致力于推动学生人工智能素养的全面提升,助力拔尖创新型人才培养,为我国未来工信科技人才队伍储备力量。
2026-01-12 15:41
在斯图尔特的农场,赞比亚大豆科技小院首席专家、吉林农业大学教授魏健疆手把手教会当地农户“作物—菌物—肥料”闭环生产。
2026-01-12 08:59
记者1月11日从国家数据局获悉,国家数据局将进一步研究借鉴其他领域登记制度的经验做法,不断吸收社会各界的意见建议,创新建立适应数据特点的登记制度,更好推进数据流通使用,释放数据要素价值。
2026-01-12 08:54
目前团队正牵头建设贵州省人工智能实验室,将吸引更多算力产业链上下游企业集聚贵州,助力数字经济高质量发展。
2026-01-12 08:53
为适配医保业务的新形势新要求,助力中医药产业高质量发展,近日,国家医保局修订中药饮片医保编码规则。这相当于给每一味中药饮片都配上了新的“医保身份证”。
2026-01-12 08:51
以大模型为代表的新一代人工智能技术,深度赋能医疗健康领域,在医学影像判读、疾病风险预警、辅助诊疗决策等领域展现出巨大潜力和应用价值,有力助推临床诊疗模式优化升级,
2026-01-12 03:05
这条光缆,打破了地理困局,让贵州算力真正具备了“走出去”的能力。光缆为算力的灵活调配贯通了“路”,“息壤”平台如同光缆上的“智能交通指挥中心”,将西部算力资源与东部算力需求精准匹配。
2026-01-12 08:53
8日,中国载人航天工程办公室发布2025年度《中国空间站科学研究与应用进展报告》。
2026-01-09 02:45
日前,生态环境部与国家统计局联合印发《关于发布2023年电力二氧化碳排放因子的公告》,以便于不同主体核算电力消费的二氧化碳排放量。
2026-01-09 02:45
近日,中国农业科学院农产品加工研究所联合国内外科研团队,系统揭示了小麦基因型、灌溉条件、储存方式及制粉工艺影响面团流变特性及产品质量的微观和介观机制。
2026-01-09 02:45
各地要强化标准牵引,结合相关部门人工智能终端智能化分级标准制定和产品智能化等级认定等情况,合理确定补贴品类。
2026-01-09 09:05
从中国机械工业联合会获悉,“十四五”时期是我国环保装备制造行业技术创新爆发期,产业链自主可控率超90%,核心专利数量全球第一,技术装备水平跃升,国际竞争力显著提升,国际市场占有率达23.1%。
2026-01-09 02:55
CES历来是观察前沿技术走向的重要窗口。今年,一个新词被频频提及——“物理人工智能(物理AI,Physical AI)”。
2026-01-08 18:29
加载更多