来源:互联网 更新时间:2026-08-13 14:30
2024年SECon全球软件工程技术大会的议题,恰好契合了“拥抱AI 走深向实”的主题。分享的核心,正是基于开源模型构建领域模型的落地实践。
国内大模型市场正经历一场深刻变革。百模大战打到现在,三个趋势已经非常明显:开源模型的能力在急速攀升;ToB和ToC两个赛道开始各走各路;企业对大模型的需求,也从最初的“什么都试试”转向了“聚焦核心业务,解决实际问题”。大模型正在加速与产业融合,催生出新的市场机遇。在这个背景下,Llama 3作为目前性能最强的开源基座模型,给企业打造领域模型、实现行业价值赋能,提供了一个相当不错的起点。
这次分享,主要围绕三个核心问题展开:
1.
下面,就展开聊聊这几个核心问题。
在人工智能领域,开源大模型正在快速崛起,成为一股不可忽视的技术力量。目前“百模大战”中,模型数量已经超过300个,各家供应商也开始找准自己的市场定位。生态的繁荣,直接催生了ToB和ToC市场的双线开花。
一边是互联网大厂和创业公司,基于自研大模型猛攻C端市场,通过Web端、App或小程序反赌,核心是优化用户体验,用丰富的供给来激发用户需求。另一边,是各垂直领域的企业和解决方案服务商,它们基于开源或闭源模型,为特定行业提供真实可用的场景化方案。

除了供给侧的变化,企业对大模型的需求也从“广泛探索”转向了“核心业务深化”。大家更务实了,目标非常明确:用大模型解决垂直领域的具体问题,提升ROI。但问题是,大模型在专业性、泛化性和经济性之间,很难做到三者兼顾。这就要求企业必须专注在核心业务上,细化场景,明确目标,用实际效果来说话。

企业对大模型的核心诉求,归结起来就两件事:把私域数据转化成竞争优势,同时确保场景应用的安全可控。而基于开源模型进行适配调优,是当前实现这个目标最有效的路线。
直接上闭源模型,私域数据的安全和隐私是个大问题。直接用开源模型吧,又可能碰到性能瓶颈。走“开源模型+Prompt+知识库”的路线,灵活性提高了,但处理复杂指令时就会出现挑战,而且prompt的编写难度实在不低。相比之下,基于开源模型进行针对性微调,可以很好地平衡这些问题:在少量领域数据上快速适配,自主选择模型结构和优化策略,全流程掌控数据和模型,杜绝泄露风险。这才是真正的定制化、高效性、灵活性和可控性兼得。
那么,如何选择开源基座呢?关键在哪?在于

Llama 3作为目前最强的开源模型,隐性能力扎实,显性能力领先,确实为领域赋能带来了全新的机会。

不过,Llama 3虽然表现出色,但在中文处理能力、专业场景应用和在线服务能力这三个关键方面,仍然面临不小的挑战。

一个反复被提及的观点是:
“中学生”阶段,大模型需要掌握广泛的语言理解和信息处理能力,打好基础;“大学生”阶段,则要在大规模通用文本数据上训练,深入了解金融术语、行业案例、专家经验和最佳实践,逐步具备行业所需的专业能力;最终成为“职场人”,以岗位产出为导向,通过真实场景的反馈,持续提高模型性能和适应性。这三个阶段,分别对应了数据优化、金融增强、价值对齐和应用增强等不同的构建环节。
除了这三个阶段,构建领域大模型还有

具体到工程层面,首先是
团队打造的质量模型库,包括了文本质量判别、知识性判别和内容结构判别等多个模型,对数据质量进行了全方位把控。人工评测结果显示,过滤后的数据质量提升了48%,直接推动了模型性能的显著提升。

另外,数据安全是重中之重。团队基于多领域内容安全标准,搭建了业内领先的内容安全系统,高效识别恶意内容,将多领域敏感恶意内容过滤至1%以内,满足了领域安全的需求。

当然,

重点来了——Llama3的中文增量预训练具体怎么做?首先得考虑

值得一提的是,我们创新了


指令微调阶段,我们分为混合微调和指令微调两个阶段进行,兼顾了大模型的通用能力与领域能力。为了高质量、低成本地构建指令微调数据,团队

在指令微调基础上,团队
而
场景增强是领域模型的方向,包括
为了科学评估模型性能,精准指引优化路径,团队构建了全方位的评测体系。通过不同模型间的“横评”看差距,通过同一模型在不同阶段的“纵评”看提升。评测覆盖预训练、指令微调和应用三个阶段,每个阶段都有相应的指标。评测手段包括实时评测和阶段评测,实时评测通过CheckPoint自动触发,阶段评测则采用“自动+人工”的立体化体系。此外,
到此,我们展示了度小满从Llama3到金融行业的完整解决方案。
为了应对大模型在金融场景的落地挑战,向行业分享实战经验,我们开源了「轩辕」系列大模型。
「轩辕」在金融领域的内容理解和生成上能力卓越。在金融自动评测集FinanceIQ上,XuanYuan-70B-V2展现了超过GPT-4的水平,表现出专家级的金融知识能力。在解决实际金融任务时,金融专家的人工评测结果显示,各个参数尺寸的轩辕模型均具有“以小搏大”的实力,达到自身2到5倍参数量的模型水平。
「轩辕」系列大模型的技术认知和实践经验,也毫无保留地总结成了
期待模型能力、场景应用和人机协作全面升级的AGI时代。
黄金价格不断创新高!黄金稳定币XAU、PAXG市值达11亿美元
新浪机器学习热点小时报丨2026年07月25日18时_今日实时机器学习热点速递
CC币价格预测(2026-2035):Canton币今日价格走势+长期价格预测
新浪互联网热点小时报丨2026年07月26日16时_今日实时互联网热点速递
腾讯ima怎么把微信内容一键导入知识库?
腾讯ima怎么创建共享知识库?
今日比特币暴涨分析:Metaplanet的比特币BTC投资推动股价上涨17%
蚂蚁庄园今日答案7月21日(今日已更新) 蚂蚁庄园今天正确答案是什么呢
新浪人工智能热点小时报丨2026年07月30日18时_今日实时人工智能热点速递
2026热门直线加速赛车手游推荐:高人气、爽快加速体验的精品榜单
Intel喜讯连连:18A工艺良率提升到85%、CPU将涨价15%
Windy卫星云图怎么看?云层变化识别技巧
kimi提示词专家使用方法新手指南
原神霜月三处月灵龛具体位置汇总
《幻兽帕鲁》不触发通缉捕捉传说商人方法
短剧《史上最强洪荒修为》剧情介绍
Aptos(APT)币是什么?APT代币经济学、价格预测及投资前景
9条破亿视频,新号涨粉百万,过去半年谁在制造AI爆款?
如何修复Edge浏览器无法通过微软账号进行身份验证?
为什么推特KOL都在BRC20赚钱 我一冲就亏?
手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc