来源:互联网 更新时间:2026-06-09 01:27
6月9日消息,据媒体报道,日前,
仅用一个月时间,项目团队便基于昇腾910C国产算力集群,成功实现DeepSeek-V4-Pro的全参数续训练与SFT(监督微调)稳定运行。训练累计完成超过1500步,模型训练MFU(模型算力利用率)超过30%,关键训练算子效率提升约14%。
DeepSeek-V4-Pro是一款拥有1.6万亿参数的MoE(混合专家)开源旗舰模型,采用了CSA+HCA混合稀疏注意力、mHC连接等创新机制。相比上一代DeepSeek-V3/R1,它对国产训练框架提出了全方位的“极限挑战”。
经过联合攻关,项目已在千卡级昇腾910C国产算力集群上实现了DeepSeek-V4-Pro全参数后训练的稳定运行。
模型迭代超过1500步,全程无迭代跳过或NaN异常。关键训练算子效率较初始版本提升约14%,最终MFU稳定达到34.9%,单步训练时间稳定在27秒。团队同步打通了DeepSeek‑V4‑Flash的全参数续训练与SFT完整链路。
本次成果并非单次演示,而是具备可复现、可工程化交付的万亿级MoE模型国产算力稳定训练能力。项目已完成工业级自动化运筹建模场景的闭环验证,证明国产算力能够在短周期、低成本下完成行业大模型的专项增强训练。
技术层面,项目实现了三大突破:一是成功构建了覆盖权重、梯度、激活、优化器状态的分布式承载方案,实现数据并行、张量并行、流水并行与专家并行的协同工作;二是优化了MoE路由与稀疏注意力算子,建立了专家负载均衡机制,有效缓解通信拥堵与负载失衡;三是构建了全指标可视化的长稳监控体系,在多日连续训练中未出现一次Loss失控或NaN值。
在能力验证环节,项目设计了一项“硬核”实验——增强大模型的数学建模能力。团队搭建了一条SFT建模数据生产工作流,产出3000条高质量数学建模任务SFT样本,覆盖4类目标任务与3种问题形态。
训练结果显示:模型LM Loss收敛至0.2056,MTP 1 Loss收敛至0.2538,梯度曲线平稳。

为何比特币BTC价格跌破7.3万美元?一文拆解影响近期比特币行情的五大原因
摩托车活塞环性能如何
ThinkBook系列最新价格全解析:2026年选购避坑与实时询价指南
GPT5.6惨遭切脑,Fable 5回归要变弱鸡版?
Ondo将于今日上线股票永续合约
暗黑4S14野蛮人终局BD攻略
电视剧《罗曼诺夫后裔》剧情介绍
《三角洲行动》S10赛季卡邮件技巧详解-三种方法及风险提示
如何在火狐浏览器中彻底禁用自动更新功能?
区块链OTC交易所有哪几家比较正规?
手机qq浏览器误删文件如何找回-手机qq浏览器误删除文件怎样恢复
360浏览器如何设置网页缩放比例
《三角洲行动》GTI超人成就解锁攻略-满辐射状态击杀技巧详解
全链网:戴蒙或继续担任摩根大通首席执行官三年
什么是山寨币?山寨币指数如何查看?全球前10大山寨币盘点
Binance新增15种bStocks代币化证券为杠杆抵押资产
Sophon正在关闭其Layer2区块链并迁移到Base
全球十大加密货币APP v3.11.5正版下载
异环1.2前瞻什么时候
《三角洲行动》ASh-12战斗步枪改装攻略-省钱与击杀方案详解
手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc