scaling law 持续见效,让算力就快跟不上大模型的膨胀速度了。「规模越大、算力越高、效果越好」成为行业圭皋。主流大模型从百亿跨越到 1.8 万亿参数只用了1年,meta、google、微软这些巨头也从 2025 年起就在搭建 15000 卡以上的超大集群。「万卡已然成为 ai 主战场的标配。」

7 月 3 日,摩尔线程在上海重磅宣布其 AI 旗舰产品夸娥(KUAE)智算集群解决方案实现重大升级,从当前的千卡级别大幅扩展至万卡规模。摩尔线程夸娥(KUAE)万卡智算集群,以全功能 GPU 为底座,旨在打造国内领先的、能够承载万卡规模、具备万 P 级浮点运算能力的国产通用加速计算平台,专为万亿参数级别的复杂大模型训练而设计。这一里程碑式的进展,树立了国产 GPU 技术的新标杆,有助于实现国产智算集群计算能力的全新跨越,将为我国人工智能领域技术与应用创新、科研攻坚和产业升级提供坚实可靠的关键基础设施。
此外,摩尔线程联合中国移动通信集团青海有限公司、中国联通青海公司、北京德道信科集团、中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司(排名不分先后)分别就三个万卡集群项目进行了战略签约,多方聚力共同构建好用的国产 GPU 集群。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

摩尔线程创始人兼 CEO 张建中表示:“当前,我们正处在生成式人工智能的黄金时代,技术交织催动智能涌现,GPU 成为加速新技术浪潮来临的创新引擎。摩尔线程矢志投身于这一历史性的创造进程,致力于向全球提供加速计算的基础设施和一站式解决方案,为融合人工智能和数字孪生的数智世界打造先进的加速计算平台。夸娥万卡智算集群作为摩尔线程全栈 AI 战略的一块重要拼图,可为各行各业数智化转型提供澎湃算力,不仅有力彰显了摩尔线程在技术创新和工程实践上的实力,更将成为推动 AI 产业发展的新起点。”

AI 主战场,万卡通用算力是标配
大模型自问世以来,关于其未来的走向和发展趋势亟待时间验证,但从当前来看,几种演进趋势值得关注,使得其对算力的核心需求也愈发明晰。
首先,Scaling Law 将持续奏效。Scaling Law 自 2025 年提出以来,已揭示了大模型发展背后的 “暴力美学”,即通过算力、算法、数据的深度融合与经验积累,实现模型性能的飞跃,这也成为业界公认的将持续影响未来大模型的发展趋势。Scaling Law 将持续奏效,需要单点规模够大并且通用的算力才能快速跟上技术演进。
其次,Transformer 架构不能实现大一统,和其他架构会持续演进并共存,形成多元化的技术生态。生成式 AI 的进化并非仅依赖于规模的简单膨胀,技术架构的革新同样至关重要。Transformer 架构虽然是当前主流,但新兴架构如 Mamba、RWKV 和 RetNet 等不断刷新计算效率,加快创新速度。随着技术迭代与演进,Transformer 架构并不能实现大一统,从稠密到稀疏模型,再到多模态模型的融合,技术的进步都展现了对更高性能计算资源的渴望。
与此同时,AI、3D 和 HPC 跨技术与跨领域融合不断加速,推动着空间智能、物理 AI 和 AI 4Science、世界模型等领域的边界拓展,使得大模型的训练和应用环境更加复杂多元,市场对于能够支持 AI+3D、AI + 物理*、AI + 科学计算等多元计算融合发展的通用加速计算平台的需求日益迫切。

多元趋势下,AI 模型训练的主战场,万卡已是标配。随着计算量不断攀升,大模型训练亟需超级工厂,即一个 “大且通用” 的加速计算平台,以缩短训练时间,实现模型能力的快速迭代。当前,国际科技巨头都在通过积极部署千卡乃至超万卡规模的计算集群,以确保大模型产品的竞争力。随着模型参数量从千亿迈向万亿,模型能力更加泛化,大模型对底层算力的诉求进一步升级,万卡甚至超万卡集群成为这一轮大模型竞赛的入场券。
然而,构建万卡集群并非一万张 GPU 卡的简单堆叠,而是一项高度复杂的超级系统工程。它涉及到超大规模的组网互联、高效率的集群计算、长期稳定性和高可用性等诸多技术难题。这是难而正确的事情,摩尔线程希望能够建设一个规模超万卡、场景够通用的加速计算平台,并优先解决大模型训练的难题。

夸娥:国产万卡万 P 万亿大模型训练平台
夸娥(KUAE)是摩尔线程智算中心全栈解决方案,是以全功能 GPU 为底座,软硬一体化、完整的系统级算力解决方案,包括以夸娥计算集群为核心的基础设施、夸娥集群管理平台(KUAE Platform)以及夸娥大模型服务平台(KUAE ModelStudio),旨在以一体化交付的方式解决大规模 GPU 算力的建设和运营管理问题。



夸娥万卡智算解决方案具备多个核心特性:
超大算力,万卡万 P:在集群计算性能方面,全新一代夸娥智算集群实现单集群规模超万卡,浮点运算能力达到 10Exa-Flops,大幅提升单集群计算性能,能够为万亿参数级别大模型训练提供坚实算力基础。同时,在 GPU 显存和传输带宽方面,夸娥万卡集群达到 PB 级的超大显存总容量、每秒 PB 级的超高速卡间互联总带宽和每秒 PB 级超高速节点互联总带宽,实现算力、显存和带宽的系统性协同优化,全面提升集群计算性能。
码上飞
码上飞(CodeFlying) 是一款AI自动化开发平台,通过自然语言描述即可自动生成完整应用程序。
430
查看详情

超高稳定,月级长稳训练:稳定性是衡量超万卡集群性能的关键。在集群稳定性方面,摩尔线程夸娥万卡集群平均无故障运行时间超过 15 天,最长可实现大模型稳定训练 30 天以上,周均训练有效率目标最高可达 99% 以上,远超行业平均水平。这得益于摩尔线程自主研发的一系列可预测、可诊断的多级可靠机制,包括:软硬件故障的自动定位与诊断预测实现分钟级的故障定位,Checkpoint 多级存储机制实现内存秒级存储和训练任务分钟级恢复以及高容错高效能的万卡集群管理平台实现秒级纳管分配与作业调度。

极致优化,超高 MFU:MFU 是评估大模型训练效率的通用指标,可以直接反应端到端的集群训练效率。夸娥万卡集群在系统软件、框架、算法等层面一系列优化,有效计算效率(MFU)目标最高达 60%,可达到国际水平。其中,在系统软件层面,基于极致的计算和通讯效率优化等技术手段,大幅提升集群的执行效率和性能表现。在框架和算法层面,夸娥万卡集群支持多种自适应混合并行策略与高效显存优化等,可以根据应用负载选择并自动配置最优的并行策略,大幅提升训练效率和显存利用。同时,针对超长序列大模型,夸娥万卡集群通过 CP 并行、RingAttention 等优化技术,有效缩减计算时间和显存占用,大幅提升集群训练效率。

全能通用,生态友好:夸娥万卡集群是一个通用加速计算平台,计算能力为通用场景设计,可加速 LLM、MoE、多模态、Mamba 等不同架构、不同模态的大模型。同时,基于高效易用
的 MUSA 编程语言、完整兼容 CUDA 能力和自动化迁移工具 Musify,加速新模型 “Day0” 级迁移,实现生态适配 “Instant On”,助力客户业务快速上线。


万众一芯,共建大模型应用生态
万卡集群的建设需要产业界的齐心协力,为实现大模型创新应用的快速落地,让国产算力 “为用而建”。发布会现场,摩尔线程携手中国移动通信集团青海有限公司、中国联通青海公司、北京德道信科集团、中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司(排名不分先后),分别就青海零碳产业园万卡集群项目、青海高原夸娥万卡集群项目、广西东盟万卡集群项目进行了战略签约。
借助摩尔线程先进的夸娥全栈智算解决方案,各方将携手共建强大的全国产智算平台,以加速产业数字化转型和高质量发展。夸娥万卡智算集群项目标志着国产 AI 算力基础设施的又一重大进展,将为各地的数字经济发展注入新活力。

摩尔线程与中国移动通信集团青海有限公司战略签约

摩尔线程与中国联通青海公司、北京德道信科集团战略签约

摩尔线程与中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司战略签约
发布会后,无问芯穹、清程极智、360、京东云、智平方等五家合作伙伴代表纷纷登台,分享了摩尔线程夸娥智算集群如何助力其在大模型训练、大模型推理、具身智能等不同场景和领域的创新,展现了夸娥智算集群在实际应用中的巨大潜力与广泛适用性。

以上就是AI主战场,万卡是标配:国产GPU万卡万P集群来了!的详细内容,更多请关注其它相关文章!
# 摩尔线程
# 朔州seo推广优化
# 全网营销乛乐云seo
# 唐山营销推广咨询公司排名
# 网站建设策划书范本
# 灵活用工网站建设
# 绥化420seo-80310
# 网站营销推广金手指11
# 北京
# 这一
# 互联
# 基础设施
# 股份有限公司
# 中国联通
# 显存
# 青海
# 标配
# 来了
# type
# udio
# follow
# kuae
# 产业
# 大连公司网站seo优化价格
# 包头网站建设中心
# 章丘做网站优化
相关栏目:
【
Google疑问12 】
【
Facebook疑问10 】
【
优化推广96088 】
【
技术知识133117 】
【
IDC资讯59369 】
【
网络运营7196 】
【
IT资讯61894 】
相关推荐:
华为HarmonyOS 4将集|成人|工智能大型模型
2025WRC世界机器人大赛锦标赛(烟台)收官!斯坦星球勇夺VEX赛项冠亚军!
Bing 聊天机器人现支持在桌面端用语音提问
2025智源大会AI安全话题备受关注,《人机对齐》新书首发
一家 380 亿美元的数据巨头,要掀起企业「AI 化」革命
一文读懂自动驾驶的激光雷达与视觉融合感知
如何用AI开创智慧能源新时代?固德威正让能源“通人性”!
美踏控股推出创新人工智能大数据模型“心乐舞河”:虚拟人音舞社交的新体验
Nature发AIGC禁令!投稿中视觉内容使用AI的概不接收
AI在教育中的角色:AI如何改变我们的学习方式
AI取代人工先拿教育行业开刀?美版“作业帮”启动裁员
如何对员工进行再培训以充分利用供应链管理中的人工智能创新
剧透!蜜小豆@2025世界人工智能大会多个亮点曝光
Midjourney 5.2震撼发布!原画生成3D场景,无限缩放无垠宇宙
华为即将推出HarmonyOS 4,再度领先行业的AI技术
史玉柱谈AI:国内最缺是计算数学人才,曾给浙大数学系捐五千万
抖音在Android平台获得VR|直播|软件著作权
常见的五个人工智能误解
开创全新虚拟现实体验的Pimax Crystal VR头显
助力人工智能产业高质量发展 龙岗区算法训练基地正式启用
AI大模型紫东太初已被注册商标 中科院已注册紫东太初大模型商标
IBM和NASA合作发布可追踪碳排放的开源AI基础模型
WAIC 2025|云深处科技绝影Lite3与X20四足机器人亮相
英伟达的AI领域垄断地位:一直无法撼动吗?
提高开发效率:AmazonCodeWhisperer与Amazon Glue的集成和生成式AI的应用
世界水下机器人大赛:9国青年携手逐梦深蓝
英伟达H100霸榜权威AI性能测试 11分钟搞定基于GPT-3的大模型训练
AI赋能艺术 超现实达利奇幻之旅在沪开启
如何用户外电源给无人机实现持久续航
当人工智能开始写高考作文?作家陈崇正、朱山坡谈文学与未来
华为盘古AI模型实现秒级全球气象预报时间缩短
利亚德加码AI战略,与光年无限图灵机器人全面开展AI研发业务合作
XREAL Beam 投屏盒子正式发布:支持“可悬停 AR 空间屏”
人形机器人概念集体爆发,能买吗?
优傲机器人的人机协作技术 助力中小企发展
眼球反射解锁3D世界,黑镜成真!马里兰华人新作炸翻科幻迷
马斯克嘲讽人工智能:机器学习本质就是统计学
DreamAvatar数字人在哪里下载
2025 WAIC|美团无人机发布第四代新机型
联想戴炜:以全栈AI加速CT与IT融合,共建高质量算力网络
新华全媒+|AI:当心,我可能欺骗了你!
国内首款大尺寸仿鸵双足机器人“大圣”亮相,穿戴红色战袍
揭晓2025年玻尔兹曼奖:Hopfield网络创始人荣获奖项
不止“文心一言”,消息称百度将推出全新 AI 对话软件“万话”
时间、空间可控的视频生成走进现实,阿里大模型新作VideoComposer火了
日本学校探索引入 AI 和无人机:提高安保效率,节省劳动力
特斯拉机器人面世 未来将大幅提振磁材需求,引领人工智能时代
“可用”“有用”的讯飞星火认知大模型将亮相世界人工智能大会
首部国内AI辅助动画片《魔游纪:人工智能辅助篇》预告发布
元宇宙迈入2.0时代,它和生成式人工智能有何关联吗?
2024-07-05
运城市盐湖区信雨科技有限公司是一家深耕海外推广领域十年的专业服务商,作为谷歌推广与Facebook广告全球合作伙伴,聚焦外贸企业出海痛点,以数字化营销为核心,提供一站式海外营销解决方案。公司凭借十年行业沉淀与平台官方资源加持,打破传统外贸获客壁垒,助力企业高效开拓全球市场,成为中小企业出海的可靠合作伙伴。